FireRedVAD

FireRedVAD — это передовая система детекции голосовой активности и аудиособытий промышленного уровня, поддерживающая более 100 языков.

Она превосходит другие модели, такие как Silero-VAD, TEN-VAD, FunASR-VAD и WebRTC-VAD, обеспечивая высокую точность и надежность.

Модель основана на архитектуре DFSMN (Deep Feedforward Sequential Memory Network) с 8 блоками DFSMN и одним слоем DNN, что делает её легковесной и эффективной.

Lang: Python https://github.com/FireRedTeam/FireRedVAD