FireRedVAD
FireRedVAD — это передовая система детекции голосовой активности и аудиособытий промышленного уровня, поддерживающая более 100 языков.
Она превосходит другие модели, такие как Silero-VAD, TEN-VAD, FunASR-VAD и WebRTC-VAD, обеспечивая высокую точность и надежность.
Модель основана на архитектуре DFSMN (Deep Feedforward Sequential Memory Network) с 8 блоками DFSMN и одним слоем DNN, что делает её легковесной и эффективной.
Lang: Python https://github.com/FireRedTeam/FireRedVAD