⏺ Исследователи Яндекса раскрыли принципы работы нейросети для распознавания голосовых команд на фоне шума
Разработка уже внедрена в линейку умных устройств компании, а теперь стала доступна и для внешних разработчиков. Научная статья опубликована на arXiv.
Техническая особенность подхода Яндекса заключается в применении архитектуры с attention-механизмом, который в реальном времени выбирает оптимальный аудиосигнал для анализа. В отличие от стандартных решений, где отдельно реализованы шумоподавление и эхоподавление, данная модель параллельно анализирует два варианта входного сигнала — прошедший через noise suppression и через echo cancellation. Нейросеть динамически оценивает качество каждого потока и переключается на наиболее чистый фрагмент. Это позволяет системе эффективно работать в сложных акустических условиях, минимизируя искажения речи и сохраняя высокую точность распознавания.
💬 Участвуйте в новом розыгрыше 💬 Читайте нас в: | Telegram | VK | Сайт |
В этом посте были ссылки, но мы их удалили по правилам Сетки