🎙️ РЕЧЬ БОЛЬШЕ НЕ ТЕРЯЕТСЯ Пока человек ещё думает, где поставить запятую, новая модель уже разобрала разговор на голоса и записала всё по порядку. Даже если собеседники перебивают друг друга и перескакивают между языками. 🧠 КОРОТКО: В ЧЁМ СУТЬ? • 🧠 Meta выпустила новую модель для аудио Meta Superintelligence Labs представила Muse Voice Transcribe — систему, которая переводит речь в текст прямо во время разговора.

• 👥 Она различает участников Модель определяет, кто именно говорил, даже если в записи больше 20 собеседников. Перебивания и разговоры большой компанией для неё тоже не повод сдаться.

• 🌍 Понимает смешение языков Muse Voice Transcribe работает с более чем 70 языками и умеет распознавать code-switching — когда в одной фразе внезапно встречаются русский, английский и немного офисного диалекта.

• ⏱️ Длинные записи не нужно дробить Модель обрабатывает записи дольше часа без дополнительной обработки. Записал разговор — получил текст, а не аудиофайл размером с маленький архив.

• 🎯 Паузы и термины тоже учитываются Система понимает, закончил человек мысль или просто замолчал на секунду, а также учитывает имена, названия и специальные термины. 🔥 ПОЧЕМУ ЭТО ЦЕПЛЯЕТ?Текст появляется в реальном времени Не нужно ждать, пока запись «переварится» после разговора. Речь сразу превращается в текст — почти как стенографист, только без блокнота и усталых глаз ⚡

Спикеров не придётся раскладывать вручную Раньше после встречи нужно было угадывать, кто сказал важную мысль. Теперь модель сама расставляет говорящих, включая случаи с перебиваниями 👥

Смешанные языки больше не ломают запись Для международных команд и тех, кто легко перескакивает с русского на английский, это особенно полезно. Не придётся выбирать один язык и делать вид, что остальные запрещены 🌐

Контекст помогает не коверковать имена Названия компаний, термины и имена собственные распознаются с учётом контекста. Это важнее, чем кажется: одна ошибка в фамилии — и протокол уже выглядит как квест 📝

Модель уже попала в рабочие продукты Muse Voice Transcribe доступна через Meta Model API, используется в Meta AI для Mac и Muse Code. По данным новости, система также заняла первое место в рейтинге Artificial Analysis среди потоковых систем распознавания 🏆 💼 КАК НА ЭТОМ ЗАРАБАТЫВАТЬ?Встречи можно сразу превращать в протокол Потенциальный сценарий: команда заканчивает созвон, а на выходе получает текст с отметками спикеров. Не нужно второй раз переслушивать час записи ради одной договорённости 📋

Интервью станет проще выпускать Потенциальный сценарий: журналист записывает разговор с несколькими гостями и получает расшифровку с разделением участников. Дальше из неё проще собрать статью, цитаты или субтитры 🎙️

Голосовой ввод становится менее раздражающим В Meta AI для Mac модель уже используется для голосового ввода. Если она правильно понимает паузы, фраза не должна обрываться каждый раз, когда человек на секунду задумался 💻

Разработчики могут встроить это в свои сервисы Через Meta Model API Muse Voice Transcribe можно использовать как основу для приложений, которым нужны потоковая расшифровка и определение говорящих. Конкретные сценарии зависят от того, как разработчик соберёт продукт 🔧

Человеческая проверка всё ещё нужна Даже сильная транскрибация не отменяет редактуру, особенно для важных документов, имён и специализированной лексики. Машина хорошо снимает рутину, но финальный смысл лучше проверять человеку 👀 🔹🔹🔹🔹🔹🔹 🏆 ЛУЧШИЕ ПРОМПТЫ В PROJECT POOL 🤖 ИИ АГЕНТЫ — собери своего 📈 ИИ-агенты. - просто и понятно #новости #news #нейросети #ии


В этом посте были ссылки, но мы их удалили по правилам Сетки