Google выпускает Gemini 3.1 Flash TTS для точного управления синтезом речи

Google презентовала Gemini 3.1 Flash TTS — современную систему синтеза речи, в которой параметры звучания настраиваются с помощью специальных текстовых тегов. Инструмент позволяет регулировать интонацию, ритм и эмоции в рамках запросов, а также моделировать диалоги с несколькими собеседниками и фиксировать их голосовые профили.

Разработка поддерживает свыше 70 языков и использует невидимую маркировку SynthID для верификации контента, что повышает безопасность и упрощает производство профессионального аудио для коммерческих нужд.

Ссылка: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-flash-tts/ @AIandproducts