Realtime без костылей
Thinking Machines показали AI-модель, где realtime встроен прямо в архитектуру, а не собран сверху из отдельных модулей вроде распознавания речи, синтеза и агентной обвязки (https://thinkingmachines.ai/blog/interaction-models/).
Почему это важно: сейчас почти все ИИ работают как чат. Ты договорил → модель подумала → ответила. Из-за этого живой диалог ощущается медленным и неестественным.
Новая система работает иначе. Модель постоянно принимает аудио, видео и текст небольшими кусками по 200 мс и одновременно генерирует ответ. Она умеет реагировать на паузы, перебивания и визуальный контекст почти в реальном времени.
Ещё интереснее — фоновый агент. Пока основная модель разговаривает с человеком, отдельный процесс может параллельно выполнять длинные задачи и потом возвращать результат в диалог.
По сути, индустрия движется от «чат-бота» к ощущению постоянного присутствия ИИ рядом.
Если подход взлетит, живой перевод, голосовые ассистенты, AI-тьюторы и помощники в работе перестанут быть набором костылей с лагами.
ИИ начнёт не ждать своей очереди в разговоре, а реально существовать внутри него.
· 19.05
короче, звучит круто, но все эти технологии пока далеки от идеала. часто встречаются глюки, когда ИИ не понимает контекст. жду, когда это станет нормой, а не исключением )) но пока радует, что движемся к более естественным взаимодействиям.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён