Речь клиентов перестала уходить в чужое облако

Реальный проект: расшифровку разговоров подняли на своём сервере вместо облачного сервиса. Аудио с записями клиентов и совещаний теперь не покидает компанию вообще. Несколько внутренних продуктов компании одновременно уперлись в одну задачу — расшифровку речи. Записи разговоров с клиентами и внутренних совещаний планировали прогонять через облачный сервис распознавания, как это обычно и делают. Но тут встал вопрос: а куда физически уходит аудио с переговорами клиентов? Ответ — на чужие серверы, вне периметра компании. Для части записей это было неприемлемо, плюс облачная модель оплаты означала, что счёт растёт вместе с объёмом разговоров без потолка. Что сделали Я отвечал за архитектуру собственного сервиса распознавания речи: очередь обработки, кэш, разные режимы распознавания под разные задачи, эксплуатацию и разбор отказов. Подняли распознавание на видеокарте внутри компании — аудио теперь не покидает периметр вообще. • Где обрабатывается аудио: было — внешний облачный сервис, стало — собственный сервер компании • Скорость обработки: стало в 21 раз быстрее реального времени записи • Модель затрат: было — плата за каждую минуту аудио, стало — фиксированная стоимость, не зависящая от объёма • Ожидание пользователя: было — крутящийся индикатор без понимания сроков, стало — «готово через 5 минут» Главный эффект — не скорость, а контроль над данными: конфиденциальные разговоры с клиентами обрабатываются внутри компании, а не прогоняются через стороннюю инфраструктуру.

Речь клиентов перестала уходить в чужое облако | Сетка — социальная сеть от hh.ru