📌 28 мая Yandex Cloud провёл конференцию AI2Business. Среди ключевых анонсов было четыре, и по отдельности каждый похож на проходной апдейт. Вместе они складываются в четыре сдвига, которые стоит проговорить.

🔸 Сдвиг 1. Российский AI-стек становится мультимодельным Главная новость конференции. Яндекс открыл в облаке доступ к модели DeepSeek V4 Flash с контекстным окном в миллион токенов. Это первая такая модель, доступная в российском облаке. В марте в Studio подключили DeepSeek V3.2, 28 мая её заменили на V4 Flash. В каталоге Yandex AI Studio уже более двух десятков моделей, включая Qwen, DeepSeek, Gemma. Стратегия меняется. Раньше задача формулировалась как продать клиенту свою модель, теперь как удержать клиента в инфраструктуре, дав любую модель под задачу.

🔸 Сдвиг 2. От универсальных моделей к специализированным На конференции запустили Alice AI LLM Flash, лёгкую версию флагмана для бизнеса. В пять раз дешевле полной модели, оптимизирована под текстовые и документные задачи (около 60% всех B2B-запросов к Яндексу). Та же логика, по которой DeepSeek выпускает Flash-версии, OpenAI делает mini-модели, Anthropic выпускает Haiku. Рынок взрослеет от "одной модели на всё" в сторону специализированных решений под класс задач, где приоритет на скорости отклика и стоимости.

🔸 Сдвиг 3. Порог входа в разработку голосовых агентов упал Третий анонс. Интерфейс для сборки голосовых ИИ-агентов в Yandex AI Studio. Раньше написание такого агента занимало дни или недели, теперь несколько минут. Подключение к телефонии по SIP, готовая модель Speech Realtime, работа с русским и казахским языком. Голосовой AI больше не задача для большой команды разработки. Малый бизнес с минимальной командой может собрать рабочий прототип сам.

🔸 Сдвиг 4. AI-инфраструктура переходит в формат подписки Yandex B2B Tech, Selectel и MetaMentor запустили совместный продукт On-Premises AI-as-a-Service. Компания арендует ПАК с GPU-серверами, на которых уже стоит Yandex AI Studio. Типовой пилот на три месяца может стоить около 5,8 млн рублей. Закупка собственного оборудования заняла бы от нескольких месяцев до года, а сервер с восемью картами Nvidia H200 стоит десятки миллионов рублей только за железо, без лицензий и развёртывания. Это сдвиг от капекса к опексу. Компании больше не готовы вкладывать в инфраструктуру под гипотезу, хотят попробовать на пилоте и потом решать.

❗️Что в сумме. Российский AI-рынок прошёл стадию "у нас есть LLM". Сейчас он на стадии инфраструктуры внедрения. Соревнование сместилось с моделей на способы их доставки в бизнес. Выигрывает тот, кто проще и быстрее даёт пилот.

✅ Мы как раз помогаем компаниям пройти эту стадию: собрать пилот, протестировать гипотезу, не тратя на железо и месяцы разработки. Пишите в личку, если есть задача.

#ИИ #AI #Нейросети #Yandex ——— #Инструменты ✍️ Подписывайтесь: @aiforproduct


В этом посте были ссылки, но мы их удалили по правилам Сетки

📌 28 мая Yandex Cloud провёл конференцию AI2Business. Среди ключевых анонсов было четыре, и по отдельности каждый похож на проходной апдейт | Сетка — социальная сеть от hh.ru