#разборновостей

Все видео в моем телеграмм канале

• HeyGen запускает первую в мире "креативную ОС" для видео (маркетинговое название)

HeyGen представили Video Agent — это что-то типа ИИ-режиссера и монтажёра в одном флаконе. Можно загрузить документ, футаж или просто пару строк текста — агент анализирует ввод, сам находит сюжет, пишет сценарий, подбирает и генерирует видео, "нанимает" актёров (ИИ-аватары), собирает всё вместе, выставляет темп и делает монтаж, даже титры автоматически оформляет.

Так что теперь ИИ-сервис может сделать для вас всё — от рекламы до TikTok или демо любого продукта. Сотни "стартапов-автоматизаторов видео" явно сейчас грустят: у HeyGen совсем другой масштаб и подход. Мы тоже грустим, потому что также смотрели в эту сторону. Записаться в waitlist можно тут


• Сбер выпустил Kandinsky 4.1 Video

Новая версия видеомодели — Kandinsky 4.1 Video — представлена на GigaConf 2025. ИИ помогает создавать короткие ролики по текстовому описанию, делает это быстрее и выразительнее: лучше понимает промпт, точнее работает с композицией, визуальными эффектами.

Модель теперь гораздо производительнее, время генерации сократилось в три раза, отдельный акцент — на баланс между скоростью и качеством. Первыми доступ получили участники конференции, а для всех остальных — обещают скоро открыть. Выглядит, конечно, пока не очень.


Cloud.ru: новый помощник Клаудия и Evolution AI Factory

Cloud.ru сразу на GigaConf анонсировали два релиза:

  • Клаудия — ИИ-ассистент для работы в облаке. Автоматизирует DevOps (вот это очень приятно!), помогает настраивать виртуалки, мониторинг, работает прямо в консоли как второй пилот. Уже доступен в Public Preview.
  • Evolution AI Factory — облачная среда для своих LLM и экспериментов с ИИ. Есть Jupyter, готовые API, инструменты для файнтюна, инференса, всё в одном месте.

Что ж, держим кулачки. Я сам использую Railway, Yandex Cloud и Digital Ocean, поэтому Клаудию не планировал пробовать. Но если кто-то попробует — дайте знать, интересно.


• Google DOPPL — снова примерочная, но в США

Google выпустили Doppl — мобильное приложение для виртуальной примерки одежды. Просто загружаете своё фото в полный рост, выбираете одежду (фото, скриншот), и уже через секунду видите себя в новом образе. Вишенка на торте — ИИ ещё и анимирует примерку: короткое видео в конце.

Пока только для пользователей из США, но сам факт — теперь у Google есть свой "убийца виртуальных примерочных". У нас в Авато тоже есть примерочная, настроенная именно для Ozon/Wildberries продавцов. Думаю, скоро будет достурно всем


• Inception Labs Mercury — хотят уделать Groq по скорости

Вышла Mercury — первая коммерческая LLM на диффузионной архитектуре. Она не пишет текст по токенам, а сразу генерирует весь кусок, как модели для картинок. В тестах Mercury уже на уровне GPT-4.1 nano, но работает в 7 раз быстрее! Есть и вариант для кода — Mercury Coder, а подобные подходы пробует и Google (Gemini). Опять же хорошо подойдёт хорошо для голосовых интерфейсов, где важна скорость. Жду очень что-то такое в open-source.

Потестить бесплатно API


• FLUX.1 Kontext [dev] — теперь можно делать лоры

Black Forest Labs выпустили FLUX.1 Kontext — опенсорсная модель, идеально подходящая для редактирования картинок без потери сути. Сохраняет оригинальные объекты, отлично подходит для аккуратных правок. Похуже на PRO и MAX версий, но зато можно натренировать свой стиль редактирования (если, например, хотите делать из обычных фото советский стиль мультфильмов). Доступно бесплатно на HuggingFace, можно тренировать LoRA на fal.ai.

Подробнее: