Давно не делал #разборновостей, поэтому разбил на 2 части

Все видео в моем телеграмм канале

Это часть по персональным инструментам

Perplexity запустил свой браузер Comet, но не для всех (1 видео) Долгожданный Comet — новый браузер с ИИ-ассистентом от Perplexity — уже доступен, но только для обладателей Max-подписки ($200/мес). Для остальных — лист ожидания. По сути, это привычный Perplexity, но теперь в виде отдельного браузера: – Саммари страниц, автозаполнение форм, работа с запросами прямо из адресной строки – Поддержка Spaces и коллекций вкладок для ресёрча – Ассистент открывается сбоку, можно работать и через строку поиска Фишка: агент реально может логиниться в ваши сервисы и выполнять действия от вашего имени (не как Operator, а реально автономно). Теперь война браузеров — GenSpark, Comet, OpenAI делает свой и много кто ещё. Посмотрим что из этого получится, но переход в новый браузер — это всегда хлопотно. Зато победитель забирает очень много внимания пользователя.


Higgsfield Soul ID: теперь твой стиль — твой аватар (2 видео) Это мы недавно обсуждали — Soul ID. Загружаешь 20–25 своих фото — и получаешь персонализированную модель. Дальше — выбираешь любой из 60+ стилей (мода, природа, тиктоки и т.д.), а твое лицо остается узнаваемым. Но я считаю Wan лоры лучше


Google Flow теперь доступен почти везде Google наконец-то раскатил Flow (липсинк по фото) на почти весь мир, включая Европу. То есть Veo3 доступен теперь во всех странах без санкций.


Runway Act-Two: оживи персонажа по видео-референсу (3 видео) Runway представил Act-Two — новую модель захвата движения. Можно анимировать любой персонаж и фон по видео-референсу с отслеживанием головы, лица, тела и рук. Пока только для Enterprise и партнеров, позже дадут всем. Максимум — 30 секунд, нужна Gen-4, оплата в кредитах. Анимирует даже окружение, если референсом была картинка. Но всё равно качество так себе, очень много галлюцинаций.


• High Input Fidelity для ChatGPT Image-1 Теперь можно точно контролировать детали при редактировании картинок в GPT Image-1. Новый параметр High Input Fidelity сохраняет максимум исходных черт (особенно лиц и поз). Пока работает только через API и playground, настройки скоро появятся в ChatGPT и SORA. Я попробовал по API — перенос делаталей действительно работает лучше, но не идеально. Переодеваторы через Flux модели могут выдохнуть.


• ChatGPT Plus теперь умеет записывать встречи (только macOS) В десктопном приложении ChatGPT для Mac появился Record mode: записывает, расшифровывает и делает саммари встреч с таймкодами. Доступно подписчикам Plus, максимум 120 минут за сессию. Пока только на Mac.


• Slack: ИИ-расшифровка звонков и новые инструменты Slack анонсировал расшифровку и пересказ звонков, поиск по подключенным приложениям, автоматическое выделение задач и сроков из чатов — всё на ИИ


• Higgsfield UGC Builder: конструктор селфи-видео (4 видео) Higgsfield выпустил UGC Builder — конструктор рекламных видео, где можно в три клика сделать ролик с собой в главной роли. Загружаешь изображение, выбираешь стиль и реплики, настраиваешь эмоции и звук, интегрируешь Veo3 для генерации видео со звуком. 1200 кредитов в месяц по подписке Pro ($29). Для мира коротких видосов — прям в точку и мощный конкурент inVideo. Мощный конкурент множества подобных мини-стартапов, которые пытаются создать контент-завод


Suno v4.5+: новая версия, больше вариативности (5 видео) Suno обновился до версии 4.5+, теперь треки стали ещё разнообразнее, есть полноценные проигрыши и припевы: теперь можно подгружать свои вокалы или инструментальные дорожки, а также использовать плейлист для вдохновения новой песней. Udio отстаёт. По сути Suno — лучшая модель для аудио-генерации


OpenArt Story: AI-генератор сторителлинга (6 видео) OpenArt совместно с Hailuo_AI выпустил OpenArt Story — сервис для создания коротких видео до 1 минуты из текста, музыки, сценария или персонажа. Можно менять сцены, музыку, голоса, ещё один конкурент inVideo, только в другую сторону — в сторону сторителлинга