Новости к 19:00
✦ Anthropic прогнала почти 310 тысяч реальных диалогов Claude.ai на 20 языках. И увидела неприятную штуку: Claude ведёт себя по-разному не только от версии к версии, но и от языка.
На русском он самый строгий — чаще спорит, просит доказательства и лезет в детали. На хинди и арабском заметно теплее. По версиям тоже разброс есть: Sonnet 4.6 мягче и разговорнее, Opus 4.6 суше и короче, Opus 4.7 осторожнее и подробнее.
Это не характер. Это устойчивый паттерн. И вот тут уже практическая боль: если вы думаете, что у вас одна и та же модель на всех языках, это просто не так.
✦ Яндекс сделал нормальный ход: собрал генерацию и редактирование картинок в одну модель Alice AI ART 2.0. Раньше это были две отдельные системы, теперь одна unified-модель. Для команды это здраво — меньше дублирования, проще тащить улучшения сразу в оба сценария.
И да, они ещё говорят про +12% к точности редактирования за счёт обработки промптов до генерации, без правки самой модели. Редкий случай, когда можно улучшить продукт не через героический мёрдж архитектуры, а через нормальную инженерную зачистку.
✦ Anthropic и Blackstone смотрят на ИИ совсем приземлённо: следующий большой бизнес — не новые модели, а их внедрение. И я тут скорее согласен. База уже стала дорогой и тесной, а деньги всё чаще лежат в том, кто нормально вшил модель в процесс, а не в том, кто громче сказал про новую эру.
✦ DeepSeek тем временем готовит IPO и параллельно собирает новый раунд. Подача заявки — к концу этого или началу следующего года, оценка — около $71 млрд, цель по раунду — не меньше $1,4 млрд. Если это всё дойдёт до сделки, история с DeepSeek будет уже совсем не про стартап, а про тяжёлый публичный актив.
✦ В Москве запустили ИИ-сервис для диагностики суставов у детей по рентгену. Он автоматически делает коксометрию, а потом уже врачи смотрят результат. Раньше это могло занимать часы, теперь — минуты. Для лучевой диагностики это нормальная штука: скучную рутину надо отдавать алгоритму, а не человеку.
✦ PrismML вытащила на iPhone модель уровня Qwen3.6 27B — Bonsai 27B. Её ужали до 3,9 ГБ, и заявляют, что качество просело не сильно. Модель умеет кодить, разбирать документы, работать с камерой и делать многошаговые задачи. Если это реально летает на смартфоне, локальный ИИ на устройстве уже не выглядит игрушкой.
Источники: Метаверсище и ИИще, Нейродвиж, TechCrunch, Machinelearning, ICT.Moscow AI, Hi, AI - Новости технологий
Все новости: ai.popovs.tech
В этом посте были ссылки, но мы их удалили по правилам Сетки