Новости к 19:00

✦ Anthropic прогнала почти 310 тысяч реальных диалогов Claude.ai на 20 языках. И увидела неприятную штуку: Claude ведёт себя по-разному не только от версии к версии, но и от языка.

На русском он самый строгий — чаще спорит, просит доказательства и лезет в детали. На хинди и арабском заметно теплее. По версиям тоже разброс есть: Sonnet 4.6 мягче и разговорнее, Opus 4.6 суше и короче, Opus 4.7 осторожнее и подробнее.

Это не характер. Это устойчивый паттерн. И вот тут уже практическая боль: если вы думаете, что у вас одна и та же модель на всех языках, это просто не так.

✦ Яндекс сделал нормальный ход: собрал генерацию и редактирование картинок в одну модель Alice AI ART 2.0. Раньше это были две отдельные системы, теперь одна unified-модель. Для команды это здраво — меньше дублирования, проще тащить улучшения сразу в оба сценария.

И да, они ещё говорят про +12% к точности редактирования за счёт обработки промптов до генерации, без правки самой модели. Редкий случай, когда можно улучшить продукт не через героический мёрдж архитектуры, а через нормальную инженерную зачистку.

✦ Anthropic и Blackstone смотрят на ИИ совсем приземлённо: следующий большой бизнес — не новые модели, а их внедрение. И я тут скорее согласен. База уже стала дорогой и тесной, а деньги всё чаще лежат в том, кто нормально вшил модель в процесс, а не в том, кто громче сказал про новую эру.

✦ DeepSeek тем временем готовит IPO и параллельно собирает новый раунд. Подача заявки — к концу этого или началу следующего года, оценка — около $71 млрд, цель по раунду — не меньше $1,4 млрд. Если это всё дойдёт до сделки, история с DeepSeek будет уже совсем не про стартап, а про тяжёлый публичный актив.

✦ В Москве запустили ИИ-сервис для диагностики суставов у детей по рентгену. Он автоматически делает коксометрию, а потом уже врачи смотрят результат. Раньше это могло занимать часы, теперь — минуты. Для лучевой диагностики это нормальная штука: скучную рутину надо отдавать алгоритму, а не человеку.

✦ PrismML вытащила на iPhone модель уровня Qwen3.6 27B — Bonsai 27B. Её ужали до 3,9 ГБ, и заявляют, что качество просело не сильно. Модель умеет кодить, разбирать документы, работать с камерой и делать многошаговые задачи. Если это реально летает на смартфоне, локальный ИИ на устройстве уже не выглядит игрушкой.

Источники: Метаверсище и ИИще, Нейродвиж, TechCrunch, Machinelearning, ICT.Moscow AI, Hi, AI - Новости технологий

Все новости: ai.popovs.tech

#Anthropic #Claude #LLM


В этом посте были ссылки, но мы их удалили по правилам Сетки