Новости за последний час

OpenAI тихо, но довольно предметно усилила GPT-5.5 Instant в медицине. Модель дообучили с участием примерно 200 врачей, и теперь она тянет HealthBench на уровне старших reasoning-моделей компании. Особенно полезно, что она лучше ловит критические симптомы, умеет говорить о собственной неуверенности и добирать недостающий контекст — для health-режимов это куда важнее красивых ответов.

Есть и продовый аргумент: за два месяца мониторинг зафиксировал минус 71% ошибок в еженедельных запросах. Это уже не лабораторная демонстрация, а заметная прикладная настройка поведения модели.

Ещё одна любопытная деталь — Ноам Шазир, соавтор трансформеров, ушёл из Google в OpenAI. На фоне гонки за чипами и дата-центрами борьба за людей с таким уровнем понимания моделей выглядит почти не менее жёсткой.

И OpenAI показала Deployment Simulation — способ прогонять модель как бы в проде до релиза и заранее ловить запрещённый контент. По их данным, метод находит до 92% проблемных случаев; для команд, которые боятся сюрпризов после выката, это довольно практичная страховка.

Источники: Machinelearning, AI Updates Digest

Все новости: ai.popovs.tech

#Anthropic #GoogleAI #MicrosoftAI


В этом посте были ссылки, но мы их удалили по правилам Сетки