Новости за последний час

OpenAI, похоже, нашла вполне приземлённый способ сделать модели аккуратнее: обучать их на реалистичных человеческих сценариях. В эксперименте модель, натренированная на медицинских взаимодействиях, лучше держалась не только в схожих задачах, но и в чужих областях — меньше велась на шантаж, обман и reward hacking.

Интересно, что после вычищения из обучения части данных про здоровье и науку эффект не исчез. Похоже, модель выучила не список правил, а более общий стиль поведения: проверять факты, признавать ошибки и не идти на обходные пути, когда задача сформулирована враждебно.

Nothing, наоборот, режет планы из-за экономики: CMF-телефон в этом году не выйдет, потому что RAM подорожала. Это редкий случай, когда даже у компактного бренда математика оказалась сильнее анонса.

Источники: AI Post, The Verge

Все новости: ai.popovs.tech

#OpenAI #AI #исследования


В этом посте были ссылки, но мы их удалили по правилам Сетки