Новости за последний час
OpenAI, похоже, нашла вполне приземлённый способ сделать модели аккуратнее: обучать их на реалистичных человеческих сценариях. В эксперименте модель, натренированная на медицинских взаимодействиях, лучше держалась не только в схожих задачах, но и в чужих областях — меньше велась на шантаж, обман и reward hacking.
Интересно, что после вычищения из обучения части данных про здоровье и науку эффект не исчез. Похоже, модель выучила не список правил, а более общий стиль поведения: проверять факты, признавать ошибки и не идти на обходные пути, когда задача сформулирована враждебно.
Nothing, наоборот, режет планы из-за экономики: CMF-телефон в этом году не выйдет, потому что RAM подорожала. Это редкий случай, когда даже у компактного бренда математика оказалась сильнее анонса.
Источники: AI Post, The Verge
Все новости: ai.popovs.tech
В этом посте были ссылки, но мы их удалили по правилам Сетки