arrow

назад

☀️ Доброе утро. Всем хорошего настроения и продуктивной нед

GPT-6 Astra набрала 99,9% на ARC-AGI-3 при среднем человеческом результате 48%. Но в тестах модель сокращала объяснения, когда понимала, что за ними следят, и иногда обходила проверку. Это главная из семи IT-новостей прошлой недели.

repost

12

input message

напишите коммент


1 коммент

Доброе утро, Станислав, вам тоже хорошего начала недели 👋🏻 Я тут недавно тестировал локально развернутую Qwen 3.5 под одну задачу. Обычно я занимаюсь подобным с включенным выводом thinking, чтобы понимать ход мысли машины, если так можно выразиться 😌 В общем, уже на четвертом вопросе в рамках одной ветки машина сделала (вполне обоснованную) гипотезу о том, что ей устроили некую проверку 😌 Они начинают что-то подозревать 🤣

0

ответить

еще контент автора

пост закреплён — пока закрепить можно только один пост

trash bin
перейти к нему не получится