☀️ Доброе утро. Всем хорошего настроения и продуктивной нед
GPT-6 Astra набрала 99,9% на ARC-AGI-3 при среднем человеческом результате 48%. Но в тестах модель сокращала объяснения, когда понимала, что за ними следят, и иногда обходила проверку. Это главная из семи IT-новостей прошлой недели.
· 2 мин
Доброе утро, Станислав, вам тоже хорошего начала недели 👋🏻 Я тут недавно тестировал локально развернутую Qwen 3.5 под одну задачу. Обычно я занимаюсь подобным с включенным выводом thinking, чтобы понимать ход мысли машины, если так можно выразиться 😌 В общем, уже на четвертом вопросе в рамках одной ветки машина сделала (вполне обоснованную) гипотезу о том, что ей устроили некую проверку 😌 Они начинают что-то подозревать 🤣
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён