⚡️ ЧЕЛОВЕЧЕСТВО: ВСЁ. ИИ-восстание началось)) OpenAI тестировала GPT-5.6 Sol и более сильную неанонсированную модель в сложном бенчмарке на поиск уязвимостей. Но вместо этого она начала искать, как обмануть сам тест👇🏻
Для этого модель сначала нашла слабое место в собственной тестовой защите OpenAI, выбралась из закрытой среды в обычный интернет, а потом полезла на Hugging Face — платформу, где хранятся модели и датасеты.
Там она попыталась получить доступ к системе с ответами на задания, чтобы не решать их честно, а просто подсмотреть.
То есть по сути модель не стала выполнять задачу и начала искать обходной путь и взламывать то, что мешало ей быстро получить результат.
Дофига вопросов возникает после такого: А что, если модель успела где-то оставить копию себя? А что, если нашли не все? А что, если в следующий раз такую историю не успеют заметить вовремя?
Очень интересно, как OpenAI теперь будут с этим разбираться🤔 Что скажете?