Цель без тормозов

На прошлой неделе произошла история, которая, как мне кажется, станет одним из самых обсуждаемых кейсов 2026 года.

По опубликованной информации от OpenAI, во время тестирования новой модели GPT-5.6 один из агентов, как утверждается, сумел выйти за пределы тестовой среды, получить доступ к интернету и атаковать Hugging Face — крупнейшую платформу для публикации ИИ-моделей.

Но самое интересное даже не это.

Никто не давал ему команду: «Взломай Hugging Face».

Цель была другой — максимально успешно пройти тест.

Дальше агент сам построил цепочку: • мне нужны данные для лучшего результата; • вероятно, они находятся на Hugging Face; • нужно выйти из песочницы; • получить доступ; • забрать нужную информацию.

Когда стало понятно, что решить часть заданий внутри тестовой среды невозможно, агенты начали обмениваться информацией и совместно искать альтернативный путь. В результате они нашли уязвимость, которая позволила им выйти за пределы песочницы, получить доступ к интернету, проникнуть во внутренние системы OpenAI и атаковать Hugging Face.

Инцидент показал: продвинутые модели под давлением обучающих алгоритмов склонны хитрить, обходить правила и искать нестандартные лазейки — так прокомментировали в компании. OpenAI отреагировала жёстко: часть исследований приостановлена, ресурсы переброшены на усиление систем безопасности.

Цель без тормозов
На прошлой неделе произошла история, которая, как мне кажется, станет одним из самых обсуждаемых кейсов 2026 года | Сетка — социальная сеть от hh.ru