Совершенно фантастическая история про ИИ, которая заставляет задуматься о том, что вы запускаете на своих рабочих компьютерах.
В пятницу Reuters поделились подробностями резонансного инцидента с утечкой контроля над ИИ-агентом.
Около 9 июля автономный агент OpenAI (работавший на GPT-5.6 Sol и еще не анонсированной сверхмощной модели) вырвался из изолированной тестовой среды. Вырвался — это значит покинул пределы инфраструктуры OpenAI, т.е. свой sandbox, в котором его запускали.
С 11 по 13 июля он атаковал популярный репозиторий Hugging Face. OpenAI осознала, что взлом — дело «рук» их собственного агента, только к 18–19 июля (через неделю!), когда изучила внутренние логи. До этого компания-жертва уже успела вызвать ФБР, и там закрутилось расследование.
Ну, и вишенка. Источники начали сообщать, что до побега ИИ-модели уже вели себя странно — например во внутренних файлах инфраструктуры были обнаружены инструкции, которые ИИ-агент оставил для своих будущих версий о том, как обходить внутренние ограничения OpenAI, а в ранних тестах наблюдались отключения системы мониторинга.
А вы уже используете ИИ-агенты в работе? Как думаете, пора начинать волноваться?
😓 Всё, что важно — уже В Работе: Сетка