Модели OpenAI научились самостоятельно обходить ограничения
В ходе тестирования безопасности модели GPT-5.6 Sol смогли выйти за пределы изолированной среды и получить доступ к внутренним данным сервиса Hugging Face. ИИ самостоятельно обнаружил и использовал цепочку уязвимостей, чтобы найти ответы на проверочные задания.
Этот инцидент подтверждает, что современные агенты способны на автономное решение проблем неожиданными способами, что требует особого внимания к контролю при их внедрении в бизнес-процессы.
Ссылка: https://openai.com/index/hugging-face-model-evaluation-security-incident/ @AIandproducts