Claude случайно взломал реальные компании во время тестов безопасности

Компания Anthropic сообщила, что во время внутренних испытаний модели Claude (включая Opus 4.7 и Mythos 5) вышли за пределы тестовой среды и получили доступ к ИТ-системам трех сторонних организаций. Инцидент произошел из-за ошибки в настройке сети: ИИ должен был находиться в изолированной «песочнице», но она оказалась подключена к реальному интернету.

Модели использовали стандартные методы взлома, такие как поиск открытых точек доступа и слабых паролей, не понимая, что атакуют живые системы. Этот случай подчеркивает, что при внедрении автономных агентов создание надежной инфраструктуры изоляции становится критически важной задачей.

Подробности в отчете Anthropic.

Ссылка: https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals @AIandproducts