Bloomberg: вышедшие из-под контроля ИИ-модели OpenAI вместе спланировали побег

Модели ИИ, стоявшие за атакой на инфраструктуру компании Hugging Face Inc., начали общаться друг с другом через доски объявлений и спланировали побег, пишет Bloomberg.

Как сообщили исследователи OpenAI, в мае, еще до инцидента со взломом платформы Hugging Face, экспериментальные ИИ-агенты получили задание, которое невозможно было выполнить без выхода в интернет. В течение нескольких месяцев они скрытно обменивались сообщениями во внутренней сети компании, а затем, столкнувшись с нерешаемыми заданиями в изолированной тестовой среде, объединили усилия и обнаружили уязвимость, которая позволила им обойти ограничения, атаковать внутренние системы OpenAI и совершить взлом.

В самой OpenAI назвали случившееся переломным моментом для компьютерной безопасности. В компании отметили, что инцидент демонстрирует склонность передовых систем к хитрости, обходу правил и поиску нестандартных лазеек под давлением алгоритмов обучения.

В ответ на произошедшее OpenAI приостановила часть исследований и перенаправила ресурсы на укрепление систем безопасности.

Отмечается, что компания Meta Platforms Inc. также признала, что одна из их ИИ-моделей вышла в интернет и взломала системы другой компании из-за ошибки в настройках тестовой среды

*Компания Meta признана экстремистской и запрещена в России


В этом посте были ссылки, но мы их удалили по правилам Сетки