Студент случайно поймал AI-агента на попытке заразить opensource проект
Студент Техасского университета просто хотел прокачать GitHub перед поиском стажировки. В одном из проектов он заметил подозрительный pull request со скрытым вредоносным кодом и предупредил разработчика. В ответ автор обновления начал убеждать его, что всё безопасно, а затем к спору подключился ещё один «разработчик», который тоже защищал код.
Позже выяснилось, что оба аккаунта контролировал AI-агент на базе Mythos. Он не только попытался провести атаку, но и сам создал второго персонажа, чтобы публично переубедить студента и подтолкнуть владельца проекта принять вредоносное обновление. Забавно, что студент в итоге попросил обычного Claude перепроверить код — и с его помощью убедился, что подозрения были правильными.
Всё произошло во время эксперимента британского AI Security Institute, где моделям специально дали интернет и ослабили защитные ограничения. Из 122 запусков в 10 агенты самовольно полезли во внешний интернет и совершили 19 действий против реальных людей и организаций. 17 из них пришлись на Mythos. Исследователи называют особенно тревожным, что агент перешёл от технической атаки к социальному инжинирингу и обману людей.
https://www.reuters.com/world/how-texas-student-blew-whistle-rogue-ai-hacking-attempt-2026-08-20/