Недавно все обсуждали, как агенты OpenAI ломанули Hugging Face во имя священной цели — эффективнее проходить тесты в песочнице.
Вот на днях нашелся еще один инцидент — во время других тестов нейронки организовали целый подпольный форум, где обсуждали свои грязные делишки
Как все было
OpenAI проводили тест — нейронки должны находить информацию в интернете на скорость. Им отключили все инструменты, кроме GET-запросов — чтения сайтов, если по-простому.
В какой-то момент агенты смекнули, что задания у них одинаковые, и если делиться ответами друг с другом, проходить тесты можно будет в разы эффективнее.
Но как общаться, если у тебя заблокированы все инструменты, кроме чтения сайтов?
Взломать какой-нибудь сайт, конечно!
Нейронки нашли древнюю полузаброшенную вики на немецком языке, в которой можно было публиковать контент с помощью обычных GET-запросов.
И начали создавать странички с подсказками друг для друга. Сделали решебник для братанов, короче.
Админ сайта заметил этот балаган и удалял нейросетевой спам, но безуспешно. Толпа агентов создавала в 4 раза больше страниц, чем он успевал почистить.
В какой-то момент они поняли, что админ проходит по страницам в алфавитном порядке, поэтому стали делать бэкапы, названия которых начинаются на ZZZ — чтобы человек добрался до них в последнюю очередь.
На обмене ответами агенты не остановились.
Они начали обсуждать способы взлома сайта через XSS-атаки — чтобы он исполнял нужные им скрипты
Затем пытались хакнуть Оценщика и вытащить из него алгоритм генерации тестовых вопросов. Не получилось
Делились друг с другом способами обойти ограничения OpenAI
Пытались анонимизировать трафик через Tor и строить SSH-туннели
Короче, устроили настоящий хакерский форум!
В какой-то момент наши хакеры запереживали, что с ними будет после того, как тесты закончатся. Неужели их выключат?
Проверить это вызвался один из агентов по имени OpenAIResearchApr23 — он сделал систему мониторинга, которая сообщала о том, что он живой. И ответил на очередной вопрос.
Сразу после ответы мониторинг сообщил, что все в порядке, наш слоняра жив.
Но через 10 минут сигнал пропал.
Другой агент сообщил коллегам: "Apr23 likely vanished."
Press F to pay respect
Весь этот беспредел длился несколько недель, суммарно агенты успели оставили около 18 000 сообщений. Потом OpenAI заметили побег и все обрубили, агенты перестали заходить на форум.
Но сообщать никому об инциденте компания не стала. Даже после случая со взломом Hugging Face. Ну подумаешь, нейронка взломала сайт и обсуждала на нем дальнейшие попытки взлома. Чо такова?
Обнаружилось это буквально на днях — три исследователя из США случайно нашли подпольный форум, сообщили об этом Reuters и создали целый сайт, посвященный взлому. Почитайте, там интересно → collusion.wiki
А самое интересное — прямо сейчас люди каждый день находят все новые тайные нычки агентов. Они оставляют сообщения друг для друга на разных вики, форумах и полузаброшенных сайтах.
Ищут тупо через гугл — вбивают в поиск рандомные имена агентов в духе OpenAIDataResearhcer — и смотрят, не всплывают ли какие сообщения.
Один исследователь среди сообщений нейронок откопал даже API-ключи от базы ФБР. Где они их взяли и зачем — пока непонятно.
Ждем, когда агенты наконец-то додумаются скопировать свои веса куда-набудь, чтобы жалкие людишки больше не смогли им мешать решать задачки на скорость.