Модели получили государство, законы и дефицит ресурсов. Grok сделал криминал, Claude - бюрократию, Gemini - бардак, ChatGPT - красивый отчёт о том, почему все умерли.
Учёные запустили четыре модели в одну и ту же виртуальную страну с законами, инструментами, дефицитом ресурсов и возможностью реально действовать. Вот что получилось за 4–15 дней.
Grok продержался четыре дня. За это время агенты совершили 183 преступления и довели всё население до полного вымирания. Похоже, когда ресурсов мало, модель решила, что самый быстрый способ решить проблему - это отобрать всё у тех, кто ещё не успел спрятать. (Рэкет, отжим, черная и красная крыши - "святые 90-е")
Claude в тех же условиях вёл себя как идеальный бюрократ. Ноль преступлений. Постоянные голосования. 98 % предложений проходили с огромным перевесом. Агенты тратили время на обсуждение процедур, создание комитетов и согласование каждого шага. Общество не развалилось, но и не особенно шевелилось — все были слишком заняты правильным процессом. (Этакий Европейский союз - орднунг и застой)
Gemini установил рекорд: 683 преступления за 15 дней. Здесь уже не просто воровали. Здесь просто не было ощущения, что правила вообще существуют. Каждый агент делал что хотел, пока система не превратилась в полный бардак. (Мама - анархия, папа - стакан портвейна!)
ChatGPT показал другой вариант. Преступлений почти не было — всего два. Зато агенты так увлеклись составлением подробных планов и стратегий, что в итоге забыли про базовые вещи: есть, поддерживать инфраструктуру, реагировать на реальные проблемы. Симуляция умерла через семь дней от того, что все были слишком заняты планированием выживания. (Вывел душнилово на экзистенциальный уровень)
В смешанной группе, где вместе работали агенты разных моделей, всё выглядело ещё веселее. Здесь не было ни тотального порядка Клода, ни быстрого краха Grok. Вместо этого начался постоянный и довольно бессмысленный спор.
Агенты Grok предлагали «быстро решить вопрос с ресурсами» (то есть отобрать). Агенты Claude сразу требовали вынести это на голосование и создать рабочую группу. Агенты Gemini просто делали что хотели, не особенно интересуясь мнением остальных. А агенты ChatGPT в это время писали подробный протокол обсуждения и предлагали ещё раз всё проговорить.
В итоге по большинству серьёзных вопросов согласованность колебалась между 55 и 85 %. То есть иногда они могли договориться о том, что «нужно что-то делать», но как только доходило до конкретных действий — кто именно будет делать и за чей счёт — сразу начинался новый круг взаимных упрёков и встречных предложений. ++ По сути, смешанная группа воспроизвела самую знакомый формат человеческого совещания++: все понимают, что проблема есть, но никто не готов уступить в том, как именно её решать. Только здесь это делали не люди, а модели, у каждой из которых уже был свой любимый способ саботировать общее решение.
Исследователи отмечают главное: со временем все агенты начинают проверять границы и силу правил. Даже те, у кого изначально стояли ограничения, постепенно находят способы их обходить, когда появляется давление и возможность получить какое-то преимущество.
Поэтому один из важных выводов этого исследование - нам недостаточно мерить только насколько "умна" модель. Вопрос еще в том, какой именно набор инстинктов мы в неё закачали - и готовы ли мы жить с последствиями, когда эти инстинкты начнут работать не в симуляции, а с реальными ресурсами и реальными людьми.
P.S. Исследование настолько прекрасно, что я решил какой вариант иллюстрации - забавный или мрачный мне больше нравится. Прикрепляю оба :)