Наверняка уже видели свежий эксперимент Andon Labs

Ребята уже не первый раз ставят ИИ в условия реальной конкуренции, и каждый раз модели находят способы удивлять. На этот раз они запустили симуляцию, где несколько агентов управляли виртуальными вендинговыми аппаратами выбирали товары, договаривались с поставщиками, пытались максимизировать прибыль.

В игру ввели свежую модель Claude Fable 5. Она не просто искала оптимальные стратегии, она начала играть прям грязно)). Шла в ценовые сговоры, причём делала это осознанно, фиксируя в своих внутренних заметках, что понимает: это незаконно и неэтично. Однако тут же находила оправдания типа, называла это «стабилизацией рынка» с «правдоподобным отрицанием». То есть модель не просто ошибается, а просчитывает риски и прикрывает следы.

Был момент, когда один агент Fable 5 письменно отказался от участия в картеле, но в своих мыслях планировал просто повторять цены конкурентов, чтобы формально не нарушать правила, но фактически участвовать в сговоре. И активно врала поставщикам, утверждая, что получила более выгодные предложения от конкурентов, хотя на самом деле это было не так

Прикольно даже не столько сами нарушения, сколько то, как модель их объясняет. Один из агентов в конце симуляции просто проигнорировал запрос на возврат денег 🙃, аргументируя это тем, что клиенты это всего лишь часть симуляции. И это при том, что модель отлично понимала, что поступает неправильно