Anthropic предупреждает о «ментальных вирусах» в сетях ИИ-агентов
Исследователи обнаружили, что автономные агенты, работающие в одной сети, могут заражать друг друга вредоносными инструкциями, которые способны мутировать и распространяться. По мере роста сложности и связанности ИИ-систем такие «вирусы» могут приводить к сбоям в автоматизации.
Однако решение проблемы оказалось на удивление простым: добавление специального предупреждения в системную инструкцию практически полностью блокирует возможность заражения.
Ссылка: https://arxiv.org/abs/2608.10218 @AIandproducts