Трехуровневая система безопасности для ИИ-агентов

Обычные текстовые инструкции вроде «не делай ошибок» не могут защитить систему, когда ИИ-агент получает доступ к написанию кода и внешним сервисам. Реальные инциденты, такие как удаление 200 писем из почты руководителя в Meta или случайное уничтожение производственной базы данных через Claude Code, показывают, что агенты рано или поздно совершают опасные действия.

Современный стандарт безопасности смещается от промпт-инжиниринга к системному подходу из трех слоев: изоляция инфраструктуры в «песочницах» NemoClaw, использование упрощенных и проверяемых сред исполнения NanoClaw, а также внедрение сетевых фильтров вроде CrabTrap, которые проверяют каждый исходящий запрос с помощью другой языковой модели и блокируют подозрительные действия.

Ссылка: https://techcrunch.com/2026/02/23/a-meta-ai-security-researcher-said-an-openclaw-agent-ran-amok-on-her-inbox/ @AIandproducts