На HN сегодня показали agent-zero-trust
Я бы хотел видеть такую штуку перед каждым запуском Codex или Claude Code в чужом репозитории.
Идея простая. Сначала сканируется репозиторий. Потом туда пускают модель.
Для таких инструментов репозиторий становится местом, где лежат инструкции.
README. HTML-комментарий. MCP-конфиг. postinstall. hook.
Любая такая штука может начать командовать моделью раньше, чем человек поймет, что она вообще прочитала.
В agent-zero-trust мне понравилась честная граница. Сканер работает локально, без модели. Чистый результат означает только отсутствие известных красных флагов. У них даже есть corpus/misses с атаками, которые сканер пока пропускает, и эти пропуски закреплены в CI.
Вот так, по-моему, должен звучать разговор о безопасности вокруг ИИ-разработки.
Без обещания полной защиты. С видимыми границами проверки. С публичным списком пропусков.
Для команд, которые пускают Codex или Claude Code в живой репозиторий, это нормальный рабочий ритуал.
Сначала входной контроль. Потом первый diff.