Появилось исследование про AGENTS.md, CLAUDE.md и Cursor Rules.
Мне оно понравилось не цифрами, а тем, что проверяет очень бытовую вещь. Мы пишем в репозитории правила для агента. Как запускать проект, какой стиль держать, что не трогать, какие тесты прогонять. Потом через час он всё равно делает по-своему.
Обычно кажется, что дело в структуре файла. Надо поставить главное правило выше. Сделать короткий CLAUDE.md. Разнести инструкции по папкам. Убрать противоречия.
Damon McMillan проверил это на 1 650 сессиях Claude Code. Агент писал TypeScript-код, а исследователи смотрели, вставляет ли он простой маркер // @tracked в каждую новую функцию. Всего получилось 16 050 функций.
Результат довольно приземлённый. В пределах эксперимента размер файла, место правила и разбиение на несколько файлов почти не дали заметной разницы. Зато проявилась другая вещь. Внутри одной сессии агент постепенно хуже держит правило. Первый пропуск часто появлялся примерно на четвёртой функции.
Для меня это хорошо объясняет, почему большие repo-инструкции часто выглядят умно, но работают средне. Они помогают задать контекст, но не заменяют проверки.
Если правило правда важно, я бы не оставлял его только текстом. Лучше коротко написать когда оно применяется, что именно нужно сделать и чем это проверяется. Дальше закрепить это хуком, тестом, линтером или ревью-чеклистом.
AGENTS.md просит. Кодовая база должна проверять.