AI-агенты пишут код: что проверить до продакшена
На совете звучит красиво: «Подключаем AI-агентов — код будет в три раза быстрее».
Через два–три месяца в репозитории сотни строк «от агента». В проде — тихий баг в оплате или ключ API в истории git. А команда спорит: кто вообще ревьюил этот pull request?
Обещание рынка сбылось по скорости. Не сбылось по контролю. Проблема не в AI-агентах и не в «глупой модели». Проблема в том, что скорость генерации обгоняет дисциплину выкладки. Агент закрывает задачу по расплывчатому промпту, в main попадает изменение без понятного владельца, тесты зелёные «для галочки», а секреты когда-то попали в чат с моделью и остались в истории.
Три ступени, в которых узнаёте себя: - Пилот — агент пишет бойлерплейт и черновики, все довольны скоростью. Здесь выгода реальная. - Разгон — агенту дают задачи целиком: «сделай оплату», «добавь роли», «почини прод». PR без владельца, ревью формальное. - Удар — регресс в деньгах или правах, либо секрет в истории. Сутки разбора, откат, запрет AI «до лучших времён» — и вы теряете и скорость, и доверие.
Ориентир по деньгам для директора: → час осмысленного ревью senior — обычно 5–10 тыс. ₽ → сутки инцидента с откатом и разбором — часто от 150–400 тыс. ₽, не считая потерянных заказов в пик → утечка ключей: ротация, аудит, простой интеграций — нередко ещё 100–300 тыс. ₽ прямых затрат
Один час ревью дешевле суток аварии на порядок. AI удешевляет черновик. Без ворот он также удешевляет ответственность — до первого инцидента.
Четыре ворота до продакшена. Без них код от агента не в main — ни у штата, ни у подрядчика: - Scope — что меняется для пользователя, что не трогаем, критерий «готово». Промпт «сделай красиво» — не scope. - Тесты — автотест на критичный сценарий: оплата, вход, права. «Агент написал тесты» недостаточно, если они проверяют заглушку. - Security — скан секретов и зависимостей; запрет тащить прод-секреты и ПДн в промпт; человек подтверждает, что нет обхода авторизации. - Staging + владелец PR — прогон на стенде и имя инженера в владельцах. Без имени — не мержим.
Когда AI-агенты уместны: узкая воспроизводимая задача, уже есть CI и культура ревью, критичные контуры помечены ручным approve, есть метрика «доля AI-PR с регрессом».
Когда рано: агент сам пушит в main, нет тестов на оплату и роли, в промпты тащат прод и клиентские данные, MVP ещё без базового CI.
Короткий чеклист перед мержем: → в задаче есть scope и критерий приёмки → у PR человеческий владелец и описание эффекта для бизнеса → CI зелёный на критичном сценарии → секреты и зависимости проверены → staging подписан → платежи / права / ПДн — отдельный approve → у подрядчика в договоре те же ворота, что у штата
Агент ускоряет черновик. В прод идёт только то, что прошло те же ворота, что и код человека.
Полный разбор — статья на сайте «AI-агенты пишут код: что проверить до продакшена»: https://ninelab.ru/blog/ai-agents-code-review-governance?utm_source=setka&utm_medium=social&utm_campaign=ninelab_setka_ai_agents_code_review_governance
А у вас AI-агенты уже пишут в прод — и кто подписан на последний такой PR?
· 27.07
В NineLab помогаем встроить ворота в CI и договор с командой: scope, тесты, security, staging — одни правила для штата и подрядчика. Если нужно разобрать ваш процесс выкладки — пишите в ЛС или через ninelab.ru/contacts.
Короткие разборы: @ninelab_ru
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён