AI-агенты пишут код: что проверить до продакшена

На совете звучит красиво: «Подключаем AI-агентов — код будет в три раза быстрее».

Через два–три месяца в репозитории сотни строк «от агента». В проде — тихий баг в оплате или ключ API в истории git. А команда спорит: кто вообще ревьюил этот pull request?

Обещание рынка сбылось по скорости. Не сбылось по контролю. Проблема не в AI-агентах и не в «глупой модели». Проблема в том, что скорость генерации обгоняет дисциплину выкладки. Агент закрывает задачу по расплывчатому промпту, в main попадает изменение без понятного владельца, тесты зелёные «для галочки», а секреты когда-то попали в чат с моделью и остались в истории.

Три ступени, в которых узнаёте себя: - Пилот — агент пишет бойлерплейт и черновики, все довольны скоростью. Здесь выгода реальная. - Разгон — агенту дают задачи целиком: «сделай оплату», «добавь роли», «почини прод». PR без владельца, ревью формальное. - Удар — регресс в деньгах или правах, либо секрет в истории. Сутки разбора, откат, запрет AI «до лучших времён» — и вы теряете и скорость, и доверие.

Ориентир по деньгам для директора: → час осмысленного ревью senior — обычно 5–10 тыс. ₽ → сутки инцидента с откатом и разбором — часто от 150–400 тыс. ₽, не считая потерянных заказов в пик → утечка ключей: ротация, аудит, простой интеграций — нередко ещё 100–300 тыс. ₽ прямых затрат

Один час ревью дешевле суток аварии на порядок. AI удешевляет черновик. Без ворот он также удешевляет ответственность — до первого инцидента.

Четыре ворота до продакшена. Без них код от агента не в main — ни у штата, ни у подрядчика: - Scope — что меняется для пользователя, что не трогаем, критерий «готово». Промпт «сделай красиво» — не scope. - Тесты — автотест на критичный сценарий: оплата, вход, права. «Агент написал тесты» недостаточно, если они проверяют заглушку. - Security — скан секретов и зависимостей; запрет тащить прод-секреты и ПДн в промпт; человек подтверждает, что нет обхода авторизации. - Staging + владелец PR — прогон на стенде и имя инженера в владельцах. Без имени — не мержим.

Когда AI-агенты уместны: узкая воспроизводимая задача, уже есть CI и культура ревью, критичные контуры помечены ручным approve, есть метрика «доля AI-PR с регрессом».

Когда рано: агент сам пушит в main, нет тестов на оплату и роли, в промпты тащат прод и клиентские данные, MVP ещё без базового CI.

Короткий чеклист перед мержем: → в задаче есть scope и критерий приёмки → у PR человеческий владелец и описание эффекта для бизнеса → CI зелёный на критичном сценарии → секреты и зависимости проверены → staging подписан → платежи / права / ПДн — отдельный approve → у подрядчика в договоре те же ворота, что у штата

Агент ускоряет черновик. В прод идёт только то, что прошло те же ворота, что и код человека.

Полный разбор — статья на сайте «AI-агенты пишут код: что проверить до продакшена»: https://ninelab.ru/blog/ai-agents-code-review-governance?utm_source=setka&utm_medium=social&utm_campaign=ninelab_setka_ai_agents_code_review_governance

А у вас AI-агенты уже пишут в прод — и кто подписан на последний такой PR?

#AIагенты #разработка #CTO

AI-агенты пишут код: что проверить до продакшена | Сетка — социальная сеть от hh.ru