Агент получает цель и признак готовности вместо одной команды и повторяет попытки, пока признак не сработает. У инженеров это давно рутина: агент правит код, пока тесты не станут зелёными. Осенью 2025 у практики появилось имя – loop engineering.
Менеджеру механика достаётся готовой, вместе с обещанием, что так же можно проверять решения. Переносится она частями, и разрыв начинается раньше самого цикла: менеджер держит тридцать вкладок чата и в каждой заново пересказывает, что за проект, кто в команде, какие сроки. Контекст он носит руками, как курьер коробки. Оркестрация начинается там, где он записан один раз.
Первым при переносе ломается критерий остановки. У инженера он объективен: тест зелёный или красный. У решения о смене подрядчика зелёного теста не существует, поэтому критерий приходится задавать словами. Запускается это в обычном чате, одним сообщением, ставить агентов не нужно:
Цель – найти сильнейший аргумент против решения. Круг – одно возражение, каждое с опорой на факт из контекста. Стоп – два круга подряд без нового
Ответа между кругами модель не ждёт. Предыдущее возражение она проверяет сама, прежде чем выдвинуть следующее.
Прогон на конкретном сценарии: смена аутсорс-подрядчика, до релиза 3 месяца, бюджет квартала урезан на 15%. Весь вход – четыре строки фактов. Первые круги дали возражения, которые пережили проверку: онбординг съедает до трети оставшегося времени, риск регрессии в финтехе, скрытые затраты перехода. А в конце агент выдвинул ещё два возражения и забраковал оба сам, как ничем не подкреплённые догадки. И остановился.
Этот прогон разложен по шагам в интерактивном виджете: нажимаете «Следующий круг» и смотрите, на чём цикл останавливает сам себя.
Вторым переносится результат. Инженеру цикл возвращает готовый код. Менеджеру он улучшает только входные данные: показать, что переход рискован по срокам, агент может, а решить, что срыв дедлайна болезненнее перерасхода бюджета, остаётся человеку.
Третья часть – страховка. Когда в контексте нет реального сигнала, цикл не молчит: он производит правдоподобные возражения из общих соображений, и звучат они так же уверенно, как обоснованные. В прогоне выше агент отсёк такие сам, потому что правило требовало ссылки на факт. Полагаться на это целиком не стоит: возражение без опоры на ваши данные снимаете вы, вручную.
Переносится сама механика – цель, круг, стоп. На менеджере остаётся тоже три вещи: критерий остановки, который придётся написать словами, результат, который останется черновиком, и последняя проверка, которую никто за вас не сделает.
Промпт целиком, полный разбор прогона и ещё два места, где ранняя остановка обходится дороже всего: цикл, который спорит с решением
Неделю канал занимали результаты бенчмарка. Возвращаемся к практике, ради которой всё это и считается.