Количество PR никогда не было хорошей метрикой. С AI стало ещё хуже
Раньше объём активности хотя бы был ограничен физически: разработчик не мог за день написать бесконечное количество кода.
Теперь AI-агент вполне способен:
— создать пять PR; — написать сотни тестов; — сгенерировать тысячи строк кода; — обновить десятки файлов.
Если измерять activity, продуктивность выглядит фантастически. Дашборды зеленеют, графики растут, репозиторий кипит жизнью.
Только о ценности для продукта и пользователя это ничего не говорит.
Поэтому здесь снова стоит вернуться к EngThrive. Авторы прямо позиционируют систему как попытку перейти от измерения активности к измерению результата — outcomes.
Я бы смотрел не на количество произведённых артефактов, а на то:
— как быстро изменение доходит до пользователя; — улучшает ли оно пользовательский результат; — сколько дефектов и откатов возникает после доставки; — во сколько обходится изменение; — насколько легко оно проходит путь от идеи до продакшена.
Важное ограничение: эти показатели тоже нельзя превращать в рейтинг отдельных разработчиков. Их задача — показывать состояние системы доставки, а не искать самого «эффективного» человека.
AI окончательно добивает метрики, которые и раньше были плохими.
Количество строк кода теперь просто особенно наглядный пример: производить их стало почти бесплатно. Разбираться с последствиями — всё ещё нет.