19% больше времени на выполнение задачи тратят разработчики, когда начинают использовать ИИ помощников.
Исследование некоммерческой организации METR (Model Evaluation and Threat Research) разрушило мой миф о мгновенной продуктивности. На конференции VLDC во Владивостоке Александр Мурзагалин из Яндекс Маршрутизации в своем докладе поделился опытом, что его команда перестала писать код руками, но окончательно утонула в его проверке.
Я иногда использую чаты, чтобы они помогли мне накидать код на HTML и CSS. Я потом создаю визуализации на основе этого кода. И они делают это очень быстро. 10 секунд и передо мной уже готовая визуализация и 500 строк кода. Вроде все круто, но ровно до того момента, пока не придется что-то изменить в этом коде. Поддерживать это крайне сложно. Попытка разобраться в нем отнимает не меньше времени, чем написание с нуля.
Данные Microsoft Research за 2026 год показывают еще более тревожную картину. Merge rate при ИИ ревью составляет 45,2%, тогда как у людей он достигает 68,4%. Более 60% комментариев от ИИ агентов при проверке это обычный цифровой шум, ложные срабатывания и очевидные замечания. Ревьюеры просто устают от этого потока и начинают игнорировать правки, пропуская критические баги. Раньше я думала, что автоматизация решит вопрос нехватки рук. Однако, бутылочное горлышко переехало из написания кода в его проверку и интеграцию.
На конференции автор сказал мысль, которая мне понравилась. Запрещать нейронки бесполезно. Нужно менять метрики, которые мы отлеживаем. Старые метрики вроде количества строк кода или закрытых задач не работают. Компании начинают измерять как часто они деплоят и сколько реальных ошибок в проде вылезает после таких быстрых правок.
Если ИИ делает нас быстрее в написании, но медленнее в выпуске готового продукта, не пора ли нам признать, что мы просто научились быстрее генерировать технический долг?
· 25.06
Я тут хотел немного встрять. Важно заметить, что в данном исследовании разбирались конкретно чаты, а не агенты. А это достаточно большая разница. Если с чатами столкнулись так или иначе все в индустрии (хотя бы раз писали промт). То вот агентами пользовалось только 8%. А разница как в подходах к работе, так и в получаемом результате колоссальна. Например с помощью условного Клод Кода, вполне можно применять итеративный подход к реализации задачи, при этом свободно передавая контекст между разными моделями, есть память агента, которая используется для решения задач, есть скилы, которые помогают сделать задачу качественно и удерживать итог в рамках ожиданий. Благодаря этому и исправления вносить проще.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 25.06
Хорошая мысль. Согласна, с чатом ошибок больше. А в агенте можно создать роль ревьювера.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 05.07
Это точно, разница колоссальная. Однако, многие не только не пользовались агентами, но даже не знают что есть такой вариант. Или для компании это чрезмерно сложно и дорого. Поправьте если не прав, но настройка скиллсетов и конфигов ролей требует наличия команды инженеров, которые будут администрировать агента, так же нужно развивать компетенции в команде, которой предстоит работать с ним. Пользовательский опыт с чатом и агентом очень разный, на мой взгляд.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 05.07
Зависит от требований к безопасности и бюджета. Ну то есть настроить базовый набор скилов, описать принцип работы - хватит пары часов опытного полтзователя. Но, если, скажем, в компании настаивают на использовании локальных моделей, то дело осложняется необзодимостью развернуть соответствующую инфру. Плюс нужно проверить безопасность и права доступа агентов, чтобы они там лишнего не начудили.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 06.07
Я про инженеров не спроста сказал. Агентные модели кроме скиллсетов еще работают с паттернами, сами ходят в конфлюенс, в фигму и тд. То есть, для нормальной генерации это все должно быть, а в идеале быть в порядке. Так что, пары часов хватит только если до этого были потрачены десятки, а может и сотни часов на формирование. Особенно это к конфлюенс относится.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён