🕺Обсудим результаты исследования по использованию ИИ-агентов 📌 Агент осторожнее человека Неочевидный факт: в самых сложных задачах ИИ-агент останавливается и задает уточняющий вопрос в два раза чаще, чем его принудительно прерывает сам пользователь
То есть «предохранитель» внутри модели срабатывает эффективнее, чем внешний контроль. Агент сам понимает, где зона его компетенций заканчивается и начинается риск
📌Где кипит работа? (Домены) Пока что агентная революция — это история про софт
• ~50% всей активности через API приходится на разработку ПО • Идет рост в медицине, финтехе и кибербезе, но объемы пока скромные
Разрабы — главные драйверы и «тестировщики» автономного будущего 📌Главный вывод исследования
Текущие модели технически уже могут работать дольше и автономнее, чем им позволяют люди. Проблема не в «мозгах» ИИ, а в инфраструктуре
Что нам нужно сейчас: 1. Новые паттерны мониторинга Как отслеживать действия агента, который работает 45+ минут без твоего участия?
2. Shared Autonomy Модель совместного управления рисками, где и человек, и ИИ знают, когда нажать на тормоз
Мы переходим от эпохи «Prompt Engineering» (как спросить) к эпохе «Agent Operations» (как контролировать автономный процесс)