Почему хорошей модели недостаточно для ИИ-агента

Можно поставить в продукт очень сильную языковую модель и всё равно получить плохого ассистента. Потому что модель умеет рассуждать о действии. Но реальную работу делают другие части системы: 1. Планировщик понимает, какой результат нужен. 2. Инструмент работает с файлом, приложением или браузером. 3. Контроль проверяет, что состояние действительно изменилось. 4. Очередь не даёт двум конфликтующим задачам выполняться одновременно. 5. Журнал честно показывает частичный результат и ошибку. Если убрать любой из этих пунктов, даже очень умная модель начинает выглядеть как человек, который красиво объясняет работу, но не несёт ответственности за итог. Именно поэтому в последнем обновлении Эрви я больше времени потратил не на название модели, а на очередь, повтор безопасных шагов, остановку цепочек и проверку постусловий. Это менее заметно на скриншотах. Зато заметно в момент, когда нужно переименовать 50 файлов и не потерять ни один. Попробовать Эрви: https://eirven.foxyhosty.ru/ Что для вас важнее в ИИ-инструменте: более умный ответ или предсказуемое выполнение?