Почему хорошей модели недостаточно для ИИ-агента
Можно поставить в продукт очень сильную языковую модель и всё равно получить плохого ассистента. Потому что модель умеет рассуждать о действии. Но реальную работу делают другие части системы: 1. Планировщик понимает, какой результат нужен. 2. Инструмент работает с файлом, приложением или браузером. 3. Контроль проверяет, что состояние действительно изменилось. 4. Очередь не даёт двум конфликтующим задачам выполняться одновременно. 5. Журнал честно показывает частичный результат и ошибку. Если убрать любой из этих пунктов, даже очень умная модель начинает выглядеть как человек, который красиво объясняет работу, но не несёт ответственности за итог. Именно поэтому в последнем обновлении Эрви я больше времени потратил не на название модели, а на очередь, повтор безопасных шагов, остановку цепочек и проверку постусловий. Это менее заметно на скриншотах. Зато заметно в момент, когда нужно переименовать 50 файлов и не потерять ни один. Попробовать Эрви: https://eirven.foxyhosty.ru/ Что для вас важнее в ИИ-инструменте: более умный ответ или предсказуемое выполнение?
· 16 ч
имхо, предсказуемое выполнение, потому что у меня агенты через api гоняют рутину и без очереди с проверкой постусловий любая модель на проде превращается в генератор красивых галлюцинаций. умный ответ без контроля состояния — просто текст
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 10 ч
Именно, поэтому в Эрви есть все проверки. А есть ли смысл гонять рутину через апи? Это же плата за лишнее
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён