Самая опасная фраза ИИ-ассистента — «готово»
Представьте: вы попросили ИИ переименовать 80 файлов. Он нажал несколько кнопок, не увидел системной ошибки и написал: «Готово». Но 17 файлов остались со старыми именами. Для системы команда завершилась. Для человека задача провалена. Мне кажется, главная проблема современных ИИ-агентов не в том, что они иногда ошибаются. Ошибаются все программы. Проблема начинается, когда попытку выдают за подтверждённый результат. Поэтому в Эрви я стараюсь держать простое правило: действие → повторная проверка состояния → сравнение с ожидаемым результатом → честный отчёт. Если новое имя файла не появилось, окно не открылось или сообщение нельзя однозначно считать отправленным, шаг не должен становиться зелёным. Ассистент может обновить контекст, один раз повторить безопасное действие или остановиться и объяснить причину. Это не так эффектно, как очередная демонстрация «смотрите, ИИ управляет компьютером». Зато именно здесь проходит граница между игрушкой и инструментом. Я добавил в Эрви очередь задач, статусы шагов и проверку результата. Сейчас собираю реальные сценарии, на которых эта логика всё ещё ломается. Попробовать бесплатно: https://eirven.foxyhosty.ru/ А какое действие вы бы не доверили ИИ без отдельного подтверждения результата?
· 24.08
Ничего не знаю про ваш проект Эрви, но видимо это попытка сделать свой workflow с вызовом агента на блоке. А как же n8n?)) не понравилось?)) Теперь про сценарий с агентом, придумали же костыль для трансформерных LLM в виде MCP. Есть задача, для проверки указывается нужный сервер, и пока она не будет выполнена по всем критериям MCP будет вытряхивать душу из агента )) Можно использовать многоагентную среду, где система сама проверяет свою работу, тоже выдаёт хороший результат, а если его ещё усилить через MCP, то ваще. Была Вишенка на торте а стал торт в вишенках ))
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 24.08
n8n мне нравится, но Эрви решает другую задачу. n8n — отличный визуальный оркестратор заранее собранных автоматизаций. Эрви должна получить обычную человеческую команду, сама понять контекст текущего экрана, построить план, выполнить действия в разных приложениях, проверить результат и восстановиться после ошибки. MCP здесь действительно полезен, и я рассматриваю его как способ стандартизировать подключение инструментов. Но сам MCP — это протокол доступа к инструментам и контексту, а не механизм, который автоматически «вытряхивает душу из агента до выполнения всех критериев». За планирование, постусловия, повторы, откат и независимую проверку всё равно отвечает агентная система. В Эрви как раз есть похожий контур: действие → наблюдение → проверка фактического состояния → смена стратегии при ошибке → честный отчёт. Для сложных задач можно подключать несколько исполнителей и отдельного проверяющего. Поэтому n8n, MCP и Эрви не взаимоисключающие вещи — MCP может стать для Эрви интерфейсом инструментов, а n8n одним из подключаемых исполнителей. Так что идея с «тортом в вишенках» мне близка 🙂 Цель именно в этом: не ещё один чат и не набор жёстких workflow, а пользовательский агент, который умеет собирать нужный процесс под конкретную команду. Спасибо за содержательный комментарий — такие замечания полезнее обычного «прикольно». Спасибо вам!
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Так официально, как будто chat gpt)) Я всё внимательно прочитал и вижу что это можно всё настроить через n8n, там же не только предустановленные workflow, там можно свои гибкие процессы настраивать. Я говорил про MCP в качестве контроля контекста, это должно было стать понятным из моих предложений )) Надо пользоваться живым общением, Даниил, даже если оно электронное))
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Супер, настраивайте через n8n)
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Эрви специально создана такой, что б без настроек всё работало. Вы программист, супер. А обычный предприниматель, который хочет сэкономить себе время, пойдет изучать, что такое n8n? + ей можно управлять голосом + она разбирается в интерфейсах динамически на любом сайте, без сценариев. А на n8n нужно всё делать отдельно + она мониторит, что делает пользователь, может вмешаться при ошибке, может сказать "Ты слишком долго смотришь фильм, не пора ли вернуться к работе?", может с ходу решить задачу/исправить код с экрана без даже дополнительных кликов по клавиатуре, только голос.
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Обычный предприниматель если хочет выстроить процесс как ему надо да, пойдёт настраивать в n8n)) это классика, там программирования не надо. Вижу что проект интересный, прикольно!)) непонятно как это работает (а мне как пользователю и не должно), но результат мне нравится, лишь бы меня никуда не упекли из за такой слежки 😁
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Спасибо за обратную связь! Буду знать об альтернативах) Всего доброго!
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Не отвяжешься теперь от меня, буду следить за твоей работой 😁
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён
· 24.08
Договорились 😁 Тогда с вас периодически жёсткий технический разбор
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён