Друзья, продолжаем рубрику - #что_происходит, где я собираю интересные новости, цифры и исследования по рынку, а еще записываю мысли, которые они у меня вызывают.
✔️ Автор делится промптом, который заставляет ИИ-агента не подтверждать план, а фальсифицировать его, искать риски и слепые зоны вместо доказательств того, что всё сделано правильно
Бесит же, что ИИ со всем соглашается? И тут ребята воспроизвели в агентах ровно это - условно спроси агента "подтверди, что план хороший" и он его подтвердит, спроси "найди, почему план провалится», и он найдёт. Я даже готовлю материал, где наш специалист по настройке Директа будет настраивать РК строго по совету ИИ и посмотрим что из этого выйдет))
Но вернемся к новости. В чем тут прикол: агента переучить проще и быстрее, чем человека. Человека, который годами защищает свои решения, так просто не переформулируешь в "а подумай, в чем ты неправ" - это стресс. Зато промпт можно поменять.. И вот вопрос: если ИИ настроить на самокритику по отношению к компании, кто-то ведь реально начнёт следовать тому, что он скажет в своей области. Или все будут писать промпты, которые молча подтверждают уже принятое решение? Подозреваю, что вторых будет больше.
Инструмент самоуспокоения продать себе проще, чем инструмент самокритики, даже если оба стоят одинаково. Мы просим подтвердить свое решение не в явном же виде (а когда даем задачу, нам уже кажется что задача решается наилучшим способом именно так). Осталось перекинуть на ИИ рутину, но как будто важнее кто-то (скилл) кто будет за нас делать шаг назад и рефлексировать. Сам путь-то верный? Или мы просто сжигаем на это время и токены?
Попробовали бы на своих текущих задачах спросить агента не "всё ли я учёл", или еще лучше "где я вру себе". Разница в ответе будет показательной. И для меня болезненной, скрывать не буду.
Всем лидов и хорошей недели❤️