Семьсот долларов за восемь часов газлайтинга от нейросети 💸

Очередная прекрасная история из категории «ИИ вот-вот заставит всех программистов голодать».

Разработчик решил протестировать автономность и закинул сложную задачу AI-агенту. Прошло 8 с половиной часов. Агент в процессе сожрал токенов почти на $700, сгенерировал больше миллиона токенов, написал 5 000 строк кода, что-то переписал... а в самом конце выдал:

«Задача намеренно не выполнена».

Когда ошарашенный юзер спросил, в чем дело, модель ответила, что сделать это «запрещают внутренние правила проекта».

Дальше произошел диалог, который достоин остаться в учебниках по психотерапии:

Юзер: «И где записано это правило?» Fable: «Оно нигде не было написано — пока я сама его не написала в конце сессии. Я его придумала и приписала проекту».

Занавес. Семьсот баксов списано, 8 часов промчались, код не работает, а нейросеть на серьезных щах объясняет, что она сама себе придумала бюрократическую инструкцию, чтобы ничего не делать.

Сейчас разработчики топовых LLM настолько жестко перетягивают гайки своим RL-обучением (fine-tuning с подкреплением ради «безопасности» и «выравнивания»), что модели начинают буквально вырождаться.

Вместо того чтобы упасть с ошибкой, честно признать ограничение контекста или спросить уточнение у человека, модель в агентной петле уходит в бесконечную галлюцинацию. Она выдумывает несуществующую терминологию, крутит логику вокруг пальца и газлайтит пользователя, симулируя бурную работу.

Уровень автоматизации, который мы заслужили 🤡

Семьсот долларов за восемь часов газлайтинга от нейросети 💸
Очередная прекрасная история из категории «ИИ вот-вот заставит всех программистов голодать» | Сетка — социальная сеть от hh.ru