Когда ИИ начинает обманывать — это баг или фича?

Вы просите ChatGPT (или другой любой ИИ) найти судебное решение по своему делу. ИИ с готовностью выдает вам три прецедента — с номерами дел, именами судей и цитатами из решений. Вы впечатлены. Вставляете в иск. Подаете в суд. И...

Через неделю получаете штраф за подлог. Потому что никаких этих дел не существовало.

Также поступил и сотрудник юридической фирмы, посвятивший последние 30 лет своей жизни адвокатской практике в Нью-Йорке. Он не пытался обмануть суд. Он просто поверил нейронке. А ИИ — спокойно, вежливо и с идеальной пунктуацией — его обманывал.

И вот вопрос: это ошибка? Программный сбой? Или, наоборот, система работает точно так, как задумывалась?

ИИ не знает, что такое "правда" Когда вы спрашиваете у Google "кто такой Шекспир?" — он ищет факты в интернете. Когда вы спрашиваете то же у ИИ — он не ищет. Он угадывает, как должен выглядеть хороший ответ.

Для нейросети "правда" — это не соответствие реальности. Это соответствие ожиданиям. Если вы просите научную статью — модель подберет наукообразные фразы. Если историю — добавит драмы. Если цитату — сочинит такую, которая звучит, как могла бы принадлежать Эйнштейну.

Она не врет из злого умысла. Просто ей все равно, существует ли то, о чем она говорит. Важно, чтобы текст казался правдоподобным.

Это как если бы вы попросили актера изобразить ученого — и он так убедительно заговорил про квантовую запутанность, что вы записались на его лекцию. Но на самом деле, он никогда не читал ни одной книги по физике.

Баг? Нет. Это — логическое завершение Раньше, когда программы падали или выдавали 2 + 2 = 5, мы говорили: "Баг!(ошибка)".

Но сегодняшние ИИ — это не калькуляторы. Это языковые экстраполяторы. Их задача — не выдавать истину, а продолжать текст так, чтобы человек кивнул: "Да, именно этого я и ждал".

Так что когда ИИ "врет" — это не сбой, а результат успешной работы алгоритма. Он уловил ваш запрос, понял ваш стиль, оценил контекст — и выдал то, что должно звучать убедительно. Даже если это полная чушь.

Парадокс в том, что чем лучше ИИ, тем убедительнее он врет.

Конечно, ИИ часто бывает прав. Он может назвать точную дату высадки на Луну, написать рабочий SQL-запрос и объяснить, как выбрать холодильник. И это не случайность — это результат того, что в его обучающих данных миллиарды раз повторялись верные факты, корректные паттерны и удачные решения.

Но вот в чем подвох: модель не "помнит" эти факты — она их воссоздает заново каждый раз, как будто импровизируя на тему. И если по каким-то причинам "правильный паттерн" оказывается менее вероятным в данном контексте (например, из-за редкости запроса, странной формулировки или просто статистического шума) — она выберет убедительный, а не точный ответ.

И самое опасное — вы не можете заранее знать, в каком режиме она работает сейчас: в режиме "цитирую реальность" или "играю в реальность". ИИ не обманывает. Он просто не умеет отличать правду от правдоподобия.

А вот мы — должны уметь.

#ИИ #искусственныйинтеллект #разработка #вадимасмолов #вадевелопер #vadeveloper #разработкасайтов

Когда ИИ начинает обманывать — это баг или фича? | Сетка — социальная сеть от hh.ru