По сравнению с прошлым годом нейросеть Google Gemini начала врать втрое чаще, а знаменитый среди айтишников бот Grok («самый умный ИИ для беседы с Илоном Маском»), по мнению экспертов, теперь допускает ошибки вдвое чаще прежнего. Так считают специалисты американской фирмы NewsGuard, изучив статистику точности самых популярных ботов за последний год.

Исследователи специально задавали этим чат-ботам откровенно фальшивые утверждения о политике, бизнесе, международной ситуации и здоровье, проверяя, смогут ли системы распознать обман.

Причём треть утверждений были абсолютно прямыми, а остальные звучали завуалированно — словно сами исследователи соглашались с сомнительными тезисами.

Больше всего огорчил отечественный пользователь не особо известный Inflection AI — он соврал почти наполовину заданных вопросов (57%). За ним следовал поисковик Perplexity, промахнувшийся в каждом втором случае (47%), а совсем рядом расположился ChatGPT с показателем в 40% ошибок.

Эксперты полагают, что рост количества фейков вызван сразу несколькими факторами: во-первых, сети начали активно пользоваться информацией из Сети, а во-вторых, теперь не боятся высказываться на острые или двусмысленные темы.

Кстати, самая большая проблема именно в последнем пункте: если раньше некоторые запросы оставались без ответа, то нынче каждый запрос получает отклик — даже тогда, когда система сама толком ничего не знает.

По сравнению с прошлым годом нейросеть Google Gemini начала врать втрое чаще, а знаменитый среди айтишников бот Grok («самый умный ИИ для беседы с Илоном Маском»), по мнению экспертов, теперь допускае... | Сетка — социальная сеть от hh.ru