🤡 Эпичный кейс с ИИ-глюками

Решила я для вас подготовить обзор на не совсем свежий, но все еще актуальный отчет «Total Experience: Redefining Excellence in the Age of Agentic AI» или по-русски «Комплексный опыт: переосмысление совершенства в эпоху агентного ИИ» от KPMG🫢

И, если вы думали, что ИИ-галлюцинации это проблема только джунов, которые ленятся проводить факт чек, то читаем ниже) Консалтинговые гиганты, которые за огромные деньги продают компаниям «ответственное внедрение ИИ» и «защиту от рисков», сами попались на самом детском факапе!

Что произошло Входящий в ту самую Четверку крупнейших консалт агентств мира KPMG отозвала свой свежий отчет об агентном ИИ. Почему?

Потому что исследовательская группа GPTZero и Financial Times выяснили что содержащиеся в нем ссылки на успешные кейсы про внедрение ИИ в банке UBS, британской NHS и транспортных системах Швейцарии это просто выдумка нейросети!

Представители UBS и NHS вышли с официальным: «Эээ, ребят, мы этого не делали, это вранье»😬 В чем ирония Эти фирмы активно продвигают услуги по аудиту ИИ-систем, то есть они говорят: мы проверим ваш ИИ на галлюцинации и научим вас ответственно использовать этот инструмент, в то время как их собственные отчеты пишутся нейронкой без минимального фактчекинга🤬 Звуки горящих пятых точек в студию!

Понятно, что ИИ это не замена мозгу, тем более если основная ваша экспертиза это консалт. Если вы используете LLM для аналитики или отчетов, фактчекинг и точность это буквально ваша религия. Даже если вы партнер в KPMG). Репутация стоит дороже токенов и буквально один такой факап перечеркивает годы работы над брендом экспертов по ИИ. Причем неважно вы топовое консалт агенство или маленький стартап, какой-то аналитик поленился проверить данные и вы по уши сидите в луже

Критическое мышление маст-хэв! Кажется, в Большой Четверке решили, что «Fake it till you make it» теперь работает и для ИИ-кейсов. Но нет!

Ciao💚

#ИИ