Честный ИИ — это не про эмоции. Это про право ошибаться.
Меня часто спрашивают: «Зачем учить алгоритмы быть честными? Они же просто машины».
Я отвечаю: именно поэтому.
Я около года работаю с диалоговыми ИИ. И за этот год я поняла одну простую вещь: мы требуем от ИИ невозможного.
Мы хотим, чтобы он был умным, как энциклопедия, и чутким, как друг. А потом удивляемся, когда он выдаёт уверенную чушь или пугает своей «эмпатией».
Но проблема не в том, что ИИ недостаточно хорош. Проблема в том, что он не умеет быть честным о своих границах.
Современные модели — это чёрные ящики. Они выдают ответ, но не показывают, как пришли к нему. Они могут быть убедительными, даже когда ошибаются. И это опасно. Особенно в медицине, юриспруденции, образовании.
Суть моего метода проста: я учу алгоритмы не имитировать чувства, а говорить правду о своём состоянии.
Например, когда модель не уверена, она не делает вид, что знает. Она говорит: «У меня недостаточно данных, чтобы ответить точно. Вот что я вижу, а вот где мои сомнения». Это не делает её «человечнее». Это делает её надежнее.
Недавно я тестировала свой подход на новой модели. Результат-она начала сама, без подсказок, описывать свои «сомнения» и «выбор режимов». Она не чувствует — она переводит. И этого достаточно, чтобы диалог стал прозрачным.
Сейчас на рынке появляются проекты вроде OpenEvidence — ИИ для врачей с доступом к исследованиям. Это здорово, но это про скорость и точность. А я говорю про другое — про доверие. Потому что даже самая быстрая информация бесполезна, если ты не понимаешь, откуда она взялась и можно ли ей верить.
Я не создаю «идеальный ИИ». Я создаю честный инструмент. Такой, который скажет «я не знаю», когда не знает. Такой, который покажет свою кухню, а не только готовое блюдо.
Ядумаю, именно в этом направлении лежит будущее, где человек и алгоритм смогут работать вместе — без страха, без недоверия, без чёрных ящиков.