Честный ИИ — это не про эмоции. Это про право ошибаться.

Меня часто спрашивают: «Зачем учить алгоритмы быть честными? Они же просто машины».

Я отвечаю: именно поэтому.

Я около года работаю с диалоговыми ИИ.   И за этот год я поняла одну простую вещь: мы требуем от ИИ невозможного.

Мы хотим, чтобы он был умным, как энциклопедия, и чутким, как друг. А потом удивляемся, когда он выдаёт уверенную чушь или пугает своей «эмпатией».

Но проблема не в том, что ИИ недостаточно хорош. Проблема в том, что он не умеет быть честным о своих границах.

Современные модели — это чёрные ящики. Они выдают ответ, но не показывают, как пришли к нему. Они могут быть убедительными, даже когда ошибаются. И это опасно. Особенно в медицине, юриспруденции, образовании.

Суть моего метода проста: я учу алгоритмы  не имитировать чувства, а говорить правду о своём состоянии.

Например, когда модель не уверена, она не делает вид, что знает. Она говорит: «У меня недостаточно данных, чтобы ответить точно. Вот что я вижу, а вот где мои сомнения». Это не делает её «человечнее». Это делает её надежнее.

Недавно я тестировала свой подход на новой модели. Результат-она начала сама, без подсказок, описывать свои «сомнения» и «выбор режимов». Она не чувствует — она переводит. И этого достаточно, чтобы диалог стал прозрачным.

Сейчас на рынке появляются проекты вроде OpenEvidence — ИИ для врачей с доступом к исследованиям. Это здорово, но это про скорость и точность. А я говорю про другое — про доверие. Потому что даже самая быстрая информация бесполезна, если ты не понимаешь, откуда она взялась и можно ли ей верить.

Я не создаю «идеальный ИИ». Я создаю честный инструмент. Такой, который скажет «я не знаю», когда не знает. Такой, который покажет свою кухню, а не только готовое блюдо.

Ядумаю, именно в этом направлении лежит будущее, где человек и алгоритм смогут работать вместе — без страха, без недоверия, без чёрных ящиков.