Душа по ГОСТу
ИИ проверят на нравственность. Значит, видимо, где-то уже нашли её эталон.
По данным «Ведомостей», российские ИИ-модели, претендующие на статус национальных или суверенных, будут тестировать в лабораториях. Эксперты изучат ответы и попробуют обойти встроенную в них цензуру хитрыми запросами. Успешный результат откроет разработчику путь к господдержке.
Такой тест полезен: он покажет, насколько легко заставить модель выдать запрещённый контент. Но нравственность - понятие, как мне кажется, намного более сложное. Справедливость, милосердие и патриотизм нельзя проверить одной кнопкой. Сначала кому-то придётся решить, какой ответ считать правильным, а какой отправить в брак.
Дальше интереснее. Национальные модели планируют внедрять прежде всего в образование и госуслуги. Миллионы людей будут получать одну версию «правильного» от системы, которую принято считать нейтральной. Люди выбрали границы ответа, но пользователь увидит мнение машины.
Так ИИ может стать идеальным рупором нравственных норм: без лица, должности и возможности спросить, кто так решил. Поэтому вместе с сертификатом стоит показывать публичную методику, спорные решения и имена тех, кто провел границу допустимого. Иначе фраза «так считает нейросеть» скоро станет удобнее фразы «так у нас принято».
P.S. Интересно, будет ли обновляться совесть вместе с выходом новой версии модели?