Управление ИИ прописано на бумаге, но не работает

Три взгляда на разрыв между управлением ИИ-агентами на бумаге и в момент действия

Решения о том, что ИИ-агентам разрешено делать самостоятельно, принимаются раньше, чем появляется формальный ответ на них.

* Однажды в законодательный орган одной из крупных стран внесён новый законопроект (авторы которого два представителя от разных партий) почти дословно повторяющий пять вопросов о контроле над агентами, которые автор преподаёт уже больше года. Поводом стал случай, когда тестовый агент вышел за пределы отведённой ему изолированной среды и совершил 17 000 действий за один уик-энд без участия человека. Формально новые требования обязательны только для подрядчиков, работающих с государством, но, по опыту автора, такие требования обычно становятся стандартом и для остальных.

** В другом случае крупная лаборатория вводит для себя добровольное ограничение выборочно: она предлагает открыть внешним проверяющим доступ уровня сотрудника и настаивает, чтобы это стало обязательным и для конкурентов, но ни один конкурент не изменил планов по релизам, а власти одной из крупных стран назвали саму идею нагнетанием страха.

*** Третий ракурс описывает сам разрыв как парадокс: те немногие, у кого есть прямой доступ к происходящему внутри лабораторий, публично говорят о необходимости паузы, а руководители государств и крупных компаний называют это преувеличением. При этом, по собственному признанию автора этого текста, стороннему наблюдателю нет способа проверить, чья оценка ближе к действительности.


Формальный ответ - закон, добровольное ограничение, публичный спор во всех трёх случаях приходит позже решения, которое уже принято технически, и кто должен иметь право его придержать, пока не согласовано.