OpenAI предложила правила независимой проверки AI
Проверять предлагают четыре вещи: доказательства безопасности моделей, работу защитных механизмов, качество самих тестов и причины серьёзных инцидентов. Например, действительно ли ограничения мешают агенту совершать опасные действия и не поощряет ли обучение обман или обход правил.
Проверки могут занимать недели или месяцы и в основном не привязаны к выпуску конкретной модели. Обязательного разрешения аудиторов перед каждым релизом документ не вводит. Компании смогут просить скрыть чувствительные сведения в отчёте, а проверяющие могут писать, как это повлияло на их отчёт.
OpenAI уже обсуждает предложения с несколькими независимыми организациями.
https://openai.com/index/priorities-principles-third-party-assessments