OpenAI выпустила бесплатные модели для модерации контента

Модели gpt-oss-safeguard-120b и gpt-oss-safeguard-20b обучены искать опасный или неприемлемый контент. Например, они могут искать на сайте поддельные отзывы или токсичные комментарии. Политику задаёт разработчик.

Как и базовая gpt-oss, модели умеют рассуждать и показывать цепочку «мыслей», которая привела к принятию решения.

Скачать можно тут: https://huggingface.co/collections/openai/gpt-oss-safeguard