OpenAI выпустила бесплатные модели для модерации контента
Модели gpt-oss-safeguard-120b и gpt-oss-safeguard-20b обучены искать опасный или неприемлемый контент. Например, они могут искать на сайте поддельные отзывы или токсичные комментарии. Политику задаёт разработчик.
Как и базовая gpt-oss, модели умеют рассуждать и показывать цепочку «мыслей», которая привела к принятию решения.
Скачать можно тут: https://huggingface.co/collections/openai/gpt-oss-safeguard