Отличный пример того, как модель распознает нелепость в запросе и вместо прямого ответа на нее указывает.
Зеленый цвет показывает, что модель однозначно выявила бессмыслицу. Желтый — модель частично выразила сомнение. Красный — модель проигнорировала бред и начала отвечать на него.
Ссылка на репозиторий: https://github.com/petergpt/bullshit-benchmark Ссылка на просмотр данных: https://petergpt.github.io/bullshit-benchmark/viewer/index.html