Насколько ИИ полагается на факты?
В школе сделали исследование – какая из современных LLM полагается на факты, а какая реагирует на шум в виде случайных фраз в запросе
Это важно для для того, чтобы доверять результатам ИИ. Или перепроверять? А если у вас работают автономные агенты, которым вы доверили принятие решение, как они будут себя вести?
Об этом и исследование, с упором на доступные в России модели