Этот тир-лист ИИ-моделей, возможно, точнее большинства официальных бенчмарков. Потому что он составлен не по результатам тестовых задач, а на основе реального использования за деньги.
С чем согласны, а с чем нет? Я работаю с openAI и вполне для моих задач подходит, хотя рука тянет попробовать Клод.
tg / max
В этом посте были ссылки, но мы их удалили по правилам Сетки