Что покупает менеджер, выбирая самую дорогую модель ИИ? Репутацию провайдера? Привычку? Уверенность, что «у нас самое лучшее» – даже если это «лучшее» не видно в результате?
Для команды из 10 менеджеров маршрутизация 80% рутины (черновики, протоколы, справки) на бюджетную модель экономит около $125 в месяц. Потеря качества – 11%. На этих задачах разница буквально невидима.
Метрика PPD (качество на доллар) расставляет модели иначе. Qwen3.5 9B – в 750 раз эффективнее GPT-5.2 Pro на каждый потраченный доллар. При этом Qwen запускается локально на обычном ноутбуке – бесплатно. Kimi K2.5 набирает 99% качества GPT-5.4 при 1,4% стоимости GPT-5.2 Pro – и доступна как бесплатный чат.
Claude Sonnet 4.5 и GPT-5.2 Pro показали одинаковое качество. Разница в цене – десятикратная. Мы перепроверяли трижды.
Зависимость «цена – качество» на этом рынке логарифмическая. Разброс цен между 53 моделями – 1600 раз. Разница в качестве между десяткой лучших – менее 5%. Увеличение цены в 85 раз на верхнем сегменте добавляет почти неразличимую прибавку.
Данные из нашего бенчмарка 54 моделей по восьми категориям управленческих задач.
В этом посте были ссылки, но мы их удалили по правилам Сетки