Китайская модель Kimi K2.5 от Moonshot AI заняла 6-е место в нашем тестировании AI моделей на реальных управленческих задачах. Выше – только GPT-5.4, GPT-5.2 Pro, Claude Sonnet 4.5, Claude Opus 4.5 и Claude Sonnet 4.6.
Самое интересное – где именно Kimi обошёл флагманы:
Анализ и принятие решений – 5-е место. Рядом с Claude Opus 4.5 и GPT-5.2 Pro. На практике это означает: в задачах типа «разбери конфликт между отделами и предложи решение» или «проанализируй отчёт и найди риски» Kimi даёт результат, почти неотличимый от моделей за $100+/месяц.
Поиск информации – 2-е место из 50 моделей. Обошёл все модели OpenAI и Anthropic. А в режиме Agent Swarm (до 100 параллельных подагентов) Kimi набрал 78,4% на BrowseComp – лучше GPT-5.2 и Claude Opus 4.5.
Консистентность – самый низкий разброс оценок по 8 категориям среди всех протестированных моделей. Kimi одинаково надёжен для любого типа задачи.
Программирование – 76,8% на SWE-Bench. Уступает Claude Opus 4.5 (80,9%) и GPT-5.2 (80,0%), но опережает DeepSeek V3.2 (73,1%). Для менеджера это означает: автоматизация через код и работа с API – на уровне лучших.
Отдельно выделяется агентский режим. Kimi умеет генерировать презентации, документы (.docx, .pdf, .xlsx) и таблицы прямо в чате – конкурирует с NotebookLM от Google. Просите «подготовь отчёт на основе нескольких источников» – и получаете готовый документ, а не просто текст.
При этом модель бесплатна для базового использования через kimi.com (работает в России без VPN), а через API стоит $0,45 за миллион входных токенов – в 60 раз дешевле Claude Opus. Открытый код MIT.
Подробный разбор с бенчмарками, ценами и инструкцией для России – в нашем обзоре.
Кстати, у нас открыты продажи курса по ИИ для менеджеров – практика с ChatGPT, Claude, DeepSeek, YandexGPT и другими инструментами. Цены и условия