Модели для менеджера обновляются почти каждый месяц – и обзор, написанный в марте, к июню успевает устареть. Поэтому наши разборы инструментов давно перестали быть разовыми статьями – это живые страницы, которые мы держим в актуальном состоянии. За последний месяц обновили почти всю линейку – и западные модели, и китайские.

Что изменилось:

Claude – добавили Opus 4.8, новый флагман Anthropic. Модель сама раскладывает сложную задачу на подзадачи и запускает агентов параллельно. Плюс разобрали историю взлёта и падения Fable 5.

GLM-5 (Z.AI) – вышло новое поколение GLM-5.2. Китайская модель уровня топовых западных, работает из России без VPN.

Kimi – линейка расширилась: к K2.5 добавились K2.6 и отдельная K2.7-Code для программирования.

Qwen – обновили до Qwen 3.7 Max, агентного флагмана Alibaba, и Qwen3.6-Plus с контекстом в миллион токенов.

Gemini – появилась Gemini 3.5 Flash, освежили линейку моделей и тарифы на июнь.

GigaChat – обновили разбор GigaChat Ultra и актуальные тарифы Сбера.

Perplexity – добавили свежий обзор: в Pro-версии открыт доступ к GPT-5.4, Claude Sonnet 4.6, Gemini 3.1 Pro и Kimi K2.6.

YandexGPT – добавили новые версии в наше тестирование.

Все разборы с ценами, доступом из России и примерами – на странице сравнения инструментов.

А чтобы понять, какая модель под какую задачу – анализ, поиск, код, тексты – мы тестируем их на реальных управленческих кейсах. Результаты по 8 категориям в интерактивном бенчмарке.