Alibaba выпустила LLM на 1 трлн параметров Alibaba представила Qwen3-Max — крупнейшую на данный момент языковую модель (LLM) с более чем 1 трлн параметров. Это значительно больше, чем у крупнейших конкурентов: например, у самой крупной версии ChatGPT-5 публично заявлено 635 млрд параметров, а у DeepSeek-V3.1, Kimi K2 и Claude Opus 4 показатели заметно ниже. Технические возможности Qwen3-Max Qwen3-Max-Preview реализована на архитектуре с Mixture of Experts, где при обработке каждого токена задействуется лишь часть параметров, что позволяет масштабировать модель без пропорционального роста вычислительных затрат. Модель поддерживает контекст в 262–256 тыс. токенов и вывод до 32 768 токенов. Это позволяет работать с большими документами и многопродуктовыми задачами. Qwen3-Max оптимизирована для генерации с привлечением сторонних источников (RAG) и инструментов, а также поддерживает более 100 языков. Преимущество над конкурентами На внутренних и публичных тестах Qwen3-Max показала лучшие результаты, чем Claude Opus 4, Kimi K2 и DeepSeek-V3.1 — прежде всего в задачах по математике, программированию, логике и научным данным. Модель демонстрирует эффективное понимание инструкций и надежное выполнение сложных задач, а также уменьшение "галлюцинаций". Доступность и ограничения На сегодняшний день Qwen3-Max доступна в виде preview-версии. Ее можно протестировать через Qwen Chat, API от Alibaba Cloud и партнерские платформы, включая OpenRouter и Hugging Face. Публичные веса модели пока не распространяются. Модель доступна по коммерческой подписке с поэтапным ценообразованием — стоимость запроса зависит от объема используемых токенов.

Alibaba выпустила LLM на 1 трлн параметров
Alibaba представила Qwen3-Max — крупнейшую на данный момент языковую модель (LLM) с более чем 1 трлн параметров | Сетка — социальная сеть от hh.ru Alibaba выпустила LLM на 1 трлн параметров
Alibaba представила Qwen3-Max — крупнейшую на данный момент языковую модель (LLM) с более чем 1 трлн параметров | Сетка — социальная сеть от hh.ru