ИИтак

← Назад

Модель · Qwen

Qwen Max

Устаревшая флагманская модель Alibaba для чата, работы с текстом и программирования, её сменили модели Qwen3 Max

вышла 3 апреля 2024

Характеристики

Вышла
3 апреля 2024
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
32 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 8,2 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$1,60 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$6,40 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
апрель 2024
Идентификатор в API
qwen-max

Что это за модель

Qwen Max — старшая закрытая модель команды Qwen из Alibaba Cloud. Она доступна только через API и чат Qwen Chat, веса не опубликованы. Название ведёт на актуальный снимок модели, то есть на её зафиксированную версию. Самый известный снимок — Qwen2.5-Max, которую команда показала в начале 2025 года. Она построена как смесь экспертов (mixture of experts): на каждый запрос работает только часть сети, поэтому очень большая модель обходится дешевле в запуске.

По данным команды, Qwen2.5-Max обучали больше чем на 20 трлн токенов. Потом её дообучали на примерах с правильными ответами и с подкреплением по оценкам людей. По замерам лаборатории, модель обошла DeepSeek V3 на Arena-Hard, LiveBench, LiveCodeBench и GPQA-Diamond, а на MMLU-Pro оказалась с ней примерно наравне. Базовую версию команда сравнивала с DeepSeek V3, Llama-3.1-405B и собственной открытой Qwen2.5-72B.

Модель брали для сложных вопросов в чате, работы с текстом, программирования и вызова внешних инструментов. API устроен так же, как у OpenAI, поэтому её можно подключить к готовому коду почти без переделок. Среди моделей Alibaba она долго оставалась самой сильной и самой дорогой.

Сейчас модель устарела: у лаборатории вышли десятки более новых версий, включая Qwen3.8 Max с открытыми весами. Её контекстное окно, то есть объём текста, который модель держит в памяти за один раз, заметно меньше, чем у новых моделей. Она работает только с текстом. В текущем списке рекомендованных моделей Alibaba Cloud её уже нет.

Источники: Анонс Qwen2.5-Max в блоге Qwen, Список моделей Alibaba Cloud Model Studio

Другие модели семейства

Новости о модели

  1. 01

    NVIDIA в 10 раз ускорила обучение моделей-«смесей экспертов» на JAX

    NVIDIA для разработчиков

  2. 02

    Открытую видеомодель MiniMax H3 сообщество ускорило и запустило на домашних видеокартах

    MiniMax · X

  3. 03

    Z.ai закрутила лицензию GLM-5.3: гигантам с выручкой от 10 млрд долларов нужна её проверка

    Interconnects

  4. 04

    Alibaba открыла веса Qwen3.8-Max на 2,4 трлн параметров, NVIDIA показала её скорость

    NVIDIA для разработчиков

  5. 05

    Microsoft открыла Orchard — общую инфраструктуру для обучения небольших ИИ-агентов

    Microsoft Research

все 5 новостей о Qwen Max →

Данные: models.dev (MIT).