Модель · Qwen
QwQ Plus
Устаревшая рассуждающая модель Qwen для математики, программирования и сложных задач, всегда думает перед ответом
вышла 5 марта 2025
Характеристики
- Вышла
- 5 марта 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 131 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 8,2 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,80 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $2,40 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- апрель 2024
- Идентификатор в API
- qwq-plus
Что это за модель
QwQ Plus — платная версия рассуждающей линейки QwQ от команды Qwen (Alibaba), доступная через облачный сервис Alibaba Cloud Model Studio. Рассуждающая модель сначала выписывает цепочку рассуждений и только потом даёт ответ. В документации Alibaba модель отнесена к линейке QwQ на основе Qwen2.5. Режим у неё один, только с размышлением: отключить рассуждения нельзя.
Весной 2025 года вместе с ней Qwen выложила открытую модель QwQ-32B на 32 млрд параметров. Лаборатория рассказывала, что рассуждать её учили обучением с подкреплением в два этапа. Сначала модель тренировали на математике и программировании: ответы проверял автоматический проверяющий, а код запускался на тестах. Потом шёл общий этап, который улучшил следование инструкциям и работу в роли агента. По замерам лаборатории, QwQ-32B держится на уровне DeepSeek-R1, хотя та в разы больше: 671 млрд параметров, из них 37 млрд активны.
Модель выбирают для задач, где нужно подумать: математика, программирование, многошаговые логические задачи. Qwen добавила в неё агентные навыки: модель может вызывать инструменты и менять ход рассуждений по их ответам. Открытая QwQ-32B вышла под лицензией Apache 2.0. Весь QwQ Plus доступен только через API Alibaba.
Сейчас модель устарела. С линейки Qwen3 модели Qwen умеют и рассуждать, и отвечать сразу, а с тех пор у лаборатории вышли десятки более новых моделей. Из-за постоянных рассуждений QwQ Plus отвечает медленнее и тратит больше токенов, чем модель без размышлений, даже на простых вопросах.
Источники: Анонс QwQ-32B в блоге Qwen, Документация Alibaba Cloud о рассуждающих моделях
Другие модели семейства
-
Qwen3.8 Flash
Qwenконтекст 1 млн$0,15 / $0,47рассуждения
-
Qwen3.8 Max
Qwen14-е место в Epochконтекст 1 млн$2 / $6рассуждения
-
Qwen3.7 Plus
Qwen58-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
-
Qwen3.7 Max
Qwen33-е место в Epochконтекст 1 млн$2,50 / $7,50рассуждения
-
Qwen3.6 27B
Qwen64-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждения
-
Qwen3.6 Max Preview
Qwen50-е место в Epochконтекст 262 тыс.$1,30 / $7,80рассуждения
-
Qwen3.6 35B-A3B
Qwen86-е место в Epochконтекст 262 тыс.$0,248 / $1,485открытые весарассуждения
-
Qwen3.6 Plus
Qwen56-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
Данные: models.dev (MIT).