ИИтак

← Назад

Модель · Qwen

QwQ Plus

Устаревшая рассуждающая модель Qwen для математики, программирования и сложных задач, всегда думает перед ответом

вышла 5 марта 2025

Характеристики

Вышла
5 марта 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
131 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 8,2 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,80 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2,40 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
апрель 2024
Идентификатор в API
qwq-plus

Что это за модель

QwQ Plus — платная версия рассуждающей линейки QwQ от команды Qwen (Alibaba), доступная через облачный сервис Alibaba Cloud Model Studio. Рассуждающая модель сначала выписывает цепочку рассуждений и только потом даёт ответ. В документации Alibaba модель отнесена к линейке QwQ на основе Qwen2.5. Режим у неё один, только с размышлением: отключить рассуждения нельзя.

Весной 2025 года вместе с ней Qwen выложила открытую модель QwQ-32B на 32 млрд параметров. Лаборатория рассказывала, что рассуждать её учили обучением с подкреплением в два этапа. Сначала модель тренировали на математике и программировании: ответы проверял автоматический проверяющий, а код запускался на тестах. Потом шёл общий этап, который улучшил следование инструкциям и работу в роли агента. По замерам лаборатории, QwQ-32B держится на уровне DeepSeek-R1, хотя та в разы больше: 671 млрд параметров, из них 37 млрд активны.

Модель выбирают для задач, где нужно подумать: математика, программирование, многошаговые логические задачи. Qwen добавила в неё агентные навыки: модель может вызывать инструменты и менять ход рассуждений по их ответам. Открытая QwQ-32B вышла под лицензией Apache 2.0. Весь QwQ Plus доступен только через API Alibaba.

Сейчас модель устарела. С линейки Qwen3 модели Qwen умеют и рассуждать, и отвечать сразу, а с тех пор у лаборатории вышли десятки более новых моделей. Из-за постоянных рассуждений QwQ Plus отвечает медленнее и тратит больше токенов, чем модель без размышлений, даже на простых вопросах.

Источники: Анонс QwQ-32B в блоге Qwen, Документация Alibaba Cloud о рассуждающих моделях

Другие модели семейства

Данные: models.dev (MIT).