ИИтак

← Назад

Модель · Qwen

Qwen3 Coder Plus

Устаревшая модель Qwen для программирования и агентов: правит код в репозиториях, её сменили новые версии линейки

вышла 23 июля 2025

Характеристики

Вышла
23 июля 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$1 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$5 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Знания до
апрель 2025
Идентификатор в API
qwen3-coder-plus

Что это за модель

Qwen3 Coder Plus — модель Qwen для программирования, доступная через облако Alibaba Cloud Model Studio. В её основе лежит открытая Qwen3-Coder-480B-A35B-Instruct. Эта модель построена как смесь экспертов (mixture of experts): у неё 480 млрд параметров, 160 «экспертов», и на каждый токен включаются только 8 из них, то есть около 35 млрд параметров. Так модель работает быстрее и дешевле, чем плотная модель того же размера.

От обычных чат-моделей её отличает обучение на агентных задачах. Лаборатория дообучала её с подкреплением: модель писала код, его запускали и проверяли результат. Для долгих задач, где нужно много шагов и работа с инструментами, Qwen запускала 20 тысяч параллельных сред в духе бенчмарка SWE-Bench. По заявлению лаборатории, в агентном программировании, работе с браузером и вызове инструментов модель на момент выхода показывала результаты на уровне Claude Sonnet 4.

Её берут для программных агентов: правок по всему репозиторию, многошаговых задач в терминале, работы с большими объёмами кода. Изначально модель рассчитана на 256 тысяч токенов, а до миллиона контекст растягивают специальными методами. Вместе с ней Qwen выпустила Qwen Code — консольный инструмент для работы с кодом, созданный на основе Gemini CLI.

Модель не умеет рассуждать перед ответом: у неё нет режима размышлений, она сразу выдаёт результат. Открытые веса базовой модели выложены под лицензией Apache 2.0, но для запуска на своём оборудовании нужно много памяти. С тех пор у Qwen вышло много новых моделей, так что эту версию выбирают скорее по привычке или ради совместимости.

Источники: Анонс Qwen3-Coder в блоге Qwen, Карточка модели на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Qwen-Image-2.1 научили раздавать по сети — инструкция есть, кода в vLLM-Omni пока нет

    Qwen · X

  6. 06

    Alibaba открыла Qwen-Image-2.1: рисует с прозрачным фоном и правит обведённое кружком

    Qwen · X

все 30 новостей о Qwen3 →

Данные: models.dev (MIT).