ИИтак

← Назад

Модель · Qwen

Qwen3-Coder 480B-A35B Instruct

Устаревшая открытая модель Qwen для программирования и агентной работы с кодом, в 2025 году — главная в кодовой линейке

вышла 1 апреля 2025

Характеристики

Вышла
1 апреля 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
262 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$1,50 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$7,50 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Знания до
апрель 2025
Идентификатор в API
qwen3-coder-480b-a35b-instruct

Что это за модель

Qwen3-Coder 480B-A35B Instruct — самая большая модель из кодовой линейки Qwen3-Coder, которую Qwen выпустила летом 2025 года. Она построена как смесь экспертов (mixture of experts): внутри 160 специализированных подсетей, и на каждый токен включаются только 8 из них. Всего в модели 480 млрд параметров, но в работе одновременно участвуют 35 млрд. Поэтому она быстрее и дешевле в запуске, чем плотная модель такого же размера.

Модель учили на 7,5 трлн токенов, из них 70% — программный код. Потом её доучивали с подкреплением: давали реальные задачи, которые трудно решить, но легко проверить. Для агентных сценариев, где модель сама планирует шаги и вызывает инструменты в несколько ходов, лаборатория запускала до 20 тысяч сред параллельно. По словам Qwen, на бенчмарке SWE-Bench Verified модель показала лучший результат среди открытых моделей, а в агентных задачах была сравнима с Claude Sonnet 4.

Её берут, чтобы работать с большими кодовыми базами и поручать агенту задачи на несколько шагов: исправить ошибку в репозитории, дописать функцию, запустить команды. Вместе с моделью Qwen выпустила консольную программу Qwen Code. Модель можно подключить и к Claude Code и Cline через API Alibaba Cloud. Родное контекстное окно в 256 тысяч токенов, по данным лаборатории, можно растянуть до миллиона с помощью метода YaRN.

У модели нет режима рассуждений: она сразу выдаёт ответ, без отдельного блока с цепочкой рассуждений. Веса открыты под лицензией Apache 2.0, она разрешает и коммерческое использование. Но из-за размера модель запускают на серверах, а не на обычном компьютере. С тех пор у Qwen вышло много более новых моделей, включая линейки Qwen3.6–3.8.

Источники: Анонс Qwen3-Coder в блоге Qwen, Карточка модели на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Qwen-Image-2.1 научили раздавать по сети — инструкция есть, кода в vLLM-Omni пока нет

    Qwen · X

  6. 06

    Alibaba открыла Qwen-Image-2.1: рисует с прозрачным фоном и правит обведённое кружком

    Qwen · X

все 30 новостей о Qwen3 →

Данные: models.dev (MIT).