Модель · Qwen
Qwen3-Coder 480B-A35B Instruct
Устаревшая открытая модель Qwen для программирования и агентной работы с кодом, в 2025 году — главная в кодовой линейке
вышла 1 апреля 2025
Характеристики
- Вышла
- 1 апреля 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 262 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 65 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $1,50 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $7,50 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- нет
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- апрель 2025
- Идентификатор в API
- qwen3-coder-480b-a35b-instruct
Что это за модель
Qwen3-Coder 480B-A35B Instruct — самая большая модель из кодовой линейки Qwen3-Coder, которую Qwen выпустила летом 2025 года. Она построена как смесь экспертов (mixture of experts): внутри 160 специализированных подсетей, и на каждый токен включаются только 8 из них. Всего в модели 480 млрд параметров, но в работе одновременно участвуют 35 млрд. Поэтому она быстрее и дешевле в запуске, чем плотная модель такого же размера.
Модель учили на 7,5 трлн токенов, из них 70% — программный код. Потом её доучивали с подкреплением: давали реальные задачи, которые трудно решить, но легко проверить. Для агентных сценариев, где модель сама планирует шаги и вызывает инструменты в несколько ходов, лаборатория запускала до 20 тысяч сред параллельно. По словам Qwen, на бенчмарке SWE-Bench Verified модель показала лучший результат среди открытых моделей, а в агентных задачах была сравнима с Claude Sonnet 4.
Её берут, чтобы работать с большими кодовыми базами и поручать агенту задачи на несколько шагов: исправить ошибку в репозитории, дописать функцию, запустить команды. Вместе с моделью Qwen выпустила консольную программу Qwen Code. Модель можно подключить и к Claude Code и Cline через API Alibaba Cloud. Родное контекстное окно в 256 тысяч токенов, по данным лаборатории, можно растянуть до миллиона с помощью метода YaRN.
У модели нет режима рассуждений: она сразу выдаёт ответ, без отдельного блока с цепочкой рассуждений. Веса открыты под лицензией Apache 2.0, она разрешает и коммерческое использование. Но из-за размера модель запускают на серверах, а не на обычном компьютере. С тех пор у Qwen вышло много более новых моделей, включая линейки Qwen3.6–3.8.
Источники: Анонс Qwen3-Coder в блоге Qwen, Карточка модели на Hugging Face
Другие модели семейства
-
Qwen3.8 Flash
Qwenконтекст 1 млн$0,15 / $0,47рассуждения
-
Qwen3.8 Max
Qwen14-е место в Epochконтекст 1 млн$2 / $6рассуждения
-
Qwen3.7 Plus
Qwen58-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
-
Qwen3.7 Max
Qwen33-е место в Epochконтекст 1 млн$2,50 / $7,50рассуждения
-
Qwen3.6 27B
Qwen64-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждения
-
Qwen3.6 Max Preview
Qwen50-е место в Epochконтекст 262 тыс.$1,30 / $7,80рассуждения
-
Qwen3.6 35B-A3B
Qwen86-е место в Epochконтекст 262 тыс.$0,248 / $1,485открытые весарассуждения
-
Qwen3.6 Plus
Qwen56-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT).