Модель · Qwen
Qwen3 Coder Flash
Лёгкая и дешёвая модель Qwen для программирования и агентов 2025 года, младшая сестра Qwen3-Coder-Plus. Сейчас устарела
вышла 28 июля 2025
Характеристики
- Вышла
- 28 июля 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 65 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,30 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $1,50 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- нет
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- апрель 2025
- Идентификатор в API
- qwen3-coder-flash
Что это за модель
Qwen3 Coder Flash — младшая модель линейки Qwen3-Coder для программирования. В облаке Alibaba Cloud Model Studio она описана как модель на базе Qwen3, которая унаследовала агентные навыки старшей Qwen3-Coder-Plus. Она ведёт многошаговый диалог с вызовом инструментов, то есть сама запускает команды и читает их результат. Qwen представила под именем Qwen3-Coder-Flash и открытую модель Qwen3-Coder-30B-A3B-Instruct. Эта модель устроена как смесь экспертов (mixture of experts): всего в ней 30,5 млрд параметров, но на каждый токен работают около 3,3 млрд. Поэтому она отвечает быстро и стоит недорого.
От Qwen3-Coder-Plus её отличают размер и цена: Flash заметно дешевле и подходит там, где запросов много, а задачи попроще. По словам лаборатории, при дообучении упор сделали на понимание кода всего репозитория и на то, чтобы инструменты вызывались без сбоев. Qwen называет среды, под которые настраивала модель: собственный консольный помощник Qwen Code, а также Cline, Roo Code и Kilo Code.
Модель берут для агентной работы с кодом: правок сразу в нескольких файлах, разбора большого проекта, генерации кода в редакторе. Длинное контекстное окно позволяет загрузить в запрос значительную часть кодовой базы.
Модель не умеет рассуждать: она сразу пишет ответ и не выводит цепочку рассуждений. Возможности в облаке зависят от региона: в Пекине доступны вызов функций и кэш контекста, а в Сингапуре, Германии и США вызова функций нет, зато работает дописывание заданного начала ответа. Открытые веса модели выложены под лицензией Apache 2.0. Сама Alibaba теперь советует вместо моделей Qwen-Coder брать свежие универсальные модели Qwen.
Источники: Описание qwen3-coder-flash в Model Studio, Карточка Qwen3-Coder-30B-A3B-Instruct, Модели Qwen-Coder в документации Alibaba Cloud
Другие модели семейства
-
Qwen3.8 Flash
Qwenконтекст 1 млн$0,15 / $0,47рассуждения
-
Qwen3.8 Max
Qwen14-е место в Epochконтекст 1 млн$2 / $6рассуждения
-
Qwen3.7 Plus
Qwen58-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
-
Qwen3.7 Max
Qwen33-е место в Epochконтекст 1 млн$2,50 / $7,50рассуждения
-
Qwen3.6 27B
Qwen64-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждения
-
Qwen3.6 Max Preview
Qwen50-е место в Epochконтекст 262 тыс.$1,30 / $7,80рассуждения
-
Qwen3.6 35B-A3B
Qwen86-е место в Epochконтекст 262 тыс.$0,248 / $1,485открытые весарассуждения
-
Qwen3.6 Plus
Qwen56-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT).