ИИтак

← Назад

Модель · Qwen

Qwen3 Coder Flash

Лёгкая и дешёвая модель Qwen для программирования и агентов 2025 года, младшая сестра Qwen3-Coder-Plus. Сейчас устарела

вышла 28 июля 2025

Характеристики

Вышла
28 июля 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,30 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$1,50 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
апрель 2025
Идентификатор в API
qwen3-coder-flash

Что это за модель

Qwen3 Coder Flash — младшая модель линейки Qwen3-Coder для программирования. В облаке Alibaba Cloud Model Studio она описана как модель на базе Qwen3, которая унаследовала агентные навыки старшей Qwen3-Coder-Plus. Она ведёт многошаговый диалог с вызовом инструментов, то есть сама запускает команды и читает их результат. Qwen представила под именем Qwen3-Coder-Flash и открытую модель Qwen3-Coder-30B-A3B-Instruct. Эта модель устроена как смесь экспертов (mixture of experts): всего в ней 30,5 млрд параметров, но на каждый токен работают около 3,3 млрд. Поэтому она отвечает быстро и стоит недорого.

От Qwen3-Coder-Plus её отличают размер и цена: Flash заметно дешевле и подходит там, где запросов много, а задачи попроще. По словам лаборатории, при дообучении упор сделали на понимание кода всего репозитория и на то, чтобы инструменты вызывались без сбоев. Qwen называет среды, под которые настраивала модель: собственный консольный помощник Qwen Code, а также Cline, Roo Code и Kilo Code.

Модель берут для агентной работы с кодом: правок сразу в нескольких файлах, разбора большого проекта, генерации кода в редакторе. Длинное контекстное окно позволяет загрузить в запрос значительную часть кодовой базы.

Модель не умеет рассуждать: она сразу пишет ответ и не выводит цепочку рассуждений. Возможности в облаке зависят от региона: в Пекине доступны вызов функций и кэш контекста, а в Сингапуре, Германии и США вызова функций нет, зато работает дописывание заданного начала ответа. Открытые веса модели выложены под лицензией Apache 2.0. Сама Alibaba теперь советует вместо моделей Qwen-Coder брать свежие универсальные модели Qwen.

Источники: Описание qwen3-coder-flash в Model Studio, Карточка Qwen3-Coder-30B-A3B-Instruct, Модели Qwen-Coder в документации Alibaba Cloud

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Qwen-Image-2.1 научили раздавать по сети — инструкция есть, кода в vLLM-Omni пока нет

    Qwen · X

  6. 06

    Alibaba открыла Qwen-Image-2.1: рисует с прозрачным фоном и правит обведённое кружком

    Qwen · X

все 30 новостей о Qwen3 →

Данные: models.dev (MIT).