ИИтак

← Назад

Модель · Qwen

Qwen3.5 27B

Открытая модель Qwen среднего размера для рассуждений, программирования и работы с картинками, устаревшая: её сменила Qwen3.6 27B

вышла 23 февраля

Характеристики

Вышла
23 февраля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
262 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,30 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2,40 за миллион токенов
Понимает
текст, изображения, видео, аудио
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
qwen3.5-27b

Что это за модель

Qwen3.5 27B — открытая модель из линейки Qwen3.5 с 27 млрд параметров. Она плотная: на каждый токен работают все параметры, без схемы смеси экспертов. Внимание в ней гибридное. Из каждых четырёх блоков три используют линейный механизм Gated DeltaNet, который дёшево обрабатывает длинный текст, и только один — обычное внимание. Так лаборатория ускоряет инференс, то есть выдачу ответа.

Модель с самого начала обучали и на тексте, и на изображениях, поэтому отдельная версия с приставкой VL для зрения ей не нужна. По словам Qwen, в текстовых задачах она не уступает прошлому поколению Qwen3, а в мультимодальных тестах обходит Qwen3-VL. Старшая Qwen3.5 122B сильнее, но 27B заметно экономнее. Круг языков расширили до 201 языка и диалекта. В апреле 2026 года вышла Qwen3.6 27B того же размера, она пришла на смену этой модели.

Её берут для рассуждений, программирования, агентных задач и разбора документов и картинок. В карточке модели Qwen приводит такие результаты: 86,1 в MMLU-Pro, 85,5 в GPQA Diamond, 72,4 в SWE-bench Verified (исправление реальных ошибок в коде), 75,0 в MMMU-Pro и 86,0 в MathVision. Встроенное контекстное окно можно растянуть примерно до миллиона токенов с помощью метода YaRN.

По умолчанию модель сначала рассуждает и только потом отвечает. Поэтому ответы выходят длинными: лаборатория советует оставлять до 32 768 токенов на вывод. Веса выложены по лицензии Apache 2.0, которая разрешает коммерческое использование. Правда, для запуска у себя нужно около 56 ГБ памяти без сжатия.

Источники: Карточка модели на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Шесть копий за два дня: сообщество пытается повторить модель-«решалу» Jev

    Latent Space

  6. 06

    Яндекс выложил открытую базовую модель AliceAI-Foundation на 80 млрд параметров

    Яндекс · HF

все 12 новостей о Qwen3.5 →

Данные: models.dev (MIT).