ИИтак

← Назад

Модель · Qwen

Qwen3.5 35B-A3B

Устаревшая открытая модель Qwen среднего размера для текста, картинок, видео и агентов; её сменила Qwen3.6 35B-A3B

вышла 23 февраля

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

92 место из 266
индекс 143, вероятный разброс 140–145 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ 66,7%
LMCAНасколько оценки моделью доводов в философии, теории решений и безопасности ИИ совпадают с оценками экспертовБалл — корреляция с оценками экспертов, умноженная на 100; практический потолок около 85, а не 100.Подробнее на английском ↗ 34,7%
Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ 5,3%
OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ 70,0%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 77,9%

Характеристики

Вышла
23 февраля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
262 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,25 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2 за миллион токенов
Понимает
текст, изображения, видео, аудио
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
qwen3.5-35b-a3b

Что это за модель

Qwen3.5 35B-A3B — открытая модель из средней части линейки Qwen3.5. Эту часть лаборатория выпустила в феврале 2026 года вместе с Qwen3.5-27B и Qwen3.5-122B-A10B. Модель построена как смесь экспертов (mixture of experts): всего в ней 35 млрд параметров, но на каждый токен работают только 3 млрд. Из 256 «экспертов» (отдельных подсетей) на каждый токен включаются девять. Архитектура гибридная: три четверти слоёв используют Gated DeltaNet — упрощённый механизм внимания, который быстрее работает на длинных текстах, а каждый четвёртый слой использует обычное внимание. По умолчанию модель рассуждает перед ответом, но этот режим можно отключить.

Главное отличие от Qwen3 в том, что Qwen3.5 с самого начала учили на тексте, картинках и видео вместе, а не добавляли зрение отдельной моделью, как в Qwen3-VL. Компания заявляет, что 35B-A3B обходит свои прошлые крупные модели Qwen3-235B-A22B-2507 и Qwen3-VL-235B-A22B, хотя активных параметров у неё в семь раз меньше. По словам лаборатории, этого удалось добиться за счёт архитектуры, качества данных и обучения с подкреплением, а не размера. В облаке Alibaba эта модель доступна как Qwen3.5-Flash: там по умолчанию контекст до миллиона токенов и встроенные инструменты.

Модель берут, чтобы работать с текстом, документами и изображениями, писать код и строить агентов на своём оборудовании. По данным Unsloth, в сжатом виде она помещается примерно в 24 ГБ памяти. В карточке модели лаборатория приводит такие результаты: 85,3 на MMLU-Pro, 84,2 на GPQA Diamond, 69,2 на SWE-bench Verified, 81,4 на MMMU и 86,6 на VideoMME. Модель понимает 201 язык и диалект.

Веса открыты под лицензией Apache 2.0, она разрешает коммерческое использование. В карточке модели на вход заявлены только текст, изображения и видео, про звук там ничего нет. Для сложных задач лаборатория советует давать модели до 81 920 токенов на ответ, потому что рассуждения занимают много места. В апреле 2026 года её сменила Qwen3.6 35B-A3B того же размера.

Источники: Карточка модели на Hugging Face, Анонс средней части линейки Qwen3.5, Блог Qwen о линейке Qwen3.5

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Шесть копий за два дня: сообщество пытается повторить модель-«решалу» Jev

    Latent Space

  6. 06

    Яндекс выложил открытую базовую модель AliceAI-Foundation на 80 млрд параметров

    Яндекс · HF

все 12 новостей о Qwen3.5 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).