ИИтак

← Назад

Модель · Qwen

Qwen3.5 Plus

Устаревшая рабочая модель Qwen для агентов, программирования и анализа картинок и видео, её сменила Qwen3.7 Plus

вышла 16 февраля

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

62 место из 266
индекс 147, вероятный разброс 145–148 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ 67,5%
LMCAНасколько оценки моделью доводов в философии, теории решений и безопасности ИИ совпадают с оценками экспертовБалл — корреляция с оценками экспертов, умноженная на 100; практический потолок около 85, а не 100.Подробнее на английском ↗ 42,8%
Mystery Game Puzzles100 позиций из головоломочного варианта известной игры, название которой скрыто: нужно найти единственный лучший ходПодробнее на английском ↗ 8,6%
CL-bench LifeЗадачи, которые решаются только по данным из запроса: групповые чаты, личные заметки, истории покупок и браузераПодробнее на английском ↗ 12,4%
CL-benchУмение выучить новое прямо из длинного текста: вымышленные законы, языки программирования, правила — и решить по ним задачиЗадача засчитывается, только если ответ проходит все проверочные критерии экспертов, поэтому даже лидеры решают около четверти.Подробнее на английском ↗ 19,8%
APEX-Agents480 многошаговых рабочих задач из инвестбанкинга, консалтинга и корпоративного права: агент работает с файлами, почтой, таблицамиЗадача засчитывается, только если выполнены все пункты экспертного списка критериев; проверяет их другая модель.Подробнее на английском ↗ 13,6%
Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ 17,9%
SimpleQA Verified1000 коротких вопросов на факты, на которые модель отвечает по памяти, без поиска в интернетеБалл — F1: учитываются и доля верных ответов, и точность там, где модель решилась ответить, так что честное «не знаю» лучше ошибки.Подробнее на английском ↗ 25,4%
FrontierMath-Tier-4-2025-07-01-PrivateСамый сложный уровень FrontierMath: исследовательские задачи по математике, на которые у математика уходят часы или дниРезультат посчитан на закрытом наборе задач версии от июля 2025 года; в 2026 году вышла исправленная версия, и числа двух версий не сравнимы.Подробнее на английском ↗ 3,5%
FrontierMath-2025-02-28-PrivateНеопубликованные задачи FrontierMath (уровни 1–3) в версии от 28.02.2025: трудная математика, над которой специалист сидит часамиПодробнее на английском ↗ 36,9%
OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ 86,7%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 79,8%

Характеристики

Вышла
16 февраля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,40 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2,40 за миллион токенов
Понимает
текст, изображения, видео
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
апрель 2025
Идентификатор в API
qwen3.5-plus

Что это за модель

Qwen3.5 Plus — облачная версия открытой модели Qwen3.5-397B-A17B, с которой в феврале 2026 года началась линейка Qwen3.5. Модель устроена как смесь экспертов: всего у неё 397 млрд параметров, но на каждый токен работают только 17 млрд. Большая часть слоёв использует упрощённый механизм внимания Gated DeltaNet, обычное внимание стоит лишь в каждом четвёртом слое. За счёт этого модель быстро обрабатывает длинные тексты. По замерам Qwen, на контексте 256 тыс. токенов она выдаёт ответ в 19 раз быстрее, чем Qwen3-Max, а качество у них сопоставимое.

Главное отличие от Qwen3 в том, что модель с самого начала обучали одновременно на тексте, картинках и видео. Раньше для работы с изображениями у лаборатории были отдельные модели Qwen3-VL. Qwen также расширила обучение с подкреплением на большом числе агентных сред и довела поддержку до 201 языка и диалекта. Версию Plus отличают от открытых весов три вещи: контекст в миллион токенов включён по умолчанию, есть встроенные инструменты, и модель сама решает, когда их вызывать.

Модель берут для агентных задач, программирования, разбора документов и вопросов по картинкам и видео. Лаборатория приводит такие результаты открытой версии: 76,4 в SWE-bench Verified (исправление реальных ошибок в коде), 91,3 в математическом AIME26, 85,0 в мультимодальном MMMU и 93,1 в OCRBench (распознавание текста на изображениях).

Plus доступна только через облако Alibaba Cloud Model Studio с оплатой за токены и в чате Qwen Chat, где её использование ограничено. Режим рассуждений включён по умолчанию, поэтому ответы приходят медленнее. Открытые веса Qwen3.5-397B-A17B выложены под лицензией Apache 2.0, но для запуска нужно около восьми серверных видеокарт. Сейчас в линейке Plus её сменила Qwen3.7 Plus.

Источники: Анонс Qwen3.5 в блоге Qwen, Карточка Qwen3.5-397B-A17B на Hugging Face

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    Xiaomi перелила навыки MiMo-V2.6 в Qwen3.5-9B и выложила заготовку для обучения агентов

    MiMo · HF

  2. 02

    Яндекс рассказал, как обучал открытую модель Alice AI Foundation, и выложил свои бенчмарки

    Яндекс

  3. 03

    Qwen выложила подсказчик к Qwen-Image-2.1: из короткой просьбы делает подробный запрос

    Qwen · HF

  4. 04

    Расплывчатую правку — в точный запрос: Qwen выложила модель-подсказчик к Qwen-Image-2.1

    Qwen · HF

  5. 05

    Шесть копий за два дня: сообщество пытается повторить модель-«решалу» Jev

    Latent Space

  6. 06

    Яндекс выложил открытую базовую модель AliceAI-Foundation на 80 млрд параметров

    Яндекс · HF

все 12 новостей о Qwen3.5 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).