Модель · Qwen
Qwen3.5 Plus
Устаревшая рабочая модель Qwen для агентов, программирования и анализа картинок и видео, её сменила Qwen3.7 Plus
вышла 16 февраля
Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗
62 место из 266
индекс 147, вероятный разброс 145–148 · весь рейтинг →
| Бенчмарк | РезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию теста | УсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен |
|---|---|---|
| DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ | 67,5% | |
| LMCAНасколько оценки моделью доводов в философии, теории решений и безопасности ИИ совпадают с оценками экспертовБалл — корреляция с оценками экспертов, умноженная на 100; практический потолок около 85, а не 100.Подробнее на английском ↗ | 42,8% | |
| Mystery Game Puzzles100 позиций из головоломочного варианта известной игры, название которой скрыто: нужно найти единственный лучший ходПодробнее на английском ↗ | 8,6% | |
| CL-bench LifeЗадачи, которые решаются только по данным из запроса: групповые чаты, личные заметки, истории покупок и браузераПодробнее на английском ↗ | 12,4% | |
| CL-benchУмение выучить новое прямо из длинного текста: вымышленные законы, языки программирования, правила — и решить по ним задачиЗадача засчитывается, только если ответ проходит все проверочные критерии экспертов, поэтому даже лидеры решают около четверти.Подробнее на английском ↗ | 19,8% | |
| APEX-Agents480 многошаговых рабочих задач из инвестбанкинга, консалтинга и корпоративного права: агент работает с файлами, почтой, таблицамиЗадача засчитывается, только если выполнены все пункты экспертного списка критериев; проверяет их другая модель.Подробнее на английском ↗ | 13,6% | |
| Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ | 17,9% | |
| SimpleQA Verified1000 коротких вопросов на факты, на которые модель отвечает по памяти, без поиска в интернетеБалл — F1: учитываются и доля верных ответов, и точность там, где модель решилась ответить, так что честное «не знаю» лучше ошибки.Подробнее на английском ↗ | 25,4% | |
| FrontierMath-Tier-4-2025-07-01-PrivateСамый сложный уровень FrontierMath: исследовательские задачи по математике, на которые у математика уходят часы или дниРезультат посчитан на закрытом наборе задач версии от июля 2025 года; в 2026 году вышла исправленная версия, и числа двух версий не сравнимы.Подробнее на английском ↗ | 3,5% | |
| FrontierMath-2025-02-28-PrivateНеопубликованные задачи FrontierMath (уровни 1–3) в версии от 28.02.2025: трудная математика, над которой специалист сидит часамиПодробнее на английском ↗ | 36,9% | |
| OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ | 86,7% | |
| GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ | 79,8% |
Характеристики
- Вышла
- 16 февраля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 65 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,40 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $2,40 за миллион токенов
- Понимает
- текст, изображения, видео
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- апрель 2025
- Идентификатор в API
- qwen3.5-plus
Что это за модель
Qwen3.5 Plus — облачная версия открытой модели Qwen3.5-397B-A17B, с которой в феврале 2026 года началась линейка Qwen3.5. Модель устроена как смесь экспертов: всего у неё 397 млрд параметров, но на каждый токен работают только 17 млрд. Большая часть слоёв использует упрощённый механизм внимания Gated DeltaNet, обычное внимание стоит лишь в каждом четвёртом слое. За счёт этого модель быстро обрабатывает длинные тексты. По замерам Qwen, на контексте 256 тыс. токенов она выдаёт ответ в 19 раз быстрее, чем Qwen3-Max, а качество у них сопоставимое.
Главное отличие от Qwen3 в том, что модель с самого начала обучали одновременно на тексте, картинках и видео. Раньше для работы с изображениями у лаборатории были отдельные модели Qwen3-VL. Qwen также расширила обучение с подкреплением на большом числе агентных сред и довела поддержку до 201 языка и диалекта. Версию Plus отличают от открытых весов три вещи: контекст в миллион токенов включён по умолчанию, есть встроенные инструменты, и модель сама решает, когда их вызывать.
Модель берут для агентных задач, программирования, разбора документов и вопросов по картинкам и видео. Лаборатория приводит такие результаты открытой версии: 76,4 в SWE-bench Verified (исправление реальных ошибок в коде), 91,3 в математическом AIME26, 85,0 в мультимодальном MMMU и 93,1 в OCRBench (распознавание текста на изображениях).
Plus доступна только через облако Alibaba Cloud Model Studio с оплатой за токены и в чате Qwen Chat, где её использование ограничено. Режим рассуждений включён по умолчанию, поэтому ответы приходят медленнее. Открытые веса Qwen3.5-397B-A17B выложены под лицензией Apache 2.0, но для запуска нужно около восьми серверных видеокарт. Сейчас в линейке Plus её сменила Qwen3.7 Plus.
Источники: Анонс Qwen3.5 в блоге Qwen, Карточка Qwen3.5-397B-A17B на Hugging Face
Того же уровня по индексу Epoch
-
Claude Sonnet 4.5
Anthropic61-е место в Epochконтекст 1 млн$3 / $15рассуждениядороже в 6,3 раза
-
MiniMax-M2.5
MiniMax63-е место в Epochконтекст 204 тыс.$0,30 / $1,20открытые весарассуждениядешевле в 2 раза
-
Qwen3.5 397B-A17B
Qwen59-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждениядороже в 1,5 раза
Другие модели семейства
-
Qwen3.8 Flash
Qwenконтекст 1 млн$0,15 / $0,47рассуждения
-
Qwen3.8 Max
Qwen14-е место в Epochконтекст 1 млн$2 / $6рассуждения
-
Qwen3.7 Plus
Qwen58-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
-
Qwen3.7 Max
Qwen33-е место в Epochконтекст 1 млн$2,50 / $7,50рассуждения
-
Qwen3.6 27B
Qwen64-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждения
-
Qwen3.6 Max Preview
Qwen50-е место в Epochконтекст 262 тыс.$1,30 / $7,80рассуждения
-
Qwen3.6 35B-A3B
Qwen86-е место в Epochконтекст 262 тыс.$0,248 / $1,485открытые весарассуждения
-
Qwen3.6 Plus
Qwen56-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).