ИИтак

← Назад

Модель · Qwen

Qwen3.6 35B-A3B

Лёгкая открытая модель Qwen для программирования и агентов, понимает картинки и видео и запускается на своём компьютере

вышла 17 апреля

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

86 место из 266
индекс 144, вероятный разброс 142–146 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ 56,5%
LMCAНасколько оценки моделью доводов в философии, теории решений и безопасности ИИ совпадают с оценками экспертовБалл — корреляция с оценками экспертов, умноженная на 100; практический потолок около 85, а не 100.Подробнее на английском ↗ 34,9%
Mystery Game Puzzles100 позиций из головоломочного варианта известной игры, название которой скрыто: нужно найти единственный лучший ходПодробнее на английском ↗ 14,1%
Surface Evolver Bench16 задач: описать для физической программы Surface Evolver форму жидкости под действием поверхностного натяжения, гравитации и ограниченийЗасчитывается частичное выполнение: отдельные баллы за корректный файл, успешный прогон симуляции и совпадение объёма, площади и энергии с эталоном.Подробнее на английском ↗ 44,4%
FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ 20,4%
Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ 22,1%
Terminal BenchЗадачи в командной строке по мотивам реальной работы: агент сам выполняет их в терминале, результат проверяют автотестыПодробнее на английском ↗ 23,0%
WeirdMLНеобычные задачи по машинному обучению: модель пишет код, который на выданных данных обучает классификатор, например для распознавания фигурБалл — средняя точность обученных моделью классификаторов, а не доля решённых задач.Подробнее на английском ↗ 34,5%
OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ 86,7%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 79,8%

Характеристики

Вышла
17 апреля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
262 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,248 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$1,485 за миллион токенов
Понимает
текст, изображения, видео, аудио
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
qwen3.6-35b-a3b

Что это за модель

Qwen3.6 35B-A3B — открытая модель команды Qwen из Alibaba. Она построена как смесь экспертов (mixture of experts): модель состоит из 256 специализированных блоков, и на каждый токен включаются только 9 из них. Поэтому из 35 млрд параметров в работе каждый раз участвуют около 3 млрд, и модель отвечает быстро и дёшево. В ней чередуются два вида внимания: экономный линейный Gated DeltaNet на трёх слоях из четырёх и обычное внимание на каждом четвёртом.

От предшественницы Qwen3.5-35B-A3B её отличает прежде всего программирование с участием агента: лаборатория заявляет, что модель лучше работает с фронтендом (той частью сайта, которую видит пользователь) и лучше разбирается в целом репозитории. Появилось сохранение рассуждений: модель помнит свои размышления из прошлых сообщений диалога. По словам лаборатории, так её решения в долгой работе последовательнее, а токенов уходит меньше. По замерам Qwen, она набирает 73,4 на SWE-bench Verified, 92,7 на AIME 2026 и 86,0 на GPQA и на части тестов по программированию обходит плотную Qwen3.5-27B, у которой в работе все параметры сразу.

Её берут, когда нужен агент или помощник для кода, который работает на собственном оборудовании, а не в чужом облаке. Модель понимает картинки и видео, поэтому подходит и для задач, где надо разобрать скриншот или документ. В рейтинге Epoch она заметно ниже флагманов, а в линейке Qwen уже вышли более новые версии 3.7 и 3.8.

Веса выложены под лицензией Apache 2.0: их можно свободно применять, в том числе в коммерческих продуктах. По умолчанию модель сначала рассуждает, а потом отвечает, и на простых запросах это добавляет время. Контекст можно растянуть почти до миллиона токенов способом YaRN, но лаборатория предупреждает, что тогда модель может хуже справляться с короткими текстами.

Источники: Карточка модели на Hugging Face, Анонс в блоге Qwen

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    NVIDIA выпустила Nemotron 3.5 Lightning — малую открытую модель для рутинной работы агентов

    NVIDIA для разработчиков

все 1 новость о Qwen3.6 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).