Модель · Qwen
Qwen3 14B
Устаревшая открытая модель Qwen среднего размера для чата, рассуждений и вызова инструментов, запускается на своём сервере
вышла 1 апреля 2025
Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗
120 место из 266
индекс 138, вероятный разброс 134–140 · весь рейтинг →
| Бенчмарк | РезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию теста | УсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен |
|---|---|---|
| DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ | 40,0% | |
| LMCAНасколько оценки моделью доводов в философии, теории решений и безопасности ИИ совпадают с оценками экспертовБалл — корреляция с оценками экспертов, умноженная на 100; практический потолок около 85, а не 100.Подробнее на английском ↗ | 21,4% | |
| Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ | 0,0% | |
| Fiction.LiveBenchВопросы по длинным художественным текстам: понять мотивы героев, порядок событий и сделать выводы из всего сюжетаРезультат зависит от длины текста: с ростом объёма точность обычно падает, поэтому сравнивать стоит при одинаковой длине.Подробнее на английском ↗ | 62,5% | |
| OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ | 66,4% | |
| GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ | 51,7% |
Характеристики
- Вышла
- 1 апреля 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 131 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 8,2 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,35 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $1,40 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- апрель 2025
- Идентификатор в API
- qwen3-14b
Что это за модель
Qwen3 14B — плотная языковая модель из линейки Qwen3, которую команда Qwen из Alibaba представила весной 2025 года. «Плотная» значит, что на каждый ответ работают все её параметры, а их около 14,8 млрд в 40 слоях. В линейку вошли шесть плотных моделей, от 0,6 до 32 млрд параметров, и две модели на смеси экспертов, где на каждый токен включается только часть сети. Модель 14B стоит в середине этого ряда.
Главная новинка Qwen3 — гибридный режим мышления. Модель может сначала рассуждать шаг за шагом и только потом отвечать. А может ответить сразу, если задача простая. Режим переключается одной настройкой, и разработчик сам решает, сколько вычислений отдать на рассуждения. Линейку обучали примерно на 36 трлн токенов, почти вдвое больше, чем Qwen2.5. Лаборатория заявляет, что небольшие модели Qwen3 догоняют более крупные модели прошлого поколения. По её замерам, базовая версия Qwen3 14B не уступает базовой Qwen2.5 на 32 млрд параметров.
Модель берут для многоязычного чата (лаборатория называет 119 языков и диалектов), для задач на рассуждение, математику и программирование, а ещё для агентных сценариев, где модель сама вызывает внешние инструменты. Веса выложены под лицензией Apache 2.0, она разрешает коммерческое использование. Благодаря скромному размеру модель можно поднять на своём сервере с одной мощной видеокартой.
Своё контекстное окно модель держит только до 32 тыс. токенов. Длинные тексты до 131 тыс. токенов она читает через растяжение методом YaRN, и в карточке сказано, что на коротких текстах эта настройка может снизить качество. В режиме рассуждений лаборатория просит не включать жадное декодирование, когда модель всегда берёт самый вероятный токен: ответы от этого портятся и зацикливаются. С тех пор Qwen выпустила десятки более новых моделей, включая линейки Qwen3.5–3.8, так что сейчас это модель прошлого поколения.
Источники: Анонс линейки Qwen3, Карточка Qwen3-14B на Hugging Face
Того же уровня по индексу Epoch
-
Qwen3 235B-A22B
Qwen115-е место в Epochконтекст 131 тыс.$0,70 / $2,80открытые весарассуждениядороже в 2 раза
-
GPT-5 Nano
OpenAI114-е место в Epochконтекст 400 тыс.$0,05 / $0,40рассуждениядешевле в 3,5 раза
Другие модели семейства
-
Qwen3.8 Flash
Qwenконтекст 1 млн$0,15 / $0,47рассуждения
-
Qwen3.8 Max
Qwen14-е место в Epochконтекст 1 млн$2 / $6рассуждения
-
Qwen3.7 Plus
Qwen58-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
-
Qwen3.7 Max
Qwen33-е место в Epochконтекст 1 млн$2,50 / $7,50рассуждения
-
Qwen3.6 27B
Qwen64-е место в Epochконтекст 262 тыс.$0,60 / $3,60открытые весарассуждения
-
Qwen3.6 Max Preview
Qwen50-е место в Epochконтекст 262 тыс.$1,30 / $7,80рассуждения
-
Qwen3.6 35B-A3B
Qwen86-е место в Epochконтекст 262 тыс.$0,248 / $1,485открытые весарассуждения
-
Qwen3.6 Plus
Qwen56-е место в Epochконтекст 1 млн$0,50 / $3рассуждения
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).