ИИтак

← Назад

Модель · Qwen

Qwen3.7 Flash

Устаревшая бюджетная модель Qwen для анализа картинок и видео и агентных задач; её сменила Qwen3.8 Flash

вышла 15 июля

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

82 место из 268
индекс 145, вероятный разброс 142–147 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
Mystery Game Puzzles100 позиций из головоломочного варианта известной игры, название которой скрыто: нужно найти единственный лучший ходПодробнее на английском ↗ 6,4%
FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ 19,3%
Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ 19,0%
OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ 86,7%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 76,4%

Характеристики

Вышла
15 июля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 131 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,03 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,003 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0,13 за миллион токенов
Понимает
текст, изображения, видео
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели выложены в свободный доступ, и запускать и дообучать её могут не только авторы. Небольшие модели работают на обычном компьютере. Большим нужны серверы с дорогими видеокартами: такие модели разворачивают компании и облачные сервисы, а остальные пользуются ими через них. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
qwen3.7-flash

Что это за модель

Qwen3.7 Flash — младшая и самая дешёвая модель линейки Qwen3.7 от Alibaba. Над ней стоят Qwen3.7 Plus и флагманская Qwen3.7 Max. Alibaba называет её встроенной моделью «зрение — язык»: она с самого начала рассчитана на то, чтобы работать с текстом, картинками и видео вместе. Перед ответом модель может рассуждать, то есть сначала выстраивает цепочку промежуточных шагов, а потом отвечает.

По словам Alibaba, в сравнении с Qwen3.6 Flash модель лучше распознаёт самые разные предметы, точнее воспринимает снимки реального мира и лучше понимает, где что расположено в пространстве. Отдельно компания отмечает рост в агентных сценариях, когда модель сама выполняет задачу в несколько шагов. Среди таких сценариев — поиск информации и работа с интерфейсом компьютера, и такие задачи модель, как заявляет лаборатория, стабильнее доводит до конца. Кроме того, улучшено программирование по изображениям.

Её выбирают там, где запросов много, а бюджет мал: для разбора снимков и видеозаписей, распознавания объектов и недорогих агентов, которые ищут в сети или работают с экраном. По цене входа она дешевле почти всех моделей каталога. Модель умеет вызывать внешние функции, отдавать структурированный ответ в заданном формате и кэшировать контекст: если его прислать повторно, он обходится впятеро дешевле. В рейтинге Epoch она находится в верхней трети списка.

Модель выдаёт только текст: картинок и видео она не создаёт. Встроенный в API веб-поиск, по документации Alibaba Cloud, работает только в регионах Пекин и Сингапур, а пакетная обработка запросов есть не во всех регионах. В конце августа 2026 года её сменила Qwen3.8 Flash. Alibaba описывает новую модель как более сильную в программировании, агентных задачах и понимании изображений.

Источники: Документация Qwen3.7 Flash в Alibaba Cloud Model Studio, Страница модели на QwenCloud, Анонс линейки Qwen3.7

Того же уровня по индексу Epoch

Другие модели семейства

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).