ИИтак

← Назад

Модель · Z.ai

GLM-4.7-FlashX

Лёгкая быстрая модель Z.ai для программирования и агентов, платная версия GLM-4.7-Flash; её уже сменила линейка GLM-5

вышла 19 января

Характеристики

Вышла
19 января
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
200 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 131 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,07 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,01 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0,40 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Знания до
апрель 2025
Идентификатор в API
glm-4.7-flashx

Что это за модель

GLM-4.7-FlashX — самая лёгкая платная модель в линейке GLM-4.7 от Z.ai. В документации лаборатория описывает её как «лёгкую, быструю и недорогую». В API она занимает место между бесплатной GLM-4.7-Flash и старшей GLM-4.7. Контекст, длина ответа и работа только с текстом у FlashX и Flash одинаковые.

Под FlashX лежит та же малая модель, что и под GLM-4.7-Flash. Её веса Z.ai выложила открыто под лицензией MIT. Это смесь экспертов (mixture of experts) на 30 млрд параметров: на каждый токен из них работают около 3 млрд. Поэтому модель быстрая и дешёвая в запуске. Бесплатная Flash в API работает медленнее, FlashX лаборатория предлагает, когда нужна скорость.

Всю линейку GLM-4.7 Z.ai обучала прежде всего на программирование и многошаговую работу агентов: модель должна стабильнее доводить до конца цепочки действий с вызовом инструментов. По замерам лаборатории, малая модель показывает лучший результат среди открытых моделей своего размера в тестах SWE-bench Verified (59,2) и τ²-Bench (79,5). Кроме кода, Z.ai советует её для письма на китайском, перевода и работы с длинными текстами. Выбирают её там, где запросов много и важны цена и скорость.

Это малая модель, и по сложным задачам она уступает старшей GLM-4.7. К тому же она уже устарела: с февраля 2026 года у Z.ai выходит линейка GLM-5, а в сентябре появилась GLM-5.3-FlashX — более новая модель того же класса.

Источники: Документация Z.ai по линейке GLM-4.7, Карточка GLM-4.7-Flash на Hugging Face

Другие модели семейства

Данные: models.dev (MIT).