Модель · Z.ai
GLM-4.7-FlashX
Лёгкая быстрая модель Z.ai для программирования и агентов, платная версия GLM-4.7-Flash; её уже сменила линейка GLM-5
вышла 19 января
Характеристики
- Вышла
- 19 января
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 200 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 131 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,07 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,01 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0,40 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- апрель 2025
- Идентификатор в API
- glm-4.7-flashx
Что это за модель
GLM-4.7-FlashX — самая лёгкая платная модель в линейке GLM-4.7 от Z.ai. В документации лаборатория описывает её как «лёгкую, быструю и недорогую». В API она занимает место между бесплатной GLM-4.7-Flash и старшей GLM-4.7. Контекст, длина ответа и работа только с текстом у FlashX и Flash одинаковые.
Под FlashX лежит та же малая модель, что и под GLM-4.7-Flash. Её веса Z.ai выложила открыто под лицензией MIT. Это смесь экспертов (mixture of experts) на 30 млрд параметров: на каждый токен из них работают около 3 млрд. Поэтому модель быстрая и дешёвая в запуске. Бесплатная Flash в API работает медленнее, FlashX лаборатория предлагает, когда нужна скорость.
Всю линейку GLM-4.7 Z.ai обучала прежде всего на программирование и многошаговую работу агентов: модель должна стабильнее доводить до конца цепочки действий с вызовом инструментов. По замерам лаборатории, малая модель показывает лучший результат среди открытых моделей своего размера в тестах SWE-bench Verified (59,2) и τ²-Bench (79,5). Кроме кода, Z.ai советует её для письма на китайском, перевода и работы с длинными текстами. Выбирают её там, где запросов много и важны цена и скорость.
Это малая модель, и по сложным задачам она уступает старшей GLM-4.7. К тому же она уже устарела: с февраля 2026 года у Z.ai выходит линейка GLM-5, а в сентябре появилась GLM-5.3-FlashX — более новая модель того же класса.
Источники: Документация Z.ai по линейке GLM-4.7, Карточка GLM-4.7-Flash на Hugging Face
Другие модели семейства
-
GLM-5.3-FlashX
Z.aiконтекст 1 млн$0,37 / $1,25открытые весарассуждения
-
GLM-5.3-Flash
Z.ai41-е место в Epochконтекст 1 млн$0,15 / $0,50открытые весарассуждения
-
GLM-4.7-Flash
Z.aiконтекст 200 тыс.бесплатнооткрытые весарассуждения
-
GLM-4.6V-Flash
Z.aiконтекст 128 тыс.бесплатнооткрытые весарассуждения
-
GLM-4.5-Flash
Z.aiконтекст 131 тыс.бесплатнооткрытые весарассуждения
Данные: models.dev (MIT).