Модель · Z.ai
GLM-4.5-Flash
Устаревшая бесплатная модель Z.ai для программирования, рассуждений и агентов, лёгкая версия из линейки GLM-4.5
вышла 28 июля 2025
Характеристики
- Вышла
- 28 июля 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 131 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 98 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- апрель 2025
- Идентификатор в API
- glm-4.5-flash
Что это за модель
GLM-4.5-Flash — бесплатная версия из линейки GLM-4.5 китайской лаборатории Z.ai. Лаборатория описывает её так: бесплатная модель с хорошим качеством, которая подходит для рассуждений, программирования и агентов. Старшие модели линейки устроены как смесь экспертов (mixture of experts): на каждый токен работает только часть сети. У GLM-4.5 всего 355 млрд параметров, из них активны 32 млрд, у GLM-4.5-Air — 106 млрд и 12 млрд. Отдельно размер Flash лаборатория не указывает.
Как и вся линейка, модель гибридная. В режиме размышления она рассуждает перед ответом, прежде чем решать сложную задачу или вызывать инструменты. Без этого режима она отвечает сразу. Разработчик включает и выключает режим параметром в запросе. По умолчанию модель сама решает, сколько думать: на простых вопросах рассуждения пропускает, а на математике, коде и планировании рассуждает дольше.
Z.ai предлагает линейку для создания сайтов, работы ассистентов, офисной автоматизации вроде сборки презентаций, ответов на вопросы, перевода и написания текстов. Flash среди них — вариант, на котором удобно бесплатно опробовать агентные сценарии. Лаборатория заявляет, что по набору из 12 бенчмарков флагманская GLM-4.5 заняла третье место среди всех моделей. Эти цифры относятся к старшей модели, а не к Flash.
Сама Z.ai признаёт, что в реальных задачах агентного программирования GLM-4.5 пока уступает Claude 4 Sonnet, хотя в большинстве случаев сравнима с ней. Сейчас модель устарела: у лаборатории вышли более новые лёгкие модели GLM-4.7-Flash и GLM-5.3-Flash. Веса линейки GLM-4.5 выложены по лицензии MIT, которая разрешает коммерческое использование и дообучение.
Источники: Документация Z.ai по линейке GLM-4.5, Репозиторий GLM-4.5 на GitHub
Другие модели семейства
-
GLM-5.3-FlashX
Z.aiконтекст 1 млн$0,37 / $1,25открытые весарассуждения
-
GLM-5.3-Flash
Z.ai41-е место в Epochконтекст 1 млн$0,15 / $0,50открытые весарассуждения
-
GLM-4.7-Flash
Z.aiконтекст 200 тыс.бесплатнооткрытые весарассуждения
-
GLM-4.7-FlashX
Z.aiконтекст 200 тыс.$0,07 / $0,40открытые весарассуждения
-
GLM-4.6V-Flash
Z.aiконтекст 128 тыс.бесплатнооткрытые весарассуждения
Новости о модели
- 01
Данные: models.dev (MIT).