ИИтак

← Назад

Модель · Z.ai

GLM-4.5-Flash

Устаревшая бесплатная модель Z.ai для программирования, рассуждений и агентов, лёгкая версия из линейки GLM-4.5

вышла 28 июля 2025

Характеристики

Вышла
28 июля 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
131 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 98 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Знания до
апрель 2025
Идентификатор в API
glm-4.5-flash

Что это за модель

GLM-4.5-Flash — бесплатная версия из линейки GLM-4.5 китайской лаборатории Z.ai. Лаборатория описывает её так: бесплатная модель с хорошим качеством, которая подходит для рассуждений, программирования и агентов. Старшие модели линейки устроены как смесь экспертов (mixture of experts): на каждый токен работает только часть сети. У GLM-4.5 всего 355 млрд параметров, из них активны 32 млрд, у GLM-4.5-Air — 106 млрд и 12 млрд. Отдельно размер Flash лаборатория не указывает.

Как и вся линейка, модель гибридная. В режиме размышления она рассуждает перед ответом, прежде чем решать сложную задачу или вызывать инструменты. Без этого режима она отвечает сразу. Разработчик включает и выключает режим параметром в запросе. По умолчанию модель сама решает, сколько думать: на простых вопросах рассуждения пропускает, а на математике, коде и планировании рассуждает дольше.

Z.ai предлагает линейку для создания сайтов, работы ассистентов, офисной автоматизации вроде сборки презентаций, ответов на вопросы, перевода и написания текстов. Flash среди них — вариант, на котором удобно бесплатно опробовать агентные сценарии. Лаборатория заявляет, что по набору из 12 бенчмарков флагманская GLM-4.5 заняла третье место среди всех моделей. Эти цифры относятся к старшей модели, а не к Flash.

Сама Z.ai признаёт, что в реальных задачах агентного программирования GLM-4.5 пока уступает Claude 4 Sonnet, хотя в большинстве случаев сравнима с ней. Сейчас модель устарела: у лаборатории вышли более новые лёгкие модели GLM-4.7-Flash и GLM-5.3-Flash. Веса линейки GLM-4.5 выложены по лицензии MIT, которая разрешает коммерческое использование и дообучение.

Источники: Документация Z.ai по линейке GLM-4.5, Репозиторий GLM-4.5 на GitHub

Другие модели семейства

Новости о модели

  1. 01

    Яндекс выложил открытую базовую модель AliceAI-Foundation на 80 млрд параметров

    Яндекс · HF

все 1 новость о GLM-4.5 →

Данные: models.dev (MIT).