Z.ai собрала инфраструктуру для GLM-5.3-Flash с помощью GLM-5.3
От первого удачного запуска до рабочей нагрузки прошло меньше двух недель, а сквозная пропускная способность выросла втрое относительно начальной.
От первого удачного запуска до рабочей нагрузки прошло меньше двух недель, а сквозная пропускная способность выросла втрое относительно начальной.
Z.ai перевела GLM-5.3 с лицензии MIT на собственную. Облачным провайдерам с выручкой больше 10 млрд долларов в год нужна проверка безопасности от Z.ai. Interconnects видит в этом тренд: китайские лидеры закрывают лицензии, а западные компании их открывают.
IBM Research и Red Hat развернули открытую модель GLM-5.2 на видеокартах NVIDIA H100 с помощью своего открытого фреймворка. По их расчётам, токен обходится в 5–10 раз дешевле, чем через коммерческие API.
Z.ai выпустила GLM-5.3 — модель на 750 млрд параметров, которая в части тестов по программированию обходит Claude Fable 5 и GPT-5.6-Sol. Натан Ламберт считает, что дело не в дистилляции, а в скорости выпуска и дообучении.
Baseten стала провайдером инференса на Hugging Face. Пока доступны только текстовые модели и чат, в том числе Kimi K3, DeepSeek V4 Flash и GLM-5.2. Hugging Face говорит, что не делает наценку на запросы через свой аккаунт.