ИИтак

← Назад

Модель · Tencent

Hy4 preview

Предварительная версия новой открытой модели Tencent для программирования, агентов и офисной работы, крупнее и сильнее Hy3

вышла 28 августа

Характеристики

Вышла
28 августа
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 64 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,834 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,042 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2,501 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
hy4-preview

Что это за модель

Hy4 preview — предварительная версия четвёртого поколения языковых моделей Tencent из линейки Hunyuan. Она построена по схеме смеси экспертов: из 770 млрд параметров на каждый токен работают только 49 млрд, поэтому запускать её дешевле, чем плотную модель того же размера. В модели 78 слоёв и 256 «экспертов», из которых для каждого токена выбираются восемь плюс один общий. Чтобы справляться с очень длинными текстами, в ней используется разреженное внимание по схеме DeepSeek: модель смотрит не на весь текст сразу, а на выбранные участки. По умолчанию она долго рассуждает перед ответом, но этот режим можно отключить ради быстрых прямых ответов.

По словам Tencent, по сравнению с Hy3 модель заметно выросла в размере, длине контекста и объёме данных для обучения, а также получила улучшенное предобучение и дообучение. Данные для обучения компания готовила вместе со своими специалистами по разработке, играм, финансам и безопасности. Tencent отдельно подчёркивает, что Hy4 preview сама участвовала в своей разработке: помогала автоматически улучшать методы обучения и систему инференса, то есть запуска модели.

Модель берут для долгой работы с кодом: разработки в больших проектах, отладки, вёрстки интерфейсов. Ещё один сценарий — офисные задачи: финансовый анализ, разбор данных, работа с несколькими документами сразу. Компания также называет создание прототипов игр по текстовому описанию и научные задачи в физике, математике и молекулярной динамике. По замерам Tencent, модель набирает 65,7 в SWE-bench Pro, 85,4 в Terminal Bench 2.1 и 92,3 в GPQA Diamond. Во внутренней слепой оценке, где 163 эксперта проверяли решения 203 инженерных задач, она получила в среднем 2,99 балла из 4 — немного больше, чем GLM-5.3 (2,92) и Kimi K3 (2,94).

Сама Tencent называет модель ранней версией, которую ещё есть куда улучшать и на этапе предобучения, и на этапе дообучения. Среди её недостатков компания называет склонность слишком долго рассуждать и лишний раз перепроверять свою работу. Веса выложены под лицензией Apache 2.0, которая разрешает коммерческое использование, изменение и распространение.

Источники: Анонс Hy4 preview от Tencent, Карточка модели на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Z.ai закрутила лицензию GLM-5.3: гигантам с выручкой от 10 млрд долларов нужна её проверка

    Interconnects

все 1 новость о Hy4 preview →

Данные: models.dev (MIT).