Модель · Tencent
Hy4 preview
Предварительная версия новой открытой модели Tencent для программирования, агентов и офисной работы, крупнее и сильнее Hy3
вышла 28 августа
Характеристики
- Вышла
- 28 августа
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 64 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,834 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,042 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $2,501 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Идентификатор в API
- hy4-preview
Что это за модель
Hy4 preview — предварительная версия четвёртого поколения языковых моделей Tencent из линейки Hunyuan. Она построена по схеме смеси экспертов: из 770 млрд параметров на каждый токен работают только 49 млрд, поэтому запускать её дешевле, чем плотную модель того же размера. В модели 78 слоёв и 256 «экспертов», из которых для каждого токена выбираются восемь плюс один общий. Чтобы справляться с очень длинными текстами, в ней используется разреженное внимание по схеме DeepSeek: модель смотрит не на весь текст сразу, а на выбранные участки. По умолчанию она долго рассуждает перед ответом, но этот режим можно отключить ради быстрых прямых ответов.
По словам Tencent, по сравнению с Hy3 модель заметно выросла в размере, длине контекста и объёме данных для обучения, а также получила улучшенное предобучение и дообучение. Данные для обучения компания готовила вместе со своими специалистами по разработке, играм, финансам и безопасности. Tencent отдельно подчёркивает, что Hy4 preview сама участвовала в своей разработке: помогала автоматически улучшать методы обучения и систему инференса, то есть запуска модели.
Модель берут для долгой работы с кодом: разработки в больших проектах, отладки, вёрстки интерфейсов. Ещё один сценарий — офисные задачи: финансовый анализ, разбор данных, работа с несколькими документами сразу. Компания также называет создание прототипов игр по текстовому описанию и научные задачи в физике, математике и молекулярной динамике. По замерам Tencent, модель набирает 65,7 в SWE-bench Pro, 85,4 в Terminal Bench 2.1 и 92,3 в GPQA Diamond. Во внутренней слепой оценке, где 163 эксперта проверяли решения 203 инженерных задач, она получила в среднем 2,99 балла из 4 — немного больше, чем GLM-5.3 (2,92) и Kimi K3 (2,94).
Сама Tencent называет модель ранней версией, которую ещё есть куда улучшать и на этапе предобучения, и на этапе дообучения. Среди её недостатков компания называет склонность слишком долго рассуждать и лишний раз перепроверять свою работу. Веса выложены под лицензией Apache 2.0, которая разрешает коммерческое использование, изменение и распространение.
Источники: Анонс Hy4 preview от Tencent, Карточка модели на Hugging Face
Другие модели семейства
-
Hy3 preview
Tencentконтекст 256 тыс.бесплатнооткрытые весарассуждения
Новости о модели
- 01
Данные: models.dev (MIT).