ИИтак

← Назад

Модель · Tencent

Hy3

Открытая модель Tencent с рассуждениями для программирования, офисной работы и агентов, запускается на своём сервере

вышла 6 июля

Характеристики

Вышла
6 июля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
256 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 128 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
hy3

Что это за модель

Hy3 — большая языковая модель Tencent из линейки Hunyuan. Она устроена как смесь экспертов (mixture of experts): внутри 192 специализированных блока, и на каждый токен включаются только восемь из них. Всего в модели 295 млрд параметров, но при работе задействован 21 млрд. Поэтому считать ответы ей дешевле, чем полной модели такого размера. Глубину рассуждений можно выбрать: отвечать сразу, думать немного или строить длинную цепочку рассуждений.

Hy3 — итоговая версия модели, предварительную версию которой Tencent показала в апреле. Компания пишет, что собрала отзывы из более чем 50 своих продуктов и расширила дообучение на более качественных данных. По её замерам, доля галлюцинаций, то есть выдуманных фактов, упала с 12,5% до 5,4%. Ошибок в бытовой логике стало вдвое меньше, а сбоев в длинных диалогах — с 17,4% до 7,9%. Сменилась и лицензия: предварительная версия шла под ограничительной лицензией, которая не действовала в ЕС, Великобритании и Южной Корее, а Hy3 вышла под Apache 2.0.

Модель берут для программирования, офисной работы, финансовых расчётов, вёрстки интерфейсов и агентных задач, где модель сама вызывает инструменты. Tencent отдельно отмечает, что модель стала стабильнее вызывать инструменты и держать формат ответа — это важно при работе в реальных сервисах. В анонсе лаборатория приводит такие результаты: 90,4 в GPQA Diamond, 78% в SWE-Bench Verified и 57,9% в SWE-Bench Pro. В слепой оценке экспертами она набрала 2,67 из 4 против 2,51 у GLM-5.1.

Веса открыты под Apache 2.0, их можно использовать и в коммерческих продуктах. Но запускать модель у себя непросто: нужно восемь видеокарт с большим объёмом памяти, а для рабочей среды Tencent советует серверы vLLM или SGLang. Модель работает только с текстом. Позже у лаборатории вышла предварительная версия следующей модели, Hy4.

Источники: Карточка модели Hy3 на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Лаборатории не объединяются, а множатся: Interconnects разобрал свежие открытые модели

    Interconnects

все 1 новость о Hy3 →

Данные: models.dev (MIT).