Модель · Tencent
Hy3
Открытая модель Tencent с рассуждениями для программирования, офисной работы и агентов, запускается на своём сервере
вышла 6 июля
Характеристики
- Вышла
- 6 июля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 256 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 128 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Идентификатор в API
- hy3
Что это за модель
Hy3 — большая языковая модель Tencent из линейки Hunyuan. Она устроена как смесь экспертов (mixture of experts): внутри 192 специализированных блока, и на каждый токен включаются только восемь из них. Всего в модели 295 млрд параметров, но при работе задействован 21 млрд. Поэтому считать ответы ей дешевле, чем полной модели такого размера. Глубину рассуждений можно выбрать: отвечать сразу, думать немного или строить длинную цепочку рассуждений.
Hy3 — итоговая версия модели, предварительную версию которой Tencent показала в апреле. Компания пишет, что собрала отзывы из более чем 50 своих продуктов и расширила дообучение на более качественных данных. По её замерам, доля галлюцинаций, то есть выдуманных фактов, упала с 12,5% до 5,4%. Ошибок в бытовой логике стало вдвое меньше, а сбоев в длинных диалогах — с 17,4% до 7,9%. Сменилась и лицензия: предварительная версия шла под ограничительной лицензией, которая не действовала в ЕС, Великобритании и Южной Корее, а Hy3 вышла под Apache 2.0.
Модель берут для программирования, офисной работы, финансовых расчётов, вёрстки интерфейсов и агентных задач, где модель сама вызывает инструменты. Tencent отдельно отмечает, что модель стала стабильнее вызывать инструменты и держать формат ответа — это важно при работе в реальных сервисах. В анонсе лаборатория приводит такие результаты: 90,4 в GPQA Diamond, 78% в SWE-Bench Verified и 57,9% в SWE-Bench Pro. В слепой оценке экспертами она набрала 2,67 из 4 против 2,51 у GLM-5.1.
Веса открыты под Apache 2.0, их можно использовать и в коммерческих продуктах. Но запускать модель у себя непросто: нужно восемь видеокарт с большим объёмом памяти, а для рабочей среды Tencent советует серверы vLLM или SGLang. Модель работает только с текстом. Позже у лаборатории вышла предварительная версия следующей модели, Hy4.
Источники: Карточка модели Hy3 на Hugging Face
Другие модели семейства
-
Hy4 preview
Tencentконтекст 1 млн$0,834 / $2,501открытые весарассуждения
-
Hy3 preview
Tencentконтекст 256 тыс.бесплатнооткрытые весарассуждения
Новости о модели
- 01
Данные: models.dev (MIT).