ИИтак

← Назад

Модель · MiniMax

MiniMax-M2.5-highspeed

Ускоренная версия MiniMax-M2.5 для программирования и агентов, отвечает вдвое быстрее обычной; её уже сменила M2.7-highspeed

вышла 13 февраля

Характеристики

Вышла
13 февраля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
204 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 131 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,60 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,06 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2,40 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Идентификатор в API
MiniMax-M2.5-highspeed

Что это за модель

MiniMax-M2.5-highspeed — та же модель MiniMax-M2.5, только её запускают на более быстрой инфраструктуре. В анонсе эта версия называется M2.5-Lightning. По данным лаборатории, она выдаёт около 100 токенов в секунду, обычная M2.5 — около 50. MiniMax подчёркивает, что ответы у обеих версий одинаковые: меняется скорость, а не качество. По карточке на Hugging Face, в модели около 229 млрд параметров.

От предыдущей M2.1 линейку M2.5 отличает обучение в более чем 200 тысячах реальных рабочих сред на десятке с лишним языков программирования. По замерам лаборатории, M2.5 решает 80,2% задач SWE-Bench Verified, 51,3% задач Multi-SWE-Bench и 76,3% задач BrowseComp. Задачи SWE-Bench она проходит на 37% быстрее, чем M2.1. Компания также заявляет, что модель сначала расписывает план проекта и только потом пишет код, а агентные задачи решает примерно за 20% меньше обращений к инструментам.

Быструю версию выбирают там, где важна задержка: для агентов, которые много раз подряд вызывают инструменты, для помощников программиста в редакторе и для интерактивных сервисов. Кроме программирования, лаборатория называет поиск в интернете, работу с документами Word, Excel и PowerPoint, финансовые модели. По подсчётам MiniMax, час непрерывной работы модели на скорости 100 токенов в секунду стоит около доллара.

Скорость обходится дороже: за ввод быстрая версия берёт больше обычной M2.5. Веса открыты под изменённой лицензией MIT, но скорость в 100 токенов в секунду — это свойство API самой MiniMax. При запуске на своём оборудовании она не гарантирована. В марте 2026 года линейку сменила M2.7 со своей быстрой версией M2.7-highspeed.

Источники: Анонс MiniMax M2.5, Карточка модели на Hugging Face

Другие модели семейства

Новости о модели

  1. 01

    Microsoft открыла Orchard — общую инфраструктуру для обучения небольших ИИ-агентов

    Microsoft Research

все 1 новость о MiniMax-M2.5 →

Данные: models.dev (MIT).