Модель · MiniMax
MiniMax-M2.5-highspeed
Ускоренная версия MiniMax-M2.5 для программирования и агентов, отвечает вдвое быстрее обычной; её уже сменила M2.7-highspeed
вышла 13 февраля
Характеристики
- Вышла
- 13 февраля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 204 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 131 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,60 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,06 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $2,40 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Идентификатор в API
- MiniMax-M2.5-highspeed
Что это за модель
MiniMax-M2.5-highspeed — та же модель MiniMax-M2.5, только её запускают на более быстрой инфраструктуре. В анонсе эта версия называется M2.5-Lightning. По данным лаборатории, она выдаёт около 100 токенов в секунду, обычная M2.5 — около 50. MiniMax подчёркивает, что ответы у обеих версий одинаковые: меняется скорость, а не качество. По карточке на Hugging Face, в модели около 229 млрд параметров.
От предыдущей M2.1 линейку M2.5 отличает обучение в более чем 200 тысячах реальных рабочих сред на десятке с лишним языков программирования. По замерам лаборатории, M2.5 решает 80,2% задач SWE-Bench Verified, 51,3% задач Multi-SWE-Bench и 76,3% задач BrowseComp. Задачи SWE-Bench она проходит на 37% быстрее, чем M2.1. Компания также заявляет, что модель сначала расписывает план проекта и только потом пишет код, а агентные задачи решает примерно за 20% меньше обращений к инструментам.
Быструю версию выбирают там, где важна задержка: для агентов, которые много раз подряд вызывают инструменты, для помощников программиста в редакторе и для интерактивных сервисов. Кроме программирования, лаборатория называет поиск в интернете, работу с документами Word, Excel и PowerPoint, финансовые модели. По подсчётам MiniMax, час непрерывной работы модели на скорости 100 токенов в секунду стоит около доллара.
Скорость обходится дороже: за ввод быстрая версия берёт больше обычной M2.5. Веса открыты под изменённой лицензией MIT, но скорость в 100 токенов в секунду — это свойство API самой MiniMax. При запуске на своём оборудовании она не гарантирована. В марте 2026 года линейку сменила M2.7 со своей быстрой версией M2.7-highspeed.
Источники: Анонс MiniMax M2.5, Карточка модели на Hugging Face
Другие модели семейства
-
MiniMax-M3
MiniMax65-е место в Epochконтекст 1 млн$0,30 / $1,20открытые весарассуждения
-
MiniMax-M2.7
MiniMax72-е место в Epochконтекст 204 тыс.$0,30 / $1,20открытые весарассуждения
-
MiniMax-M2.7-highspeed
MiniMaxконтекст 204 тыс.$0,60 / $2,40открытые весарассуждения
-
MiniMax-M2.5
MiniMax63-е место в Epochконтекст 204 тыс.$0,30 / $1,20открытые весарассуждения
-
MiniMax-M2.1
MiniMaxконтекст 204 тыс.$0,30 / $1,20открытые весарассуждения
-
MiniMax-M2
MiniMaxконтекст 204 тыс.$0,30 / $1,20открытые весарассуждения
Новости о модели
- 01
Данные: models.dev (MIT).