Модель · Xiaomi
MiMo-V2.5-Pro
Флагманская открытая модель Xiaomi для долгих агентных задач и программирования, работает только с текстом
вышла 22 апреля
Характеристики
- Вышла
- 22 апреля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 131 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0,435 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,004 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0,87 за миллион токенов
- Понимает
- текст
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- открытые
- Знания до
- декабрь 2024
- Идентификатор в API
- mimo-v2.5-pro
Что это за модель
MiMo-V2.5-Pro — самая сильная модель Xiaomi на момент выхода, её веса открыты под лицензией MIT. Она построена как смесь экспертов (mixture of experts): всего у неё 1,02 трлн параметров, но на каждый токен работают только 42 млрд. В ней 70 слоёв и 384 эксперта. Механизм внимания гибридный: на шесть слоёв, которые смотрят только на ближайшие 128 токенов, приходится один слой, который видит весь текст. По данным лаборатории, так памяти на кэш нужно примерно в семь раз меньше. Кроме того, у модели есть три лёгких модуля, которые угадывают сразу несколько следующих токенов, и за счёт этого ответ генерируется быстрее.
По словам Xiaomi, по сравнению с предшественницей MiMo-V2-Pro модель заметно лучше справляется с агентными задачами, сложной разработкой и долгими проектами, где нужны тысячи вызовов инструментов. От соседней MiMo-V2.5 она отличается специализацией. MiMo-V2.5 — мультимодальная модель для большинства агентных сценариев, она понимает изображения и звук. Pro работает только с текстом, рассчитана на длинные и сложные задачи и в API Xiaomi стоит вдвое дороже. Позже вышла MiMo-V2.5-Pro-UltraSpeed — ускоренный вариант той же модели.
Модель берут для автономной работы агента на часы вперёд. В демонстрациях лаборатории она за 4,3 часа и 672 вызова инструментов написала на Rust компилятор учебного языка SysY и прошла все 233 скрытых теста курса. В другом примере она за 11,5 часа собрала видеоредактор на 8192 строки. На бенчмарке ClawEval, по замерам Xiaomi, модель набирает 64% по показателю Pass³ (задача засчитывается, только если решена во всех трёх попытках). При этом она тратит около 70 тыс. токенов на одно решение — на 40–60% меньше, чем Claude Opus 4.6, Gemini 3.1 Pro и GPT-5.4. Меньший расход токенов делает долгие задачи дешевле.
Картинки и звук модель не принимает, для этого у Xiaomi есть MiMo-V2.5. Свои веса она хранит в формате FP8, и даже так для 1 трлн параметров нужен серверный кластер, на домашнем компьютере её не запустить. На внутреннем бенчмарке лаборатории MiMo Coding Bench Xiaomi пишет лишь о том, что модель сократила отставание от Claude Opus 4.6, а не обогнала её.
Источники: Анонс MiMo-V2.5-Pro, Карточка модели на Hugging Face, Запуск линейки MiMo-V2.5
Другие модели семейства
-
MiMo-V2.5-Pro-UltraSpeed
Xiaomiконтекст 1 млн$1,305 / $2,61открытые весарассуждениябета
Новости о модели
- 01
- 02
Данные: models.dev (MIT).