ИИтак

← Назад

Модель · Mistral

Magistral Small

Открытая рассуждающая модель Mistral для математики, логики и программирования, младшая версия Magistral Medium

вышла 17 марта 2025

Характеристики

Вышла
17 марта 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
128 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 128 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,50 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$1,50 за миллион токенов
Понимает
текст
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
открытые
Знания до
июнь 2025
Идентификатор в API
magistral-small

Что это за модель

Первая рассуждающая модель Mistral. Перед ответом она выстраивает цепочку рассуждений: решает задачу по шагам и только потом выдаёт итог. В ней 24 млрд параметров. Её получили из обычной чат-модели лаборатории: сначала дообучили на примерах рассуждений, потом применили обучение с подкреплением, то есть награждали за верные решения. Модель вышла в паре со старшей Magistral Medium. Medium закрытая и рассчитана на корпоративных клиентов, а младшую версию выложили в открытый доступ для сообщества.

Mistral обновляла модель несколько раз. В сентябрьской версии 1.2 лаборатория добавила понимание картинок и улучшила оформление ответов. Кроме того, модель реже застревает в бесконечном повторе текста, а рассуждения теперь отделены от ответа специальными метками. По замерам Mistral, на олимпиадном тесте AIME 2024 первая версия набирала 70,7%, а версия 1.2 — 86,1%. На тесте научных вопросов GPQA Diamond у версии 1.2 70,1%, на тесте программирования LiveCodeBench — 70,9%.

Модель берут для задач, где нужны проверяемые шаги: математика, логика, программирование, разбор сложных решений. Компания подчёркивает, что рассуждения можно прочитать и проверить ход мысли. Рассуждать модель умеет на многих языках, в том числе на русском, французском, арабском и китайском. После квантизации, то есть сжатия весов, она помещается на одну видеокарту RTX 4090 или на MacBook с 32 ГБ памяти.

Веса распространяются по лицензии Apache 2.0, она разрешает и коммерческое применение. Лаборатория предупреждает, что после примерно 40 тысяч токенов качество может падать, хотя формально окно больше. Старшая Magistral Medium, по данным Mistral, решает задачи точнее и быстрее.

Источники: Анонс Magistral в блоге Mistral, Карточка модели версии 1.2 на Hugging Face

Данные: models.dev (MIT).