ИИтак

← Назад

Модель · Mistral

Mistral Medium 3

Устаревшая модель Mistral среднего уровня для чата, программирования и работы с картинками в компаниях. Её сменили Medium 3.1 и 3.5

вышла 7 мая 2025

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

138 место из 266
индекс 134, вероятный разброс 131–136 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
DTBenchВопросы с выбором ответа по теории принятия решений в задачах вроде парадокса Ньюкома, где твой выбор говорит о выборе похожих на тебяСлучайный выбор даёт около 40%, так что это нижняя планка, а не ноль.Подробнее на английском ↗ 37,1%
FrontierMath-2025-02-28-PrivateНеопубликованные задачи FrontierMath (уровни 1–3) в версии от 28.02.2025: трудная математика, над которой специалист сидит часамиПодробнее на английском ↗ 0,6%
Lech Mazur WritingКороткие рассказы, в которые надо органично вплести десять заданных элементов: персонажа, предмет, место, мотив, тон и другиеБалл относительный: модели-судьи сравнивают рассказы попарно, ноль — примерно середина сравниваемых моделей, а не процент.Подробнее на английском ↗ 77,3%
HLEHumanity's Last Exam: 2500 вопросов экспертного уровня по математике, естественным и гуманитарным наукам, ответ не найти поискомПодробнее на английском ↗ 0,0%
OTIS Mock AIME 2024-202545 олимпиадных задач по математике из пробных экзаменов AIME школы OTIS; ответ — целое число от 0 до 999Подробнее на английском ↗ 32,2%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 46,0%
MATH level 5Самые трудные задачи (5-й уровень) из набора MATH — задачи американских школьных олимпиад AMC 10, AMC 12 и AIMEТест близок к насыщению: у сильных моделей результаты почти одинаковые и высокие, разница в несколько пунктов мало что значит.Подробнее на английском ↗ 81,6%

Характеристики

Вышла
7 мая 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
131 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 131 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0,40 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$2 за миллион токенов
Понимает
текст, изображения
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
май 2025
Идентификатор в API
mistral-medium-2505

Что это за модель

Mistral Medium 3 — модель среднего уровня от французской компании Mistral. Она работает с текстом и изображениями и умеет вызывать внешние инструменты. Компания сделала её для корпоративных клиентов и хотела найти баланс между качеством ответов, скоростью и ценой.

Mistral заявляет, что на бенчмарках модель набирает около 90% от результата Claude Sonnet 3.7, а стоит заметно дешевле. По замерам лаборатории, она обходит открытые модели Llama 4 Maverick и Cohere Command A. Сильнее всего модель, по словам компании, в программировании и точных науках. В рейтинге Epoch она стоит примерно в середине списка. Позже её сменили Mistral Medium 3.1 и Mistral Medium 3.5.

Модель берут прежде всего компании. Её можно вызывать через API Mistral и облачные платформы, а можно развернуть на своих серверах: по данным компании, для этого хватает четырёх видеокарт. Mistral предлагает дообучать модель на данных клиента и подключать её к корпоративным базам знаний. Первые клиенты из финансов, энергетики и здравоохранения применяли её в поддержке клиентов, для персональной настройки бизнес-процессов и для анализа сложных данных.

Веса модели закрыты. Скачать их нельзя, а развернуть модель у себя можно только по договорённости с Mistral.

Источники: Анонс Mistral Medium 3

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    Саймон Уиллисон попросил GPT-6 Astra показать, как Меркатор превращается в проекцию Equal Earth

    Саймон Уиллисон

  2. 02

    Mistral выпустила Agentic Search: модель сама открывает документ и ищет нужную таблицу

    Mistral AI

все 2 новости о Medium 3 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).