ИИтак

← Назад

Модель · OpenAI

GPT-5.4 Pro

Старшая версия GPT-5.4 для сложных рассуждений и агентных задач, где точность важнее скорости; её уже сменила GPT-5.5 Pro

вышла 5 марта

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

9 место из 266
индекс 159, вероятный разброс 157–162 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
FrontierMath-Tier-4-v2-PrivateЗакрытый набор самых трудных задач FrontierMath: исследовательская математика, на которую у специалистов уходят часы и дниПодробнее на английском ↗ 58,5% очень высокое
FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ 82,5% очень высокое
Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ 56,4% очень высокое
SimpleQA Verified1000 коротких вопросов на факты, на которые модель отвечает по памяти, без поиска в интернетеБалл — F1: учитываются и доля верных ответов, и точность там, где модель решилась ответить, так что честное «не знаю» лучше ошибки.Подробнее на английском ↗ 46,3% очень высокое
ARC-AGI-2Вторая, более трудная версия головоломок на клетках: по примерам найти скрытое правило и применить его к новой картинкеНа каждое задание даётся две попытки; люди в среднем решают около 60% заданий.Подробнее на английском ↗ 83,3% очень высокое
HLEHumanity's Last Exam: 2500 вопросов экспертного уровня по математике, естественным и гуманитарным наукам, ответ не найти поискомПодробнее на английском ↗ 41,5%
WeirdMLНеобычные задачи по машинному обучению: модель пишет код, который на выданных данных обучает классификатор, например для распознавания фигурБалл — средняя точность обученных моделью классификаторов, а не доля решённых задач.Подробнее на английском ↗ 57,4%
SimpleBenchВопросы с подвохом на здравый смысл: пространство, время, поведение людей. 213 вопросов, у каждого шесть вариантов ответаЛюди в проверке авторов набрали около 84%, а балл модели — средняя точность по пяти прогонам.Подробнее на английском ↗ 68,9%
GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ 92,8% очень высокое
ARC-AGIГоловоломки на цветных клетках: по паре примеров нужно понять правило преобразования картинки и применить его к новойПодробнее на английском ↗ 94,5% очень высокое

Характеристики

Вышла
5 марта
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1,1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 128 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$30 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$180 за миллион токенов
Понимает
текст, изображения
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
август 2025
Идентификатор в API
gpt-5.4-pro

Что это за модель

GPT-5.4 Pro — старшая версия модели GPT-5.4, которую OpenAI выпустила вместе с GPT-5.4 Thinking. Устроена она так же, как GPT-5.4, но тратит больше вычислительных мощностей на обдумывание каждого ответа. Компания заявляет, что так ответы получаются точнее и стабильнее. Глубину рассуждений задаёт сам разработчик: средняя (по умолчанию), высокая или очень высокая.

От предыдущих моделей OpenAI линейка GPT-5.4 отличается встроенным управлением компьютером: модель может сама работать с программами на рабочем столе. Ещё одна новинка — поиск инструментов (tool search): модель подгружает описание нужного инструмента только тогда, когда он понадобился. По замерам OpenAI, это сокращает расход токенов на 47%. Своих цифр бенчмарков для Pro компания не приводила. Для базовой GPT-5.4 она называет 83% на GDPval (задачи из 44 профессий, где работу модели сравнивают с работой специалистов) и 75% на OSWorld-Verified (управление компьютером).

Pro OpenAI называет самым дорогим и самым сильным вариантом линейки. Её советуют для работы, которую потом трудно переделать: глубокий анализ, служебные записки для руководства с готовым решением, длинные агентные задачи с множеством инструментов. Для повседневных задач компания рекомендует GPT-5.4 Thinking. В ChatGPT модель есть только в тарифах Pro и Enterprise. Разработчики получают её через API и в Codex.

Модель медленная: по словам OpenAI, некоторые запросы выполняются по нескольку минут. Поэтому их советуют запускать в фоновом режиме, чтобы соединение не обрывалось по тайм-ауту. Работает она только через Responses API: старые интерфейсы, пакетная обработка и дообучение недоступны. Контекст на миллион токенов нужно включать отдельно, без этого окно ограничено 272 тысячами токенов. В апреле 2026 года её сменила GPT-5.5 Pro.

Источники: Документация GPT-5.4 Pro в API, OpenAI Academy: GPT-5.4 Thinking и GPT-5.4 Pro, Анонс GPT-5.4 на форуме разработчиков OpenAI

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    V7 собирает из файлов компании «память» для агентов на моделях OpenAI

    OpenAI

  2. 02

    Microsoft подняла результат малой модели-агента почти вдвое на копиях почты, банка и Airbnb

    Microsoft Research

все 2 новости о GPT-5.4 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).