Модель · OpenAI
GPT-5.4 Pro
Старшая версия GPT-5.4 для сложных рассуждений и агентных задач, где точность важнее скорости; её уже сменила GPT-5.5 Pro
вышла 5 марта
Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗
9 место из 266
индекс 159, вероятный разброс 157–162 · весь рейтинг →
| Бенчмарк | РезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию теста | УсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен |
|---|---|---|
| FrontierMath-Tier-4-v2-PrivateЗакрытый набор самых трудных задач FrontierMath: исследовательская математика, на которую у специалистов уходят часы и дниПодробнее на английском ↗ | 58,5% | очень высокое |
| FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ | 82,5% | очень высокое |
| Chess Puzzles100 новых шахматных задач, позиция дана текстом: нужно найти единственный лучший ход по оценке движка StockfishПодробнее на английском ↗ | 56,4% | очень высокое |
| SimpleQA Verified1000 коротких вопросов на факты, на которые модель отвечает по памяти, без поиска в интернетеБалл — F1: учитываются и доля верных ответов, и точность там, где модель решилась ответить, так что честное «не знаю» лучше ошибки.Подробнее на английском ↗ | 46,3% | очень высокое |
| ARC-AGI-2Вторая, более трудная версия головоломок на клетках: по примерам найти скрытое правило и применить его к новой картинкеНа каждое задание даётся две попытки; люди в среднем решают около 60% заданий.Подробнее на английском ↗ | 83,3% | очень высокое |
| HLEHumanity's Last Exam: 2500 вопросов экспертного уровня по математике, естественным и гуманитарным наукам, ответ не найти поискомПодробнее на английском ↗ | 41,5% | |
| WeirdMLНеобычные задачи по машинному обучению: модель пишет код, который на выданных данных обучает классификатор, например для распознавания фигурБалл — средняя точность обученных моделью классификаторов, а не доля решённых задач.Подробнее на английском ↗ | 57,4% | |
| SimpleBenchВопросы с подвохом на здравый смысл: пространство, время, поведение людей. 213 вопросов, у каждого шесть вариантов ответаЛюди в проверке авторов набрали около 84%, а балл модели — средняя точность по пяти прогонам.Подробнее на английском ↗ | 68,9% | |
| GPQA diamond198 вопросов с выбором ответа по физике, химии и биологии уровня аспирантуры — такие, что ответ не найти поискомСлучайный выбор даёт 25%, а специалисты с учёной степенью в своей области набирают около 70%.Подробнее на английском ↗ | 92,8% | очень высокое |
| ARC-AGIГоловоломки на цветных клетках: по паре примеров нужно понять правило преобразования картинки и применить его к новойПодробнее на английском ↗ | 94,5% | очень высокое |
Характеристики
- Вышла
- 5 марта
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1,1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 128 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $30 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $180 за миллион токенов
- Понимает
- текст, изображения
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- август 2025
- Идентификатор в API
- gpt-5.4-pro
Что это за модель
GPT-5.4 Pro — старшая версия модели GPT-5.4, которую OpenAI выпустила вместе с GPT-5.4 Thinking. Устроена она так же, как GPT-5.4, но тратит больше вычислительных мощностей на обдумывание каждого ответа. Компания заявляет, что так ответы получаются точнее и стабильнее. Глубину рассуждений задаёт сам разработчик: средняя (по умолчанию), высокая или очень высокая.
От предыдущих моделей OpenAI линейка GPT-5.4 отличается встроенным управлением компьютером: модель может сама работать с программами на рабочем столе. Ещё одна новинка — поиск инструментов (tool search): модель подгружает описание нужного инструмента только тогда, когда он понадобился. По замерам OpenAI, это сокращает расход токенов на 47%. Своих цифр бенчмарков для Pro компания не приводила. Для базовой GPT-5.4 она называет 83% на GDPval (задачи из 44 профессий, где работу модели сравнивают с работой специалистов) и 75% на OSWorld-Verified (управление компьютером).
Pro OpenAI называет самым дорогим и самым сильным вариантом линейки. Её советуют для работы, которую потом трудно переделать: глубокий анализ, служебные записки для руководства с готовым решением, длинные агентные задачи с множеством инструментов. Для повседневных задач компания рекомендует GPT-5.4 Thinking. В ChatGPT модель есть только в тарифах Pro и Enterprise. Разработчики получают её через API и в Codex.
Модель медленная: по словам OpenAI, некоторые запросы выполняются по нескольку минут. Поэтому их советуют запускать в фоновом режиме, чтобы соединение не обрывалось по тайм-ауту. Работает она только через Responses API: старые интерфейсы, пакетная обработка и дообучение недоступны. Контекст на миллион токенов нужно включать отдельно, без этого окно ограничено 272 тысячами токенов. В апреле 2026 года её сменила GPT-5.5 Pro.
Источники: Документация GPT-5.4 Pro в API, OpenAI Academy: GPT-5.4 Thinking и GPT-5.4 Pro, Анонс GPT-5.4 на форуме разработчиков OpenAI
Того же уровня по индексу Epoch
-
GPT-5.6 Terra
OpenAI7-е место в Epochконтекст 1,1 млн$2 / $12рассуждениядешевле в 15 раз
-
Claude Opus 4.8
Anthropic10-е место в Epochконтекст 1 млн$5 / $25рассуждениядешевле в 7,2 раза
-
Kimi K3
Moonshot AI11-е место в Epochконтекст 1 млн$3 / $15открытые весарассуждениядешевле в 12 раз
Другие модели семейства
-
GPT-5.5 Pro
OpenAI5-е место в Epochконтекст 1,1 млн$30 / $180рассуждения
-
GPT-5.2 Pro
OpenAI23-е место в Epochконтекст 400 тыс.$21 / $168рассуждения
Новости о модели
- 01
- 02
Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).