Модель · OpenAI
GPT-5 Pro
Устаревшая старшая версия GPT-5 для трудного анализа, проверки кода и планирования: думает дольше обычной, её сменила GPT-5.5 Pro
вышла 6 октября 2025
Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗
43 место из 266
индекс 150, вероятный разброс 149–153 · весь рейтинг →
| Бенчмарк | РезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию теста | УсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен |
|---|---|---|
| FrontierMath-Tier-4-v2-PrivateЗакрытый набор самых трудных задач FrontierMath: исследовательская математика, на которую у специалистов уходят часы и дниПодробнее на английском ↗ | 19,5% | высокое |
| FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ | 55,8% | высокое |
| ARC-AGI-2Вторая, более трудная версия головоломок на клетках: по примерам найти скрытое правило и применить его к новой картинкеНа каждое задание даётся две попытки; люди в среднем решают около 60% заданий.Подробнее на английском ↗ | 18,3% | |
| HLEHumanity's Last Exam: 2500 вопросов экспертного уровня по математике, естественным и гуманитарным наукам, ответ не найти поискомПодробнее на английском ↗ | 28,2% | |
| WeirdMLНеобычные задачи по машинному обучению: модель пишет код, который на выданных данных обучает классификатор, например для распознавания фигурБалл — средняя точность обученных моделью классификаторов, а не доля решённых задач.Подробнее на английском ↗ | 60,4% | высокое |
| SimpleBenchВопросы с подвохом на здравый смысл: пространство, время, поведение людей. 213 вопросов, у каждого шесть вариантов ответаЛюди в проверке авторов набрали около 84%, а балл модели — средняя точность по пяти прогонам.Подробнее на английском ↗ | 53,9% | высокое |
| ARC-AGIГоловоломки на цветных клетках: по паре примеров нужно понять правило преобразования картинки и применить его к новойПодробнее на английском ↗ | 70,2% | высокое |
Характеристики
- Вышла
- 6 октября 2025
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 400 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 272 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $15 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $120 за миллион токенов
- Понимает
- текст, изображения
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- сентябрь 2024
- Идентификатор в API
- gpt-5-pro
Что это за модель
GPT-5 Pro — старшая версия GPT-5 для самых сложных задач. Отдельной архитектуры у неё нет, отличается она способом работы. OpenAI пишет, что GPT-5 Pro думает дольше и тратит больше вычислительных мощностей на ответ. Она параллельно прорабатывает несколько линий рассуждения, пока отвечает на запрос. Сначала модель появилась в ChatGPT на дорогих тарифах, в API её открыли позже.
По замерам OpenAI, внешние эксперты проверили её на тысяче с лишним сложных запросов из реальной практики. В 67,8% случаев они предпочли её ответы ответам GPT-5 в режиме рассуждений. Грубых ошибок у Pro было на 22% меньше. Лучше всего она проявила себя в вопросах здоровья, науки, математики и программирования. На научном тесте GPQA компания назвала её результат лучшим среди моделей линейки GPT-5.
Её берут для задач, где важнее точность, чем скорость и цена: глубокий анализ, проверка кода, сложное планирование. Модель умеет вызывать внешние функции, искать в интернете и по загруженным файлам, выдавать структурированный ответ — строго по заданной схеме. Уровень рассуждений у неё всегда максимальный, выбрать меньший нельзя.
Ограничений немало. В API она работает только через Responses API и пакетную обработку, классический Chat Completions не поддерживается. Запускать код в песочнице (code interpreter) она не умеет, дообучить её нельзя. Ответ может идти несколько минут, поэтому OpenAI советует включать фоновый режим, чтобы запрос не оборвался по таймауту. Сейчас у OpenAI есть более новые модели, старшая из них в этой роли — GPT-5.5 Pro.
Источники: Документация GPT-5 Pro в API OpenAI, Анонс GPT-5 от OpenAI
Того же уровня по индексу Epoch
-
Claude Opus 4.5
Anthropic45-е место в Epochконтекст 200 тыс.$5 / $25рассуждениядешевле в 4,8 раза
-
Kimi K2.7 Code
Moonshot AI46-е место в Epochконтекст 262 тыс.$0,95 / $4открытые весарассуждениядешевле в 30 раз
Другие модели семейства
-
GPT-5.5 Pro
OpenAI5-е место в Epochконтекст 1,1 млн$30 / $180рассуждения
-
GPT-5.4 Pro
OpenAI9-е место в Epochконтекст 1,1 млн$30 / $180рассуждения
-
GPT-5.2 Pro
OpenAI23-е место в Epochконтекст 400 тыс.$21 / $168рассуждения
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).