ИИтак

← Назад

Модель · OpenAI

GPT-5 Pro

Устаревшая старшая версия GPT-5 для трудного анализа, проверки кода и планирования: думает дольше обычной, её сменила GPT-5.5 Pro

вышла 6 октября 2025

Рейтинг Epoch AIСводная оценка общих возможностей модели: статистическая модель выводит её из результатов на многих бенчмарках с учётом их сложностиШкала условная (Claude 3.5 Sonnet = 130, GPT-5 = 150); интервал — 90-процентный диапазон оценки, и модели с перекрывающимися интервалами надёжно не различаются.Подробнее на английском ↗

43 место из 266
индекс 150, вероятный разброс 149–153 · весь рейтинг →

БенчмаркРезультатОбычно — доля заданий теста, которые модель решила. У некоторых тестов свой счёт; как он устроен, сказано в пояснении к названию тестаУсилиеНасколько долго модель рассуждала перед ответом, когда её проверяли: низкое, среднее, высокое, очень высокое, максимальное. Чем выше усилие, тем обычно выше результат — и тем дольше и дороже ответ. Показан лучший результат и усилие, на котором он получен
FrontierMath-Tier-4-v2-PrivateЗакрытый набор самых трудных задач FrontierMath: исследовательская математика, на которую у специалистов уходят часы и дниПодробнее на английском ↗ 19,5% высокое
FrontierMath-Tiers-1-3-v2-PrivateСотни новых задач исследовательской математики от профессиональных математиков; эксперту на задачу нужны часы или дниПодробнее на английском ↗ 55,8% высокое
ARC-AGI-2Вторая, более трудная версия головоломок на клетках: по примерам найти скрытое правило и применить его к новой картинкеНа каждое задание даётся две попытки; люди в среднем решают около 60% заданий.Подробнее на английском ↗ 18,3%
HLEHumanity's Last Exam: 2500 вопросов экспертного уровня по математике, естественным и гуманитарным наукам, ответ не найти поискомПодробнее на английском ↗ 28,2%
WeirdMLНеобычные задачи по машинному обучению: модель пишет код, который на выданных данных обучает классификатор, например для распознавания фигурБалл — средняя точность обученных моделью классификаторов, а не доля решённых задач.Подробнее на английском ↗ 60,4% высокое
SimpleBenchВопросы с подвохом на здравый смысл: пространство, время, поведение людей. 213 вопросов, у каждого шесть вариантов ответаЛюди в проверке авторов набрали около 84%, а балл модели — средняя точность по пяти прогонам.Подробнее на английском ↗ 53,9% высокое
ARC-AGIГоловоломки на цветных клетках: по паре примеров нужно понять правило преобразования картинки и применить его к новойПодробнее на английском ↗ 70,2% высокое

Характеристики

Вышла
6 октября 2025
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
400 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 272 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$15 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$120 за миллион токенов
Понимает
текст, изображения
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
сентябрь 2024
Идентификатор в API
gpt-5-pro

Что это за модель

GPT-5 Pro — старшая версия GPT-5 для самых сложных задач. Отдельной архитектуры у неё нет, отличается она способом работы. OpenAI пишет, что GPT-5 Pro думает дольше и тратит больше вычислительных мощностей на ответ. Она параллельно прорабатывает несколько линий рассуждения, пока отвечает на запрос. Сначала модель появилась в ChatGPT на дорогих тарифах, в API её открыли позже.

По замерам OpenAI, внешние эксперты проверили её на тысяче с лишним сложных запросов из реальной практики. В 67,8% случаев они предпочли её ответы ответам GPT-5 в режиме рассуждений. Грубых ошибок у Pro было на 22% меньше. Лучше всего она проявила себя в вопросах здоровья, науки, математики и программирования. На научном тесте GPQA компания назвала её результат лучшим среди моделей линейки GPT-5.

Её берут для задач, где важнее точность, чем скорость и цена: глубокий анализ, проверка кода, сложное планирование. Модель умеет вызывать внешние функции, искать в интернете и по загруженным файлам, выдавать структурированный ответ — строго по заданной схеме. Уровень рассуждений у неё всегда максимальный, выбрать меньший нельзя.

Ограничений немало. В API она работает только через Responses API и пакетную обработку, классический Chat Completions не поддерживается. Запускать код в песочнице (code interpreter) она не умеет, дообучить её нельзя. Ответ может идти несколько минут, поэтому OpenAI советует включать фоновый режим, чтобы запрос не оборвался по таймауту. Сейчас у OpenAI есть более новые модели, старшая из них в этой роли — GPT-5.5 Pro.

Источники: Документация GPT-5 Pro в API OpenAI, Анонс GPT-5 от OpenAI

Того же уровня по индексу Epoch

Другие модели семейства

Новости о модели

  1. 01

    Уиллисон попробовал Jev: дёшево и быстро, но это ещё более «чёрный ящик», чем чат-боты

    Саймон Уиллисон

  2. 02

    Xiaomi выложила MiMo-V2.6-Flash-RL — облегчённую открытую модель для агентов

    MiMo · HF

  3. 03

    Xiaomi выпустила MiMo-V2.6-Pro-RL — открытую модель на 1 трлн параметров для агентов

    MiMo · HF

  4. 04

    V7 собирает из файлов компании «память» для агентов на моделях OpenAI

    OpenAI

  5. 05

    14 октября GPT-5.5 уберут из ChatGPT и Codex, но через API модель останется

    OpenAI для разработчиков · X

  6. 06

    OpenAI отдаёт госорганам США лицензии бесплатно и вдвое снижает цену на использование

    OpenAI

все 44 новости о GPT-5 →

Данные: models.dev (MIT) и Epoch AI (CC BY 4.0).