ИИтак

← Назад

Модель · OpenAI

GPT-5.3 Codex Spark

Малая и очень быстрая модель OpenAI для программирования в реальном времени, превью облегчённой GPT-5.3-Codex

вышла 5 февраля

Характеристики

Вышла
5 февраля
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
128 тыс. токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 32 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$1,75 за миллион токенов
Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
$0,175 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$14 за миллион токенов
Понимает
текст, изображения, PDF
Отвечает
текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
да
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Знания до
август 2025
Идентификатор в API
gpt-5.3-codex-spark

Что это за модель

GPT-5.3-Codex-Spark — уменьшенная версия GPT-5.3-Codex, модели OpenAI для программирования. Это первая модель компании, которую сделали для работы с кодом в реальном времени: человек даёт правку и почти сразу видит результат. Её запускают не на обычных видеокартах, а на чипах Cerebras Wafer-Scale Engine. Это процессор размером с целую кремниевую пластину, на нём больше встроенной памяти, чем на любом другом чипе для ИИ. По данным OpenAI, модель выдаёт больше 1000 токенов в секунду. Это первый результат партнёрства OpenAI и Cerebras, о котором компании объявили в январе 2026 года.

От полной GPT-5.3-Codex она отличается прежде всего скоростью: пишет примерно в 15 раз быстрее. Платить за это приходится качеством: большая модель справляется с задачами лучше. По замерам лаборатории, на бенчмарках SWE-Bench Pro и Terminal-Bench 2.0 Spark обходит прошлую лёгкую модель GPT-5.1-Codex-mini и тратит на задачи заметно меньше времени. Вместе с запуском OpenAI ускорила всю цепочку от запроса до ответа. Например, соединение с сервером теперь не рвётся между запросами, а первый токен появляется быстрее. Эти улучшения работают и для других моделей.

Её берут для частой и мелкой работы с кодом, когда важно не терять темп: точные правки в файлах, переделка плана, вопросы о том, как устроен проект. По умолчанию модель ведёт себя сдержанно. Она вносит небольшие правки и не запускает тесты, пока её об этом не попросят.

Модель вышла как предварительная версия для исследований (research preview). Сначала её открыли подписчикам ChatGPT Pro в приложении Codex, в утилите командной строки и в расширении для VS Code, а через API — только отдельным партнёрам. На запуске она работала только с текстом. Лимиты использования у неё свои и могут меняться в зависимости от нагрузки. OpenAI сообщает, что модель прошла базовые проверки безопасности и выпущена по обычным правилам компании.

Источники: Анонс GPT-5.3-Codex-Spark, Cerebras о запуске Codex-Spark, Разбор анонса у Саймона Уиллисона

Данные: models.dev (MIT).