Модель · OpenAI
GPT-5.3 Codex Spark
Малая и очень быстрая модель OpenAI для программирования в реальном времени, превью облегчённой GPT-5.3-Codex
вышла 5 февраля
Характеристики
- Вышла
- 5 февраля
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 128 тыс. токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 32 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $1,75 за миллион токенов
- Вход из кэшаЦена входа для повторяющегося начала запроса, которое лаборатория уже сохранила у себя. В длинной переписке и у агентов это большая часть входа — и в разы дешевле
- $0,175 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $14 за миллион токенов
- Понимает
- текст, изображения, PDF
- Отвечает
- текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- да
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Знания до
- август 2025
- Идентификатор в API
- gpt-5.3-codex-spark
Что это за модель
GPT-5.3-Codex-Spark — уменьшенная версия GPT-5.3-Codex, модели OpenAI для программирования. Это первая модель компании, которую сделали для работы с кодом в реальном времени: человек даёт правку и почти сразу видит результат. Её запускают не на обычных видеокартах, а на чипах Cerebras Wafer-Scale Engine. Это процессор размером с целую кремниевую пластину, на нём больше встроенной памяти, чем на любом другом чипе для ИИ. По данным OpenAI, модель выдаёт больше 1000 токенов в секунду. Это первый результат партнёрства OpenAI и Cerebras, о котором компании объявили в январе 2026 года.
От полной GPT-5.3-Codex она отличается прежде всего скоростью: пишет примерно в 15 раз быстрее. Платить за это приходится качеством: большая модель справляется с задачами лучше. По замерам лаборатории, на бенчмарках SWE-Bench Pro и Terminal-Bench 2.0 Spark обходит прошлую лёгкую модель GPT-5.1-Codex-mini и тратит на задачи заметно меньше времени. Вместе с запуском OpenAI ускорила всю цепочку от запроса до ответа. Например, соединение с сервером теперь не рвётся между запросами, а первый токен появляется быстрее. Эти улучшения работают и для других моделей.
Её берут для частой и мелкой работы с кодом, когда важно не терять темп: точные правки в файлах, переделка плана, вопросы о том, как устроен проект. По умолчанию модель ведёт себя сдержанно. Она вносит небольшие правки и не запускает тесты, пока её об этом не попросят.
Модель вышла как предварительная версия для исследований (research preview). Сначала её открыли подписчикам ChatGPT Pro в приложении Codex, в утилите командной строки и в расширении для VS Code, а через API — только отдельным партнёрам. На запуске она работала только с текстом. Лимиты использования у неё свои и могут меняться в зависимости от нагрузки. OpenAI сообщает, что модель прошла базовые проверки безопасности и выпущена по обычным правилам компании.
Источники: Анонс GPT-5.3-Codex-Spark, Cerebras о запуске Codex-Spark, Разбор анонса у Саймона Уиллисона
Данные: models.dev (MIT).