OpenAI ускорила GPT-6 Astra до восьми раз в платном режиме Ultrafast
В режиме Ultrafast GPT-6 Astra выдаёт до 300 токенов в секунду. В агенте для программирования Codex режим есть в тарифе Pro 500 и части планов Enterprise, в API — у всех разработчиков.
OpenAI запустила Ultrafast — платный режим повышенной скорости для GPT-6 Astra. В агенте для программирования Codex модель генерирует ответы до восьми раз быстрее обычного, до 300 токенов1 в секунду.
Почему это важно: OpenAI продаёт скорость как отдельную услугу. Флагманская модель компании отвечает быстрее, но за это нужно платить больше. В API режим стоит дороже обычного, а в подписке для него нужен новый тариф или корпоративный план.
Расклад: кому уже доступен режим:
- В Codex и ChatGPT Work, версии ChatGPT для офисной работы, режим есть в новом тарифе Pro 500 и в планах Enterprise с оплатой по использованию, но не в старых планах с фиксированными лимитами. В Enterprise режим по умолчанию выключен: включить его должен владелец корпоративного аккаунта.
- В API режим открыт всем разработчикам, но по умолчанию с низкими лимитами. Повысить их компании могут через своих менеджеров в OpenAI.
- Для GPT-6.1 Sol, более дешёвой модели, которую OpenAI выпустила в тот же день, Ultrafast обещают «скоро».
В цифрах: по сравнению с обычным режимом Ultrafast ускоряет ответы в Codex до восьми раз, а в API — до шести. Ускоренный режим Fast в Codex он обгоняет до четырёх раз, уточнил аккаунт OpenAI для разработчиков.
Детали: вместе с режимом OpenAI поменяла подписки:
- Новый тариф Pro 500 даёт самые высокие у компании лимиты — в 25 раз выше, чем у Plus, — и доступ к Ultrafast.
- Тариф Pro 200 снова открыт для новых подписчиков. В нём остаются передовые модели, в том числе Astra и GPT-6.1 Sol.
- Кроме недельного лимита, у подписок раньше был ещё один — на объём работы за каждые пять часов. OpenAI пообещала его не возвращать, чтобы подписчики расходовали недельный объём, когда им удобно.
Но: у режима есть условия:
- Он дороже обычного: в документации OpenAI советует включать его, «когда скорость оправдывает более высокую цену».
- Без постоянного соединения с сервером (WebSocket) часть выигрыша отнимают сетевые задержки. Особенно это касается агентов, которые часто вызывают инструменты, предупреждает компания.
- Режим обрабатывает данные только в США или без привязки к региону. Европейские серверы он не поддерживает.
Что говорят: «Новейшая GPT-6.1 Sol Ultrafast от OpenAI работает не на Cerebras2, а на видеокартах Nvidia с малым размером пакета», — написала в соцсети X аналитическая компания SemiAnalysis3. Малый пакет значит, что видеокарта одновременно обрабатывает немного запросов: каждый выполняется быстрее, но обходится дороже.
В августе предварительная версия Ultrafast для прошлой модели GPT-5.6 Sol работала на чипах Cerebras. После поста SemiAnalysis акции Cerebras упали на 7%, пишет Investing.com. OpenAI не говорит, на каком железе работает Ultrafast, а режим для GPT-6.1 Sol официально обещает только «скоро».