OpenAI показала режим Ultrafast: GPT-5.6 Sol в API работает до 14 раз быстрее
OpenAI показала предварительную версию Ultrafast — отдельного тарифа API, в котором GPT-5.6 Sol выдаёт до 750 токенов в секунду на оборудовании Cerebras. Пока режим доступен только первой группе компаний.

Флагманская модель OpenAI GPT-5.6 Sol получила скоростной режим. Он называется Ultrafast — это отдельный тариф обслуживания в API. По данным компании, в нём модель работает до 14 раз быстрее, чем в обычном режиме, и выдаёт до 750 токенов в секунду. Считают выходные токены, то есть ответ модели. Вычисления идут на оборудовании Cerebras.
Раньше за скорость в реальном времени обычно приходилось платить качеством: брать модель поменьше или узкоспециализированную. OpenAI утверждает, что Ultrafast снимает этот выбор. Самая умная модель компании теперь годится для задач, где важна каждая секунда.
Сценарии компания перечисляет вполне земные. Разбирать сбой, пока он ещё идёт: читать логи, смотреть свежие изменения в коде и готовить исправление. Замечать подозрительные финансовые операции, пока рынок не успел измениться. Отвечать покупателю про товар и наличие, пока он не бросил корзину. Вести с клиентом голосовой разговор без неловких пауз.
Внутри OpenAI режим уже опробовали инженеры и исследователи. Инженеры разбирают с его помощью инциденты, но решения и выкатку исправлений оставляют за людьми. Исследователи обычно запускают серию экспериментов на ночь и смотрят результаты утром. С Ultrafast, по словам компании, за рабочий день успевают несколько таких циклов.
Пока режим открыт только первой группе клиентов из программирования, торговли, финансовой аналитики и поддержки. Остальные могут записаться и получить уведомление, когда доступ расширят. Цен и сроков OpenAI не называет, как и того, сколько мощностей Cerebras выделено под режим. Компания лишь обещает расширять доступ по мере роста мощностей.