OpenAI: GPT-5.6 Sol удешевил обслуживание собственных моделей компании на 20%
В колонке об «изобилии интеллекта» OpenAI сообщила: GPT-5.6 Sol помог инженерам снизить стоимость обслуживания моделей на 20%. У моделей компании больше миллиарда активных пользователей.
Самая интересная цифра в новой колонке OpenAI касается не цен, а кухни компании. По её словам, GPT-5.6 Sol вместе с инженерами оптимизировал программы, на которых работают модели OpenAI. В результате полная стоимость их обслуживания упала на 20%. Ещё модель помогла доработать спекулятивное декодирование1, и токены теперь генерируются более чем на 15% эффективнее.
Колонка называется «Строим изобилие интеллекта». Она объясняет логику компании: чем дешевле и умнее модели, тем больше задач их выгодно решать, а растущий спрос оплачивает новые исследования и дата-центры. Для иллюстрации OpenAI напоминает о недавнем снижении цен. GPT-5.6 Luna подешевела на 80%, до 0,20 доллара за миллион входных токенов и 1,20 доллара за миллион выходных. Terra подешевела на 20%, до 2 и 12 долларов. Для старшей модели Sol есть быстрый режим: до 2,5 раза быстрее обычного за двойную цену, а качество ответов то же.
Главная мысль автора: клиенты платят не за токены, а за результат — решённое обращение в поддержку, выпущенную программу, проверенный договор. Поэтому сильная модель, которая справляется с первой попытки, может обойтись дешевле слабой, за которой приходится переделывать. Многое зависит и от обвязки вокруг модели. Компания снова приводит пример с ARC-AGI-32: без замены модели, только за счёт сохранения рассуждений и управления контекстом, результат Sol вырос с 13,3% до 38,3%, а выходных токенов понадобилось вшестеро меньше.
Приводит OpenAI и данные об использовании. Её модели охватывают больше миллиарда активных пользователей и больше двух миллионов компаний. Через полгода после регистрации человек в среднем отправляет примерно на 50% больше сообщений в день и поручает ChatGPT вдвое больше разных видов работы. Внутри самой OpenAI на агентную работу через Codex3 приходится 99,8% выходных токенов за неделю.
Об инфраструктуре в колонке говорится сдержанно. Дата-центры приходится планировать на годы вперёд, а спрос меняется быстрее. Поэтому, по словам OpenAI, решения о вложениях она принимает по фактам: росту нагрузки, контрактам с компаниями, загрузке мощностей и выручке. Конкретных сумм и новых проектов в тексте нет.