ИИтак

← Назад

Модель · OpenAI

GPT-Live-1

Голосовая модель OpenAI для живых разговоров и телефонных звонков через API, сложные задачи передаёт другим моделям

вышла 10 сентября

Характеристики

Вышла
10 сентября
Понимает
аудио, текст
Отвечает
аудио, текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
gpt-live-1

Что это за модель

GPT-Live-1 — голосовая модель OpenAI для разговора с человеком в реальном времени. Она работает в полнодуплексном режиме, то есть слушает и говорит одновременно: выдерживает паузы, даёт себя перебить, реагирует на короткие реплики вроде «ага» и подстраивается, когда разговор меняет направление. В июле 2026 года на этой модели перезапустили голосовой режим ChatGPT, а 10 сентября OpenAI открыла её разработчикам через API. Вместе с ней появились 12 новых голосов, подключить её можно через браузер, по телефонной линии или по протоколу SIP, стандарту интернет-телефонии.

Главная особенность — разделение труда. Сама GPT-Live-1 ведёт беседу и решает, когда нужна помощь. Долгие рассуждения и вызов инструментов она передаёт серверной модели, например GPT-6 Astra. Эту модель может запускать OpenAI, а может и сам разработчик: тогда к разговору подключается его собственный агент или сервис, и разработчик сам решает, какие у агента права и как вести задачу. Модель сразу выдаёт расшифровку речи и текст ответа, сама определяет, когда собеседник закончил говорить, и лучше разбирает в речи номера и коды из букв и цифр.

По замерам OpenAI, в тесте Full Duplex Bench, где проверяют живое чередование реплик, GPT-Live-1 на 30 процентных пунктов лучше предшественницы GPT-Realtime-2.1. В бенчмарке Tau3, где агент решает задачи службы поддержки, она выполнила 83,6% заданий против 45,7% у прошлого поколения. Пауза перед ответом, по данным компании, сократилась с 1,41 до 0,8 секунды. Модель берут для голосовых ассистентов, колл-центров и приложений, где с агентом говорят голосом. Например, в Codex на ней работает голосовой агент, которому можно поручать код с телефона.

Голосовой слой сам не рассуждает глубоко: качество ответов на сложные вопросы зависит от модели, которой он передаёт задачу, и её работа оплачивается отдельно. OpenAI предупреждает: если собеседник перебил модель, начатая серверная задача продолжается. Доделать её или отменить, решает приложение разработчика.

Источники: Анонс GPT-Live-1 в API на форуме OpenAI, Руководство по GPT-Live в документации, Анонс в блоге OpenAI

Новости о модели

  1. 01

    Codex получил голосового агента на GPT-Live-1: код можно поручать с телефона

    OpenAI для разработчиков · X

  2. 02

    Голосовая модель GPT-Live-1 вышла в API: 5 центов за минуту и поддержка звонков

    OpenAI

все 2 новости о Live-1 →

Данные: models.dev (MIT).