Голосовые модели Gemini 3.8 Live пришли в Gmail, Docs и поиск и возглавили рейтинг
Google DeepMind выпустила голосовые модели Gemini 3.8 Live и 3.8 Live Extended Thinking. Старшая модель заняла первое место в рейтинге Artificial Analysis, а обе уже работают в приложении Gemini, Workspace и поиске.

Google DeepMind рассказала, что умеют её новые голосовые модели Gemini 3.8 Live и 3.8 Live Extended Thinking. С ними можно разговаривать голосом, и они выполняют задачи, не прерывая беседы. Разработчикам модели уже доступны через Gemini API. Теперь они появились и в обычных продуктах Google: в приложении Gemini, в Gmail, Docs и Keep, а также в голосовом поиске Search Live.
У моделей разные задачи. Gemini 3.8 Live — быстрая и недорогая модель для массового использования. Она видит, что показывает камера или экран, и учитывает это почти в реальном времени. Ещё она сама замечает, когда собеседник перешёл на другой язык, и переключается следом; всего она поддерживает 97 языков. Extended Thinking рассчитана на сложные многошаговые задачи. Она думает и говорит одновременно: сначала отвечает «сейчас проверю», а потом рассказывает, как продвигается работа в фоне.
Старшая модель заняла первое место в индексе качества голосового общения Artificial Analysis с результатом 82,6 балла. В бенчмарке τ-Voice, где голосовой агент должен довести задачу до конца, она решила 68,6% задач, в банковской версии этого теста — 35,1%. Младшая модель заняла второе место в Speech Agent Arena, где модели оценивают пользователи. В демонстрациях Google модель играет в шахматы по картинке, превращает набросок и голосовые правки в работающий интерфейс и бронирует поездку в несколько шагов.
Extended Thinking доступна в Gemini Live. В Docs она работает у подписчиков Google AI Pro и Ultra, а в Gmail и Keep — у всех подписчиков Google AI. Корпоративные клиенты получают модели в закрытой предварительной версии Gemini Enterprise. Встроить модели в свои продукты можно и через сторонние платформы, например LiveKit, Pipecat, LangChain и Vercel. Весь сгенерированный звук Google помечает невидимым водяным знаком SynthID.
Цены для разработчиков Google назвала раньше: минута входящего звука стоит 0,005 доллара, исходящего — 0,018 доллара. Цифры бенчмарков пока приводит сама компания, независимых сравнений в анонсе нет.