ИИтак

← Назад

Модель · Google

Gemini 3.8 Live

Голосовая модель Google для живого разговора и агентов, дешевле старшей 3.8 Live Extended Thinking

вышла 15 сентября

Характеристики

Вышла
15 сентября
Понимает
аудио, видео, текст
Отвечает
аудио, текст
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
да
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
gemini-3.8-live

Что это за модель

Gemini 3.8 Live — голосовая модель Google для разговора в реальном времени. Она слушает речь, отвечает голосом и в ходе беседы может смотреть на картинку с камеры или экрана, чтобы отвечать про то, что видит пользователь. Вместе с ней вышла старшая Gemini 3.8 Live Extended Thinking, рассчитанная на сложные многошаговые задачи. Сама 3.8 Live, по словам Google, сделана для больших объёмов и низкой цены.

Главное отличие от прошлого поколения — модель не замолкает, пока работает. Вызовы инструментов (например, запросы к внешним сервисам) идут в фоне, а она продолжает разговор. В документации такой асинхронный режим теперь включён по умолчанию. Рассуждения модель ведёт по ходу ответа, а не отдельным этапом перед ним, поэтому пауз перед ответом нет. Язык она определяет сама и, по данным Google, может переключаться между 97 языками прямо посреди беседы. Модель сменила gemini-3.1-flash-live-preview.

Google предлагает брать её для голосовых помощников в поддержке клиентов, для адаптации новых сотрудников и для работы с задачами, где агенту нужно параллельно что-то искать или менять во внешних системах. Модель умеет опираться на результаты поиска Google. По данным компании, в Speech Agent Arena, где пользователи сравнивают голосовых агентов, она заняла второе место. Кроме API и Google AI Studio, она работает в голосовом поиске Search Live, а в корпоративном Gemini Enterprise пока доступна в закрытой предварительной версии.

Часть возможностей Gemini API модели недоступна. Она не поддерживает кэш, запуск кода, поиск по файлам, структурированный ответ по заданной схеме, чтение ссылок, генерацию картинок и привязку к Google Maps. Для задач, где нужны долгие многошаговые рассуждения, Google советует старшую версию Extended Thinking.

Источники: Анонс Gemini 3.8 Live в блоге Google, Страница модели в документации Gemini API

Новости о модели

  1. 01

    Alibaba выпустила Qwen3.8-Omni-Flash — модель, которая смотрит видео, слушает звук и работает с инструментами

    Qwen · X

  2. 02

    Стартап TypeSafe выпустил Jev — модель, которая не пишет текст, а только принимает решения

    Latent Space

  3. 03

    Уиллисон поручил GPT-6 Astra собрать браузерную «звонилку» к голосовым моделям Gemini 3.8 Live

    Саймон Уиллисон

  4. 04

    Голосовые модели Gemini 3.8 Live пришли в Gmail, Docs и поиск и возглавили рейтинг

    Google DeepMind

  5. 05

    Google выпустила голосовые модели Gemini 3.8 Live: агент работает, не прерывая разговор

    Google для разработчиков

  6. 06

    OpenAI отдаёт госорганам США лицензии бесплатно и вдвое снижает цену на использование

    OpenAI

все 9 новостей о Gemini 3.8 →

Данные: models.dev (MIT).