Модель · Google
Gemini 3.8 Live
Голосовая модель Google для живого разговора и агентов, дешевле старшей 3.8 Live Extended Thinking
вышла 15 сентября
Характеристики
- Вышла
- 15 сентября
- Понимает
- аудио, видео, текст
- Отвечает
- аудио, текст
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- нет
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- да
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Идентификатор в API
- gemini-3.8-live
Что это за модель
Gemini 3.8 Live — голосовая модель Google для разговора в реальном времени. Она слушает речь, отвечает голосом и в ходе беседы может смотреть на картинку с камеры или экрана, чтобы отвечать про то, что видит пользователь. Вместе с ней вышла старшая Gemini 3.8 Live Extended Thinking, рассчитанная на сложные многошаговые задачи. Сама 3.8 Live, по словам Google, сделана для больших объёмов и низкой цены.
Главное отличие от прошлого поколения — модель не замолкает, пока работает. Вызовы инструментов (например, запросы к внешним сервисам) идут в фоне, а она продолжает разговор. В документации такой асинхронный режим теперь включён по умолчанию. Рассуждения модель ведёт по ходу ответа, а не отдельным этапом перед ним, поэтому пауз перед ответом нет. Язык она определяет сама и, по данным Google, может переключаться между 97 языками прямо посреди беседы. Модель сменила gemini-3.1-flash-live-preview.
Google предлагает брать её для голосовых помощников в поддержке клиентов, для адаптации новых сотрудников и для работы с задачами, где агенту нужно параллельно что-то искать или менять во внешних системах. Модель умеет опираться на результаты поиска Google. По данным компании, в Speech Agent Arena, где пользователи сравнивают голосовых агентов, она заняла второе место. Кроме API и Google AI Studio, она работает в голосовом поиске Search Live, а в корпоративном Gemini Enterprise пока доступна в закрытой предварительной версии.
Часть возможностей Gemini API модели недоступна. Она не поддерживает кэш, запуск кода, поиск по файлам, структурированный ответ по заданной схеме, чтение ссылок, генерацию картинок и привязку к Google Maps. Для задач, где нужны долгие многошаговые рассуждения, Google советует старшую версию Extended Thinking.
Источники: Анонс Gemini 3.8 Live в блоге Google, Страница модели в документации Gemini API
Новости о модели
- 01
- 02
- 03
- 04
- 05
- 06
Данные: models.dev (MIT).