Уиллисон поручил GPT-6 Astra собрать браузерную «звонилку» к голосовым моделям Gemini 3.8 Live
В день выхода Gemini 3.8 Live Саймон Уиллисон попросил GPT-6 Astra собрать веб-страницу для голосового разговора с новыми моделями Google. Код обходится без сторонних библиотек, а модель можно перебивать на полуслове.

С новыми голосовыми моделями Google теперь можно поговорить прямо в браузере. Разработчик Саймон Уиллисон собрал для этого веб-страницу, причём сам код не писал: он дал GPT-6 Astra от OpenAI документацию, и страницу сделала модель. Уиллисон запускал её в режиме Extra High — с самыми долгими рассуждениями.
Google выпустила Gemini 3.8 Live и 3.8 Live Extended Thinking 15 сентября. Эти модели работают с речью без промежуточного текста: слушают голос и сразу отвечают голосом. По словам Уиллисона, устроены они примерно как семейство GPT-Live у OpenAI.
На странице Уиллисона можно выбрать модель и голос, а при желании задать системный промпт — например, назначить модели роль. Разговор идёт через микрофон браузера. Модель можно перебить, пока она говорит, как в живом разговоре.
Сторонних библиотек в коде нет. Страница держит постоянное соединение с сервером Google через WebSocket, а записывает и воспроизводит звук средствами самого браузера. Адрес, к которому она подключается, — экспериментальная версия API, и ключ разработчика передаётся прямо в нём. Для тех, кто захочет повторить, Уиллисон приложил ссылку на учебник Google по этому API.
По архиву сайта, разработчикам минута входящего звука обходится примерно в полцента, а минута ответа — около 1,8 цента. Пример Уиллисона показывает, что для первого знакомства с новыми моделями хватает их документации и помощи другой модели.