ИИтак

← Назад

Модель · Google

Lyria 3 Pro Preview

Устаревшая музыкальная модель Google: пишет песни до трёх минут с вокалом, куплетами и припевами. Её сменила Lyria 3.5

вышла 25 марта

Характеристики

Вышла
25 марта
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 млн токенов
Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
до 65 тыс. токенов
Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
$0 за миллион токенов
Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
$0 за миллион токенов
Понимает
текст, изображения
Отвечает
текст, аудио
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
нет
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
lyria-3-pro-preview

Что это за модель

Lyria 3 Pro — модель Google DeepMind, которая сочиняет музыку. На вход она получает текстовое описание или картинку, а выдаёт стереозапись с частотой 48 кГц и, если нужно, текст песни. В документации Gemini API её называют главной музыкальной моделью Google, рассчитанной на целые песни, а не на короткие фрагменты. Сейчас она работает как предварительная версия (preview).

Google выпустила её через месяц после Lyria 3, которая делала треки только по 30 секунд. Pro-версия пишет композиции до трёх минут. Компания заявляет, что модель лучше понимает, как устроена песня. Поэтому в запросе можно отдельно описать вступление, куплеты, припевы и бридж, то есть связку между частями. В той же линейке есть лёгкая Lyria 3 Clip для коротких отрывков. Позже вышла Lyria 3.5: по словам Google, она поёт выразительнее и лучше слушается заданного темпа.

Модель берут для фоновой музыки к видео и презентациям, для черновиков песен и для экспериментов с жанрами и сложными переходами между частями. Она доступна в Gemini API, Google AI Studio, Vertex AI, в приложении Gemini, в Google Vids и в ProducerAI.

Это узкая модель: она не вызывает внешние функции, не ищет в интернете, не рисует картинки и не выдаёт структурированные ответы. Во все её записи встроен SynthID — невидимый водяной знак, по которому можно узнать сгенерированный звук. Голоса конкретных исполнителей модель не копирует. Если в запросе назвать артиста, она воспримет его только как общий ориентир по стилю. Готовые треки дополнительно сверяются с уже существующей музыкой.

Источники: Анонс Lyria 3 Pro в блоге Google, Страница модели в документации Gemini API

Другие модели семейства

Новости о модели

  1. 01

    Google выпустила музыкальную модель Lyria 3.5: вокал стал живее, темпом проще управлять

    Google DeepMind

все 1 новость о Lyria 3 →

Данные: models.dev (MIT).