Модель · Google
Lyria 3 Pro Preview
Устаревшая музыкальная модель Google: пишет песни до трёх минут с вокалом, куплетами и припевами. Её сменила Lyria 3.5
вышла 25 марта
Характеристики
- Вышла
- 25 марта
- КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
- 1 млн токенов
- Длина ответаСколько токенов модель может выдать за один ответ, вместе со скрытыми рассуждениями, если они есть
- до 65 тыс. токенов
- Цена входаСколько стоит миллион токенов, отправленных модели: вопрос, документы, вся история переписки
- $0 за миллион токенов
- Цена ответаСколько стоит миллион токенов, написанных моделью, — включая скрытые рассуждения
- $0 за миллион токенов
- Понимает
- текст, изображения
- Отвечает
- текст, аудио
- РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
- нет
- Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
- нет
- ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
- закрытые
- Идентификатор в API
- lyria-3-pro-preview
Что это за модель
Lyria 3 Pro — модель Google DeepMind, которая сочиняет музыку. На вход она получает текстовое описание или картинку, а выдаёт стереозапись с частотой 48 кГц и, если нужно, текст песни. В документации Gemini API её называют главной музыкальной моделью Google, рассчитанной на целые песни, а не на короткие фрагменты. Сейчас она работает как предварительная версия (preview).
Google выпустила её через месяц после Lyria 3, которая делала треки только по 30 секунд. Pro-версия пишет композиции до трёх минут. Компания заявляет, что модель лучше понимает, как устроена песня. Поэтому в запросе можно отдельно описать вступление, куплеты, припевы и бридж, то есть связку между частями. В той же линейке есть лёгкая Lyria 3 Clip для коротких отрывков. Позже вышла Lyria 3.5: по словам Google, она поёт выразительнее и лучше слушается заданного темпа.
Модель берут для фоновой музыки к видео и презентациям, для черновиков песен и для экспериментов с жанрами и сложными переходами между частями. Она доступна в Gemini API, Google AI Studio, Vertex AI, в приложении Gemini, в Google Vids и в ProducerAI.
Это узкая модель: она не вызывает внешние функции, не ищет в интернете, не рисует картинки и не выдаёт структурированные ответы. Во все её записи встроен SynthID — невидимый водяной знак, по которому можно узнать сгенерированный звук. Голоса конкретных исполнителей модель не копирует. Если в запросе назвать артиста, она воспримет его только как общий ориентир по стилю. Готовые треки дополнительно сверяются с уже существующей музыкой.
Источники: Анонс Lyria 3 Pro в блоге Google, Страница модели в документации Gemini API
Другие модели семейства
-
Lyria 3 Clip Preview
Googleконтекст 1 млнбесплатно
Новости о модели
- 01
Данные: models.dev (MIT).