ИИтак

← Назад

Модель · SpaceXAI

Grok Imagine Video 1.5

Основная видеомодель SpaceXAI: оживляет картинки и снимает ролики по описанию со звуком, умеет редактировать и продлевать видео

вышла 30 мая

Характеристики

Вышла
30 мая
КонтекстСколько текста модель учитывает за один запрос: вопрос, приложенные документы и её собственный ответ вместе. Токен — кусок слова; слово обычно занимает один–три токена
1 тыс. токенов
Понимает
текст, изображения, аудио, PDF
Отвечает
видео
РассужденияПеред ответом модель рассуждает про себя: медленнее и дороже, зато точнее на трудных задачах
нет
Вызов инструментовМодель сама просит программу выполнить действие — поиск, запуск кода, запрос к сервису — и продолжает с результатом. На этом держатся агенты
нет
ВесаОткрытые — файлы модели можно скачать и запустить на своих серверах. Закрытые — доступ только через сервис лаборатории
закрытые
Идентификатор в API
grok-imagine-video-1.5

Что это за модель

Grok Imagine Video 1.5 — модель SpaceXAI для генерации видео. Главный её режим — «картинка в видео»: пользователь даёт неподвижное изображение и текстовый запрос, а модель превращает кадр в короткий ролик. Звук создаётся за тот же проход, что и картинка: фоновая музыка, звуковые эффекты и реплики персонажей. Если попросить ролик только по тексту, модель действует в два шага: сначала рисует по описанию первый кадр, потом его оживляет.

Она сменила первую Grok Imagine Video, вышедшую в январе. SpaceXAI описывает обновление так: движения стали лучше, физика правдоподобнее, звук качественнее, а скорость выше. По словам компании, речь звучит чётче и точнее совпадает с движением губ, а движение в кадре меньше искажается к концу ролика. Быстрый вариант теперь делает шестисекундный ролик в 720p примерно за 25 секунд, раньше на это уходило больше 40. Позже появились ролики в 1080p и режим опорных изображений (референсов): каждое такое изображение закрепляет одну деталь — лицо, товар или место.

Её выбирают, чтобы оживить готовую иллюстрацию или фотографию, сделать короткий ролик для соцсетей или рекламу с одним и тем же героем в разных сценах. Если дать изображение персонажа и образец голоса, лицо и голос сохраняются от сцены к сцене. Кроме создания роликов с нуля, модель через API редактирует готовые видео и продлевает их, начиная с последнего кадра. Она доступна на grok.com, в приложениях для iOS и Android и в API SpaceXAI.

Ролики получаются короткими: по документации — до 15 секунд. Разрешение 1080p доступно только при создании ролика по тексту или по картинке, а при редактировании и продлении видео — нет. Генерация идёт асинхронно: запрос ставится в очередь, и готовое видео приходится забирать отдельно. Сколько ждать, зависит от сложности запроса, длины и разрешения ролика.

Источники: Анонс Grok Imagine Video 1.5, Карточка модели в документации SpaceXAI, Документация по генерации видео

Другие модели семейства

Данные: models.dev (MIT).