Vidu Q4 API
Vidu Q4 от Shengshu — image-to-video и reference-to-video: клипы длиной 3–16 секунд, разрешение от 540p до 4K и опциональная генерация звука. Reference-to-video принимает в одном запросе до 12 референсных изображений и до 3 референсных аудиоклипов.
Две конечные точки: vidu/q4-preview/image-to-video оживляет одно изображение, а vidu/q4-preview/reference-to-video строит сцену по промпту плюс до 12 референсных изображений и 3 референсных аудиоклипов. Обе принимают любую длительность в целых секундах от 3 до 16, пять разрешений от 540p до 4K и переключатель звука.
Обзор
О модели Vidu Q4 API
Что делает Vidu Q4, какое место занимает в линейке моделей Shengshu и почему её выбирают команды.
Vidu Q4 — модель генерации видео от Shengshu, доступная через REST API WaveSpeedAI. Vidu Q4 от Shengshu — image-to-video и reference-to-video: клипы длиной 3–16 секунд, разрешение от 540p до 4K и опциональная генерация звука. Reference-to-video принимает в одном запросе до 12 референсных изображений и до 3 референсных аудиоклипов.
Две конечные точки: vidu/q4-preview/image-to-video оживляет одно изображение, а vidu/q4-preview/reference-to-video строит сцену по промпту плюс до 12 референсных изображений и 3 референсных аудиоклипов. Обе принимают любую длительность в целых секундах от 3 до 16, пять разрешений от 540p до 4K и переключатель звука.
Семейство Vidu Q4 в WaveSpeedAI включает 2 REST-эндпоинта для сценариев: Reference-To-Video, Image-To-Video. У каждого варианта свои цены, параметры и примеры результатов — выберите тот, что подходит под ваш тип входных данных и требования продакшена, или вызывайте несколько с одним API-ключом и собирайте многошаговые пайплайны.
Запускайте Vidu Q4 с тем же API-ключом, платёжным аккаунтом и лимитами, что и остальные 1000+ ИИ-моделей WaveSpeedAI. Без отдельной регистрации у вендора, без SDK для каждого провайдера, без разных лимитов у каждого поставщика — одна интеграция охватывает всё: от текста в изображение и текста в видео до синтеза аудио, 3D-генерации, апскейлинга и редактирования.
Характеристики
Возможности Vidu Q4 API и статус релиза
То, что разработчики ищут перед выбором API: доступность, ожидаемая длина результата, поддержка референсов и текущая рабочая альтернатива.
Конечные точки
2 варианта
Image-to-video и reference-to-video.
Длительность
3–16 с
Любое целое число секунд; по умолчанию 5 с.
Разрешение
от 540p до 4K
540p, 720p, 1080p, 2K, 4K; по умолчанию 720p.
Референсы
12 изображений + 3 аудио
В reference-to-video, вместе с текстовым промптом.
Эндпоинты
Все эндпоинты API Vidu Q4
Сейчас в WaveSpeedAI доступно эндпоинтов Vidu Q4: 2 — выберите вариант под ваш сценарий.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Примеры
Vidu Q4 в деле
Реальные результаты, созданные через API Vidu Q4. Наведите курсор на видео для предпросмотра, нажмите, чтобы открыть в полном размере.
Как использовать
Как использовать API Vidu Q4
Четыре шага от регистрации до готовой генерации. Полные примеры на Python, Node.js и cURL — в разделе API ниже.
- 01
Получите API-ключ
Создайте аккаунт WaveSpeedAI и скопируйте API-ключ на панели управления. Новые аккаунты получают бесплатные стартовые кредиты — их хватит, чтобы несколько десятков раз запустить playground до начала списаний.
- 02
Отправьте предсказание
Отправьте входные данные в формате JSON методом POST на https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Эндпоинт сразу возвращает id предсказания — генерация асинхронная, поэтому соединение не нужно держать открытым на время инференса.
- 03
Опрашивайте до завершения
Выполняйте GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. При статусе completed забирайте результат; при failed, cancelled, timeout или deleted остановитесь с ошибкой; при любом другом статусе продолжайте опрос.
- 04
Получите URL результата
Когда статус станет "completed", возьмите URL из data.outputs[0]. Он указывает на созданный файл в CDN WaveSpeedAI — изображение, видео, аудио или 3D-файл, в зависимости от вызванного варианта Vidu Q4.
Сценарии применения
Что можно создать с Vidu Q4
Типичные сценарии, для которых разработчики и авторы используют API Vidu Q4.
Анимация продукта по одному фото
vidu/q4-preview/image-to-video превращает один снимок продукта в промоклип. Опишите движение камеры и нужное действие — изображение остаётся визуальной опорой.
Герои, которые не меняют облик
vidu/q4-preview/reference-to-video принимает до 12 референсных изображений, поэтому постоянного персонажа, маскота или лицо бренда можно показать с нескольких ракурсов, и он останется узнаваемым от клипа к клипу.
Сцены, ведомые звуком
Добавьте до 3 референсных аудиоклипов через поле audios вместе с изображениями и оставьте generate_audio включённым, чтобы получить клип со звуком за один вызов.
4K, готовое к выдаче
Обе конечные точки выдают 540p, 720p, 1080p, 2K или 4K. Делайте черновики в 540p или 720p, а затем перезапускайте утверждённый промпт в финальном разрешении — без отдельного прохода апскейла.
Любой формат для соцсетей
Reference-to-video рендерит в 16:9, 9:16, 1:1, 3:4 или 4:3, покрывая YouTube, Reels, Shorts, посты в ленте и страницы товаров на основе одних и тех же референсов.
Клипы точно в ритм
Длительность — любое целое число секунд от 3 до 16, так что 3-секундный луп, 6-секундный бампер и 15-секундный ролик выходят из одной и той же конечной точки.
Советы
Советы по написанию запросов для Vidu Q4
Практические советы, как получать лучшие результаты от Vidu Q4, — на основе приёмов, которые работают в продакшен-пайплайнах для моделей видео.
- 01
Берите чистое, хорошо освещённое исходное изображение
В vidu/q4-preview/image-to-video изображение задаёт объект, кадрирование и стиль. Выберите чёткое изображение с одним явным объектом, а в промпте опишите движение и работу камеры, не пересказывая то, что уже видно.
- 02
Дайте каждому референсу свою роль
В vidu/q4-preview/reference-to-video используйте референсы, которые действительно относятся к сцене, — персонажа, продукт, окружение — и укажите в промпте, как должен появиться каждый из них, вместо того чтобы отправлять слабо связанные изображения.
- 03
Соотносите действие с длительностью
Запрашивайте столько действия, сколько помещается в клип. Клипу на 3–5 секунд подходит одно движение или жест; многоэтапное действие оставьте для 10–16 секунд.
- 04
Черновик в низком, финал в высоком
Ищите идеи в 540p или 720p на короткой длительности, а затем перезапустите выбранный промпт в 1080p, 2K или 4K для финальной выдачи.
- 05
Заранее решите насчёт звука и переписывания промпта
generate_audio включён по умолчанию; отключите его, если добавите собственный саундтрек. В image-to-video установите enable_prompt_expansion в false, если хотите, чтобы промпт использовался в точности как написан.
Цены
Цены на API Vidu Q4
Оплата — за каждый результат. Итоговая стоимость зависит от параметров, заданных в playground каждого варианта (разрешение, длительность, количество результатов, референсы).
| Эндпоинт | Тип | Цена от |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Вызов API Vidu Q4
Получите API-ключ на wavespeed.ai/accesskey, затем отправьте предсказание через REST. Playground генерирует готовые к вставке примеры для любой комбинации входных данных.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Сравнение
Vidu Q4 и альтернативы
Когда стоит выбрать Vidu Q4, а не похожие модели в WaveSpeedAI.
Vidu Q4 и Vidu Q3
Reference-to-video в Vidu Q3 принимает 1–4 референсных изображения; Q4 — до 12 изображений плюс до 3 аудиореференсов, и обе конечные точки Q4 доходят до 4K. Q3 остаётся выбором для text-to-video, интерполяции между начальным и конечным ключевым кадром и уровней Pro и Turbo.
Vidu Q4 и Seedance 2.5
Seedance 2.5 даёт одиночные планы длиной до 30 секунд и добавляет конечные точки для редактирования и продления видео. Vidu Q4 сосредоточен на генерации по изображениям и референсам с разрешением до 4K.
Vidu Q4 и Wan 3.0
Wan 3.0 предлагает text-, image- и reference-to-video длиной до 30 секунд в разрешении до 1080p. Vidu Q4 ограничен 16 секундами, но добавляет вывод в 2K и 4K и до 12 референсных изображений.
FAQ
Vidu Q4 API — часто задаваемые вопросы
Цены, лицензия, интеграция — частые вопросы о запуске Vidu Q4 в WaveSpeedAI.
Что такое API Vidu Q4?
Vidu Q4 — модель генерации видео от Shengshu, доступная как REST API в WaveSpeedAI. Vidu Q4 от Shengshu — image-to-video и reference-to-video: клипы длиной 3–16 секунд, разрешение от 540p до 4K и опциональная генерация звука. Reference-to-video принимает в одном запросе до 12 референсных изображений и до 3 референсных аудиоклипов. Её можно вызывать программно или попробовать в playground по ссылке выше.
Как вызывать API Vidu Q4?
Создайте аккаунт WaveSpeedAI, скопируйте API-ключ на странице /accesskey и отправьте POST на https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video с входными данными в JSON. Эндпоинт вернёт id предсказания. Опрашивайте эндпоинт результата примерно раз в 2 секунды, для долгих задач увеличивайте интервал и останавливайтесь на любом финальном статусе. Примеры для продакшена на Python / Node.js / cURL — выше.
Сколько стоит API Vidu Q4?
Vidu Q4 стоит от $0.25 за запуск. Точная стоимость зависит от заданных параметров (разрешение, длительность, количество результатов, референсы). Предпросмотр стоимости рядом с кнопкой «Сгенерировать» в playground показывает точную цену для ваших текущих данных.
Какие варианты Vidu Q4 доступны?
В WaveSpeedAI доступно рабочих эндпоинтов Vidu Q4: 2 — vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. У каждого варианта своя страница playground и свои цены.
Можно ли использовать результаты Vidu Q4 в коммерческих целях?
Права на коммерческое использование определяются лицензией модели Shengshu. Большинство моделей Shengshu разрешают коммерческое использование результатов; краткое описание лицензии смотрите на странице playground каждой модели, а условия платформы — в Условиях использования WaveSpeedAI.
Зачем использовать Vidu Q4 в WaveSpeedAI, а не напрямую?
Один API-ключ и один платёжный аккаунт для Vidu Q4 И для 1000+ других ИИ-моделей от разных провайдеров. Без настройки SDK для каждого вендора, без отдельных лимитов, без переписывания интеграционного кода под каждого поставщика. Цены, как правило, на уровне прямого API Shengshu или ниже.
Разработчик
О Shengshu
Команда, стоящая за Vidu Q4 и всей линейкой моделей Shengshu в WaveSpeedAI.
Shengshu Technology — китайская ИИ-лаборатория, выросшая из Университета Цинхуа, создатель семейства моделей генерации видео Vidu. Vidu Q4, новейшее поколение, добавляет image-to-video и reference-to-video с поддержкой до 12 референсных изображений, до 3 референсных аудиоклипов и разрешения до 4K. Vidu Q3 предлагает text-to-video, image-to-video, reference-to-video (1–4 референсных изображения для согласованности нескольких героев) и start-end-to-video (интерполяция ключевых кадров между двумя изображениями) на уровнях Standard, Pro и Turbo. Некоторые варианты поддерживают результаты до 16 секунд.
Начните создавать с Vidu Q4 в WaveSpeedAI
Бесплатные стартовые кредиты при регистрации. Один API-ключ для 1000+ ИИ-моделей от Shengshu и всех остальных провайдеров.