Vidu Q4 API
Shengshu Vidu Q4 — obraz na wideo i referencja na wideo z klipami o długości 3–16 sekund, rozdzielczością od 540p do 4K i opcjonalnie generowanym dźwiękiem. Referencja na wideo przyjmuje w jednym żądaniu do 12 obrazów referencyjnych i do 3 referencyjnych klipów audio.
Dwa endpointy: vidu/q4-preview/image-to-video ożywia pojedynczy obraz, a vidu/q4-preview/reference-to-video buduje scenę z promptu oraz maksymalnie 12 obrazów referencyjnych i 3 referencyjnych klipów audio. Oba przyjmują dowolną długość w pełnych sekundach od 3 do 16, pięć rozdzielczości od 540p do 4K i przełącznik dźwięku.
Przegląd
O modelu Vidu Q4 API
Co robi Vidu Q4, jakie miejsce zajmuje w linii modeli Shengshu i dlaczego zespoły po niego sięgają.
Vidu Q4 to model generowania wideo od Shengshu, dostępny przez REST API WaveSpeedAI. Shengshu Vidu Q4 — obraz na wideo i referencja na wideo z klipami o długości 3–16 sekund, rozdzielczością od 540p do 4K i opcjonalnie generowanym dźwiękiem. Referencja na wideo przyjmuje w jednym żądaniu do 12 obrazów referencyjnych i do 3 referencyjnych klipów audio.
Dwa endpointy: vidu/q4-preview/image-to-video ożywia pojedynczy obraz, a vidu/q4-preview/reference-to-video buduje scenę z promptu oraz maksymalnie 12 obrazów referencyjnych i 3 referencyjnych klipów audio. Oba przyjmują dowolną długość w pełnych sekundach od 3 do 16, pięć rozdzielczości od 540p do 4K i przełącznik dźwięku.
Rodzina Vidu Q4 w WaveSpeedAI zawiera 2 endpointy REST obejmujące workflowy: Reference-To-Video, Image-To-Video. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.
Uruchamiaj Vidu Q4 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.
Specyfikacja
Możliwości i status premiery Vidu Q4 API
Szczegóły modelu, których deweloperzy szukają przed wyborem API: dostępność, oczekiwana długość wyniku, obsługa referencji i aktualne rozwiązanie zastępcze.
Endpointy
2 warianty
Obraz na wideo i referencja na wideo.
Długość
3–16 s
Dowolna pełna liczba sekund; domyślnie 5 s.
Rozdzielczość
od 540p do 4K
540p, 720p, 1080p, 2K, 4K; domyślnie 720p.
Referencje
12 obrazów + 3 audio
W referencji na wideo, razem z promptem tekstowym.
Endpointy
Wszystkie endpointy API Vidu Q4
2 endpointy Vidu Q4 dostępne teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Przykłady
Vidu Q4 w akcji
Prawdziwe wyniki wygenerowane przez API Vidu Q4. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.
Jak zacząć
Jak korzystać z API Vidu Q4
Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.
- 01
Uzyskaj klucz API
Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.
- 02
Wyślij predykcję
Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.
- 03
Sprawdzaj ukończenie
Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.
- 04
Odczytaj adres wyniku
Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu Vidu Q4.
Zastosowania
Co możesz zbudować z Vidu Q4
Typowe workflowy, do których deweloperzy i twórcy używają API Vidu Q4.
Animacja produktu z jednego zdjęcia
vidu/q4-preview/image-to-video zamienia pojedyncze zdjęcie produktu w klip promocyjny. Opisz ruch kamery i oczekiwany ruch w kadrze — obraz pozostaje wizualną kotwicą.
Postacie, które zachowują wygląd
vidu/q4-preview/reference-to-video przyjmuje do 12 obrazów referencyjnych, więc powracającą postać, maskotkę lub ambasadora marki można pokazać z kilku ujęć, a pozostaną rozpoznawalni we wszystkich klipach.
Sceny prowadzone dźwiękiem
Dodaj do 3 referencyjnych klipów audio w polu audios obok obrazów i pozostaw włączone generate_audio, aby w jednym wywołaniu otrzymać klip z dźwiękiem.
4K gotowe do publikacji
Oba endpointy generują 540p, 720p, 1080p, 2K lub 4K. Twórz wersje robocze w 540p lub 720p, a zatwierdzony prompt uruchom ponownie w docelowej rozdzielczości — bez osobnego etapu upscalingu.
Każdy format społecznościowy
Referencja na wideo renderuje w proporcjach 16:9, 9:16, 1:1, 3:4 lub 4:3, obejmując YouTube, Reels, Shorts, posty w feedzie i strony produktowe z tych samych referencji.
Klipy dopasowane do rytmu
Długość to dowolna pełna liczba sekund od 3 do 16, więc 3-sekundowa pętla, 6-sekundowy bumper i 15-sekundowy spot powstają w tym samym endpoincie.
Wskazówki
Wskazówki do promptów dla Vidu Q4
Praktyczne rady, jak uzyskiwać lepsze wyniki z Vidu Q4 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli wideo.
- 01
Użyj czystego, dobrze oświetlonego obrazu źródłowego
W vidu/q4-preview/image-to-video obraz wyznacza obiekt, kadr i styl. Wybierz ostry obraz z jednym wyraźnym obiektem, a w prompcie opisz ruch i pracę kamery zamiast ponownie opisywać to, co już widać.
- 02
Daj każdej referencji zadanie
W vidu/q4-preview/reference-to-video używaj referencji, które należą do sceny — postaci, produktu, otoczenia — i napisz w prompcie, jak każda z nich ma się pojawić, zamiast wysyłać luźno powiązane obrazy.
- 03
Dopasuj akcję do długości
Proś o tyle akcji, ile mieści się w długości klipu. Klip 3–5 sekund pasuje do jednego ruchu lub gestu; wieloetapową akcję zostaw na 10–16 sekund.
- 04
Szkicuj nisko, dostarczaj wysoko
Testuj pomysły w 540p lub 720p przy krótkich długościach, a wybrany prompt uruchom ponownie w 1080p, 2K lub 4K do finalnej wersji.
- 05
Z góry zdecyduj o dźwięku i przepisywaniu promptu
generate_audio jest domyślnie włączone; wyłącz je, jeśli dodasz własną ścieżkę dźwiękową. W obrazie na wideo ustaw enable_prompt_expansion na false, jeśli prompt ma zostać użyty dokładnie tak, jak go napisano.
Cennik
Cennik API Vidu Q4
Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).
| Endpoint | Typ | Cena początkowa |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Wywołaj API Vidu Q4
Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Porównanie
Vidu Q4 a alternatywy
Kiedy wybrać Vidu Q4 zamiast podobnych modeli w WaveSpeedAI.
Vidu Q4 a Vidu Q3
Referencja na wideo w Vidu Q3 przyjmuje 1–4 obrazy referencyjne; Q4 przyjmuje do 12 obrazów i do 3 referencji audio, a oba endpointy Q4 sięgają 4K. Q3 pozostaje najlepszym wyborem do tekstu na wideo, interpolacji klatek kluczowych początek–koniec oraz poziomów Pro i Turbo.
Vidu Q4 a Seedance 2.5
Seedance 2.5 generuje pojedyncze ujęcia do 30 sekund i dodaje endpointy do edycji i wydłużania wideo. Vidu Q4 koncentruje się na generowaniu z obrazów i referencji z rozdzielczością do 4K.
Vidu Q4 a Wan 3.0
Wan 3.0 oferuje tekst, obraz i referencję na wideo do 30 sekund w rozdzielczości do 1080p. Vidu Q4 kończy na 16 sekundach, ale dodaje wyjście 2K i 4K oraz do 12 obrazów referencyjnych.
FAQ
Vidu Q4 API — najczęściej zadawane pytania
Cennik, licencja, integracja — typowe pytania o uruchamianie Vidu Q4 w WaveSpeedAI.
Czym jest API Vidu Q4?
Vidu Q4 to model generowania wideo od Shengshu, udostępniony jako REST API w WaveSpeedAI. Shengshu Vidu Q4 — obraz na wideo i referencja na wideo z klipami o długości 3–16 sekund, rozdzielczością od 540p do 4K i opcjonalnie generowanym dźwiękiem. Referencja na wideo przyjmuje w jednym żądaniu do 12 obrazów referencyjnych i do 3 referencyjnych klipów audio. Możesz wywoływać go programowo lub wypróbować w playground, do którego prowadzi link powyżej.
Jak wywołać API Vidu Q4?
Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.
Ile kosztuje API Vidu Q4?
Vidu Q4 zaczyna się od $0.25 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.
Jakie warianty Vidu Q4 są dostępne?
WaveSpeedAI udostępnia 2 aktywnych endpointów Vidu Q4: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Każdy wariant ma własną stronę playground i cennik.
Czy mogę używać wyników Vidu Q4 komercyjnie?
Prawa do komercyjnego użycia wynikają z licencji modelu Shengshu. Większość modeli Shengshu zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.
Dlaczego korzystać z Vidu Q4 w WaveSpeedAI zamiast bezpośrednio?
Jeden klucz API i jedno konto rozliczeniowe dla Vidu Q4 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API Shengshu lub niższe.
Dostawca
O Shengshu
Zespół stojący za Vidu Q4 i szerszą linią modeli Shengshu w WaveSpeedAI.
Shengshu Technology to chińskie laboratorium AI wywodzące się z Uniwersytetu Tsinghua, stojące za rodziną modeli generowania wideo Vidu. Vidu Q4, najnowsza generacja, dodaje obraz na wideo i referencję na wideo z maksymalnie 12 obrazami referencyjnymi, maksymalnie 3 referencyjnymi klipami audio i rozdzielczością do 4K. Vidu Q3 oferuje tekst na wideo, obraz na wideo, referencję na wideo (1–4 obrazy referencyjne dla spójności wielu obiektów) i start-end-to-video (interpolacja klatek kluczowych między dwoma obrazami) na poziomach Standard, Pro i Turbo. Niektóre warianty obsługują wyniki do 16 sekund.
Zacznij budować z Vidu Q4 w WaveSpeedAI
Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od Shengshu i wszystkich innych dostawców.