Vidu Q4 API
Shengshu Vidu Q4 – Image-to-Video und Reference-to-Video mit Clips von 3–16 Sekunden, Ausgabe von 540p bis 4K und optional generiertem Audio. Reference-to-Video verarbeitet bis zu 12 Referenzbilder und bis zu 3 Referenz-Audioclips in einer einzigen Anfrage.
Zwei Endpunkte: vidu/q4-preview/image-to-video animiert ein einzelnes Bild, und vidu/q4-preview/reference-to-video baut eine Szene aus einem Prompt plus bis zu 12 Referenzbildern und 3 Referenz-Audioclips auf. Beide akzeptieren jede ganzzahlige Dauer von 3 bis 16 Sekunden, fünf Auflösungen von 540p bis 4K und einen Audio-Schalter.
Überblick
Über Vidu Q4 API
Was Vidu Q4 leistet, wie es in die Modellpalette von Shengshu passt und warum Teams darauf zurückgreifen.
Vidu Q4 ist ein Modell von Shengshu für Videogenerierung, verfügbar über die WaveSpeedAI-REST-API. Shengshu Vidu Q4 – Image-to-Video und Reference-to-Video mit Clips von 3–16 Sekunden, Ausgabe von 540p bis 4K und optional generiertem Audio. Reference-to-Video verarbeitet bis zu 12 Referenzbilder und bis zu 3 Referenz-Audioclips in einer einzigen Anfrage.
Zwei Endpunkte: vidu/q4-preview/image-to-video animiert ein einzelnes Bild, und vidu/q4-preview/reference-to-video baut eine Szene aus einem Prompt plus bis zu 12 Referenzbildern und 3 Referenz-Audioclips auf. Beide akzeptieren jede ganzzahlige Dauer von 3 bis 16 Sekunden, fünf Auflösungen von 540p bis 4K und einen Audio-Schalter.
Die Familie Vidu Q4 auf WaveSpeedAI umfasst 2 REST-Endpunkte für die Workflows Reference-To-Video, Image-To-Video. Jede Variante hat eigene Preise, Parameter und Beispielausgaben – wählen Sie die, die zu Ihrer Eingabemodalität und Ihren Produktionsanforderungen passt, oder rufen Sie mit demselben API-Schlüssel mehrere auf, um mehrstufige Pipelines zu bauen.
Nutzen Sie Vidu Q4 mit demselben API-Schlüssel, demselben Abrechnungskonto und denselben Rate Limits wie die über 1.000 weiteren KI-Modelle auf WaveSpeedAI. Keine separate Einrichtung bei Anbietern, keine SDKs pro Anbieter, keine Rate Limits pro Anbieter – eine Integration deckt alles ab, von Text-zu-Bild und Text-zu-Video über Audiosynthese, 3D-Generierung und Hochskalierung bis zur Bearbeitung.
Spezifikationen
Funktionen und Release-Status von Vidu Q4 API
Die modellspezifischen Details, nach denen Entwickler vor der Wahl einer API suchen: Verfügbarkeit, erwartete Ausgabelänge, Referenzunterstützung und die aktuelle aktive Alternative.
Endpunkte
2 Varianten
Image-to-Video und Reference-to-Video.
Dauer
3–16 s
Jede ganze Sekundenzahl; Standard sind 5 s.
Auflösung
540p bis 4K
540p, 720p, 1080p, 2K, 4K; Standard ist 720p.
Referenzen
12 Bilder + 3 Audio
Bei Reference-to-Video, zusätzlich zu einem Text-Prompt.
Endpunkte
Alle Vidu Q4-API-Endpunkte
2 Vidu Q4-Endpunkte jetzt auf WaveSpeedAI verfügbar – wählen Sie die Variante, die zu Ihrem Workflow passt.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Beispiele
Vidu Q4 in Aktion
Echte Ausgaben der Vidu Q4-API. Fahren Sie über ein Video für eine Vorschau und klicken Sie, um den Viewer in voller Größe zu öffnen.
Anleitung
So verwenden Sie die Vidu Q4-API
Vier Schritte von der Registrierung bis zur fertigen Generierung. Vollständige Beispiele in Python, Node.js und cURL finden Sie unten im Abschnitt „API“.
- 01
API-Schlüssel holen
Registrieren Sie ein WaveSpeedAI-Konto und kopieren Sie Ihren API-Schlüssel aus dem Dashboard. Neue Konten erhalten kostenlose Start-Credits – genug, um den Playground einige Dutzend Mal zu nutzen, bevor die Abrechnung beginnt.
- 02
Prediction senden
Senden Sie Ihre Eingabe als JSON per POST an https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Der Endpunkt gibt sofort eine Prediction-ID zurück – Generierungen laufen asynchron, sodass Sie während der Inferenz keine Verbindung offen halten.
- 03
Auf Abschluss prüfen
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Geben Sie bei „completed“ die Ausgaben zurück; brechen Sie bei „failed“, „cancelled“, „timeout“ oder „deleted“ mit einem Fehler ab; fragen Sie bei allen anderen Status weiter ab.
- 04
Ausgabe-URL lesen
Sobald der Status „completed“ ist, lesen Sie die URL aus data.outputs[0]. Die URL verweist auf Ihre generierten Medien im WaveSpeedAI-CDN – Bild, Video, Audio oder 3D-Datei, je nach aufgerufener Variante von Vidu Q4.
Anwendungsfälle
Was Sie mit Vidu Q4 bauen können
Gängige Workflows, für die Entwickler und Kreative die Vidu Q4-API nutzen.
Produktanimation aus einem einzigen Foto
vidu/q4-preview/image-to-video macht aus einer einzelnen Produktaufnahme einen Werbeclip. Beschreiben Sie die gewünschte Kamerabewegung und Bewegung im Bild – das Bild bleibt der visuelle Anker.
Figuren, die wiedererkennbar bleiben
vidu/q4-preview/reference-to-video akzeptiert bis zu 12 Referenzbilder. So lässt sich eine wiederkehrende Figur, ein Maskottchen oder ein Markengesicht aus mehreren Blickwinkeln zeigen und bleibt über alle Clips hinweg wiedererkennbar.
Szenen, vom Ton geleitet
Fügen Sie über das Feld audios bis zu 3 Referenz-Audioclips zu Ihren Bildern hinzu und lassen Sie generate_audio aktiviert, um mit einem einzigen Aufruf einen Clip mit Ton zu erhalten.
4K in Auslieferungsqualität
Beide Endpunkte liefern 540p, 720p, 1080p, 2K oder 4K. Entwerfen Sie in 540p oder 720p und führen Sie den freigegebenen Prompt dann in der Zielauflösung erneut aus – ganz ohne separaten Upscaling-Durchgang.
Clips im richtigen Takt
Die Dauer ist jede ganze Sekundenzahl von 3 bis 16 – ein 3-Sekunden-Loop, ein 6-Sekunden-Bumper und ein 15-Sekunden-Spot kommen alle vom selben Endpunkt.
Tipps
Tipps zum Prompting von Vidu Q4
Praktische Ratschläge für bessere Ausgaben von Vidu Q4 – abgeleitet aus Mustern, die bei Video-Modellen in Produktions-Pipelines funktionieren.
- 01
Ein sauberes, gut ausgeleuchtetes Ausgangsbild verwenden
Bei vidu/q4-preview/image-to-video bestimmt das Bild Motiv, Bildausschnitt und Stil. Wählen Sie ein scharfes Bild mit einem klaren Motiv und nutzen Sie den Prompt für Bewegung und Kameraführung, statt zu beschreiben, was bereits zu sehen ist.
- 02
Jeder Referenz eine Aufgabe geben
Verwenden Sie bei vidu/q4-preview/reference-to-video Referenzen, die in die Szene gehören – die Figur, das Produkt, den Schauplatz – und beschreiben Sie im Prompt, wie jede davon erscheinen soll, statt lose zusammenhängende Bilder zu senden.
- 03
Die Handlung an die Dauer anpassen
Fordern Sie so viel Handlung an, wie zur Cliplänge passt. Ein Clip von 3–5 Sekunden eignet sich für eine Bewegung oder Geste; mehrstufige Handlungen heben Sie sich für 10–16 Sekunden auf.
- 04
Niedrig entwerfen, hoch ausliefern
Erkunden Sie Ideen in 540p oder 720p mit kurzer Dauer und führen Sie den gewählten Prompt dann für die Auslieferung in 1080p, 2K oder 4K erneut aus.
- 05
Audio und Prompt-Umschreibung vorab festlegen
generate_audio ist standardmäßig aktiviert; schalten Sie es aus, wenn Sie einen eigenen Soundtrack hinzufügen. Setzen Sie bei Image-to-Video enable_prompt_expansion auf false, wenn Ihr Prompt unverändert verwendet werden soll.
Preise
Vidu Q4-API-Preise
Die Abrechnung erfolgt pro Ausgabe. Der Endpreis richtet sich nach den Parametern, die Sie im Playground jeder Variante setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen).
| Endpunkt | Typ | Startpreis |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Die Vidu Q4-API aufrufen
Holen Sie sich unter wavespeed.ai/accesskey einen API-Schlüssel und senden Sie dann eine Prediction per REST. Der Playground erzeugt einfügefertige Beispiele für jede Kombination von Eingaben.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Vergleich
Vidu Q4 im Vergleich zu Alternativen
Wann Sie Vidu Q4 ähnlichen Modellen auf WaveSpeedAI vorziehen sollten.
Vidu Q4 vs. Vidu Q3
Vidu Q3 Reference-to-Video verarbeitet 1–4 Referenzbilder; Q4 verarbeitet bis zu 12 Bilder plus bis zu 3 Audio-Referenzen, und beide Q4-Endpunkte erreichen 4K. Q3 bleibt die Wahl für Text-to-Video, Start-End-Keyframe-Interpolation und seine Stufen Pro und Turbo.
Vidu Q4 vs. Seedance 2.5
Seedance 2.5 erreicht bis zu 30 Sekunden lange Einzelaufnahmen und bietet zusätzlich Endpunkte für Videobearbeitung und -verlängerung. Vidu Q4 konzentriert sich auf bild- und referenzgesteuerte Generierung mit Ausgabe bis 4K.
Vidu Q4 vs. Wan 3.0
Wan 3.0 bietet Text-, Image- und Reference-to-Video mit bis zu 30 Sekunden bei bis zu 1080p. Vidu Q4 endet bei 16 Sekunden, bietet aber zusätzlich 2K- und 4K-Ausgabe und bis zu 12 Referenzbilder.
FAQ
Vidu Q4 API — Häufig gestellte Fragen
Preise, Lizenz, Integration – häufige Fragen zur Nutzung von Vidu Q4 auf WaveSpeedAI.
Was ist die Vidu Q4-API?
Vidu Q4 ist ein Shengshu-Modell für Videogenerierung, das auf WaveSpeedAI als REST-API bereitgestellt wird. Shengshu Vidu Q4 – Image-to-Video und Reference-to-Video mit Clips von 3–16 Sekunden, Ausgabe von 540p bis 4K und optional generiertem Audio. Reference-to-Video verarbeitet bis zu 12 Referenzbilder und bis zu 3 Referenz-Audioclips in einer einzigen Anfrage. Sie können es programmatisch aufrufen oder im oben verlinkten Playground ausprobieren.
Wie rufe ich die Vidu Q4-API auf?
Registrieren Sie ein WaveSpeedAI-Konto, kopieren Sie Ihren API-Schlüssel von /accesskey und senden Sie dann per POST an https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video Ihre Eingabe als JSON. Der Endpunkt gibt eine Prediction-ID zurück. Fragen Sie den Ergebnis-Endpunkt etwa alle 2 Sekunden ab, verlängern Sie das Intervall bei lang laufenden Aufgaben und hören Sie bei jedem Endstatus auf. Produktionsnahe Beispiele in Python / Node.js / cURL finden Sie oben.
Was kostet die Vidu Q4-API?
Vidu Q4 beginnt bei $0.25 pro Aufruf. Die genauen Kosten richten sich nach den Parametern, die Sie setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen). Die Live-Kostenvorschau neben der Schaltfläche „Generieren“ im Playground zeigt den genauen Preis für Ihre aktuelle Eingabe.
Welche Varianten von Vidu Q4 sind verfügbar?
WaveSpeedAI stellt 2 aktive Vidu Q4-Endpunkte bereit: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Jede Variante hat eine eigene Playground-Seite und eigene Preise.
Kann ich die Ausgaben von Vidu Q4 kommerziell nutzen?
Die kommerziellen Nutzungsrechte richten sich nach der Modelllizenz von Shengshu. Die meisten Modelle von Shengshu erlauben die kommerzielle Nutzung der Ausgaben; die konkrete Lizenzzusammenfassung finden Sie auf der Playground-Seite des jeweiligen Modells, die Bedingungen auf Plattformebene in den Nutzungsbedingungen von WaveSpeedAI.
Warum Vidu Q4 auf WaveSpeedAI nutzen statt direkt?
Ein API-Schlüssel und ein Abrechnungskonto für Vidu Q4 UND über 1.000 weitere KI-Modelle anderer Anbieter. Keine SDK-Einrichtung pro Anbieter, keine separaten Rate Limits, kein Neuschreiben von Integrationscode pro Anbieter. Die Preise liegen in der Regel auf dem Niveau der direkten API von Shengshu oder darunter.
Anbieter
Über Shengshu
Das Team hinter Vidu Q4 und der übrigen Modellpalette von Shengshu auf WaveSpeedAI.
Shengshu Technology ist ein chinesisches KI-Labor, ausgegründet aus der Tsinghua-Universität, hinter der Vidu-Familie von Videogenerierungsmodellen. Vidu Q4, die neueste Generation, bietet Image-to-Video und Reference-to-Video mit bis zu 12 Referenzbildern, bis zu 3 Referenz-Audioclips und Ausgabe bis 4K. Vidu Q3 bietet Text-to-Video, Image-to-Video, Reference-to-Video (1–4 Referenzbilder für Konsistenz mehrerer Entitäten) und Start-End-to-Video (Keyframe-Interpolation zwischen zwei Standbildern) in den Stufen Standard, Pro und Turbo. Einige Varianten unterstützen Ausgaben bis 16 Sekunden.
Starten Sie mit Vidu Q4 auf WaveSpeedAI
Kostenlose Start-Credits bei der Registrierung. Ein API-Schlüssel für über 1.000 KI-Modelle von Shengshu und allen anderen Anbietern.