Vidu Q3 API
Shengshu Vidu Q3 – Text-to-Video, Image-to-Video, Reference-to-Video (1–4 Referenzbilder für Konsistenz mehrerer Entitäten) und Start-End-to-Video. Drei Stufen: Standard, Pro, Turbo. Ausgaben bis 16 Sekunden bei einigen Varianten.
Stufen Standard, Pro (Ausgaben von 1–16 s) und Turbo (schneller). Reference-to-Video akzeptiert 1–4 Referenzbilder für Videos mit konsistenten Entitäten in 360p–1080p, bis zu 16 Sekunden. Start-End-to-Video verbindet zwei Keyframes (1–16 s bei Pro). Die Variante image-to-video-pro unterstützt 720p/1080p/2K/4K.
Überblick
Über Vidu Q3 API
Was Vidu Q3 leistet, wie es in die Modellpalette von Shengshu passt und warum Teams darauf zurückgreifen.
Vidu Q3 ist ein Modell von Shengshu für Videogenerierung, verfügbar über die WaveSpeedAI-REST-API. Shengshu Vidu Q3 – Text-to-Video, Image-to-Video, Reference-to-Video (1–4 Referenzbilder für Konsistenz mehrerer Entitäten) und Start-End-to-Video. Drei Stufen: Standard, Pro, Turbo. Ausgaben bis 16 Sekunden bei einigen Varianten.
Stufen Standard, Pro (Ausgaben von 1–16 s) und Turbo (schneller). Reference-to-Video akzeptiert 1–4 Referenzbilder für Videos mit konsistenten Entitäten in 360p–1080p, bis zu 16 Sekunden. Start-End-to-Video verbindet zwei Keyframes (1–16 s bei Pro). Die Variante image-to-video-pro unterstützt 720p/1080p/2K/4K.
Die Familie Vidu Q3 auf WaveSpeedAI umfasst 13 REST-Endpunkte für die Workflows Text-To-Video, Image-To-Video, Reference-To-Video. Jede Variante hat eigene Preise, Parameter und Beispielausgaben – wählen Sie die, die zu Ihrer Eingabemodalität und Ihren Produktionsanforderungen passt, oder rufen Sie mit demselben API-Schlüssel mehrere auf, um mehrstufige Pipelines zu bauen.
Nutzen Sie Vidu Q3 mit demselben API-Schlüssel, demselben Abrechnungskonto und denselben Rate Limits wie die über 1.000 weiteren KI-Modelle auf WaveSpeedAI. Keine separate Einrichtung bei Anbietern, keine SDKs pro Anbieter, keine Rate Limits pro Anbieter – eine Integration deckt alles ab, von Text-zu-Bild und Text-zu-Video über Audiosynthese, 3D-Generierung und Hochskalierung bis zur Bearbeitung.
Endpunkte
Alle Vidu Q3-API-Endpunkte
13 Vidu Q3-Endpunkte jetzt auf WaveSpeedAI verfügbar – wählen Sie die Variante, die zu Ihrem Workflow passt.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Beispiele
Vidu Q3 in Aktion
Echte Ausgaben der Vidu Q3-API. Fahren Sie über ein Video für eine Vorschau und klicken Sie, um den Viewer in voller Größe zu öffnen.
Anleitung
So verwenden Sie die Vidu Q3-API
Vier Schritte von der Registrierung bis zur fertigen Generierung. Vollständige Beispiele in Python, Node.js und cURL finden Sie unten im Abschnitt „API“.
- 01
API-Schlüssel holen
Registrieren Sie ein WaveSpeedAI-Konto und kopieren Sie Ihren API-Schlüssel aus dem Dashboard. Neue Konten erhalten kostenlose Start-Credits – genug, um den Playground einige Dutzend Mal zu nutzen, bevor die Abrechnung beginnt.
- 02
Prediction senden
Senden Sie Ihre Eingabe als JSON per POST an https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Der Endpunkt gibt sofort eine Prediction-ID zurück – Generierungen laufen asynchron, sodass Sie während der Inferenz keine Verbindung offen halten.
- 03
Auf Abschluss prüfen
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Geben Sie bei „completed“ die Ausgaben zurück; brechen Sie bei „failed“, „cancelled“, „timeout“ oder „deleted“ mit einem Fehler ab; fragen Sie bei allen anderen Status weiter ab.
- 04
Ausgabe-URL lesen
Sobald der Status „completed“ ist, lesen Sie die URL aus data.outputs[0]. Die URL verweist auf Ihre generierten Medien im WaveSpeedAI-CDN – Bild, Video, Audio oder 3D-Datei, je nach aufgerufener Variante von Vidu Q3.
Anwendungsfälle
Was Sie mit Vidu Q3 bauen können
Gängige Workflows, für die Entwickler und Kreative die Vidu Q3-API nutzen.
Reference-to-Video mit 1–4 Referenzen
vidu/q3/reference-to-video erzeugt Videos mit konsistenten Entitäten aus 1–4 Referenzbildern mit Text-Prompt als Vorgabe. Unterstützt 360p–1080p, bis zu 16 Sekunden und mehrere Seitenverhältnisse. Nützlich für Ensemble-Szenen, in denen mehrere referenzierte Motive kohärent bleiben müssen.
Keyframe-Interpolation zwischen Start und Ende
vidu/q3/start-end-to-video erzeugt Videos durch Interpolation zwischen zwei Keyframes. Die Stufen Pro und Turbo unterstützen Start-End ebenfalls mit Dauern von 1–16 s. Nützlich für Storyboards im Animatic-Stil, wenn Sie Start- und End-Standbild haben.
Ausgaben bis 16 Sekunden
Katalogangabe für Pro und die Reference-to-Video-Varianten: Dauer von 1–16 Sekunden. Länger als das 5–8-s-Fenster vieler konkurrierender Videomodelle – nützlich für ganze Erzählabschnitte in einer einzigen Generierung.
Image-to-Video in hoher Auflösung
vidu/q3/image-to-video-pro unterstützt 720p / 1080p / 2K / 4K aus Bildern. Nützlich für Ausgabe in Auslieferungsqualität ohne Upscaling-Durchgang, wenn Sie von einem Standbild ausgehen.
Pro-Stufe (die günstigste)
vidu/q3-pro/* ist die günstigste Vidu Q3-Stufe – nützlich für Arbeit in großen Mengen. Deckt Image-to-Video, Text-to-Video und Start-End-to-Video mit Ausgaben von 1–16 Sekunden ab.
Tipps
Tipps zum Prompting von Vidu Q3
Praktische Ratschläge für bessere Ausgaben von Vidu Q3 – abgeleitet aus Mustern, die bei Video-Modellen in Produktions-Pipelines funktionieren.
- 01
Die Unterstützung von 1–4 Referenzbildern für Szenen mit mehreren Entitäten nutzen
vidu/q3/reference-to-video akzeptiert 1–4 Referenzbilder für Videos mit konsistenten Entitäten und Text-Prompt als Vorgabe. Nützlich für Szenen mit Ensemble-Besetzung, Produktpräsentationen in Gruppen und Storyboards mit mehreren Motiven.
- 02
Start-End-Frame-Interpolation für Keyframe-Workflows
vidu/q3/start-end-to-video verbindet zwei Standbilder mit generierter Bewegung. Besonders nützlich für Arbeit im Animatic-Stil, Storyboarding anhand von Schlüsselposen und das Zusammenführen von Konzeptzeichnungen zu Bewegung, ohne jedes Segment neu zu prompten.
- 03
Die Stufe bewusst wählen
Standard ist die normale Auslieferungsstufe; die Pro-Stufe (Ausgaben von 1–16 Sekunden) ist für Arbeit in großen Mengen positioniert; die Turbo-Stufe priorisiert Tempo. Prüfen Sie die aktuelle Preistabelle auf dieser Seite für die Kosten je Stufe – die Pro-Stufe von Vidu Q3 ist ungewöhnlich konkurrenzfähig.
- 04
Ausgaben bis 16 Sekunden bei einigen Varianten
Katalogangabe für Pro und die Reference-to-Video-Varianten: Dauer von 1–16 Sekunden. Länger als das 5–8-s-Fenster vieler konkurrierender Videomodelle – nützlich für ganze Erzählabschnitte in einer einzigen Generierung.
- 05
image-to-video-pro für Ausgabe in hoher Auflösung
vidu/q3/image-to-video-pro unterstützt 720p / 1080p / 2K / 4K aus Bildern. Nützlich für Ausgabe in Auslieferungsqualität ohne Upscaling-Durchgang, wenn Sie von einem Standbild ausgehen.
Preise
Vidu Q3-API-Preise
Die Abrechnung erfolgt pro Ausgabe. Der Endpreis richtet sich nach den Parametern, die Sie im Playground jeder Variante setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen).
| Endpunkt | Typ | Startpreis |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Die Vidu Q3-API aufrufen
Holen Sie sich unter wavespeed.ai/accesskey einen API-Schlüssel und senden Sie dann eine Prediction per REST. Der Playground erzeugt einfügefertige Beispiele für jede Kombination von Eingaben.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Vergleich
Vidu Q3 im Vergleich zu Alternativen
Wann Sie Vidu Q3 ähnlichen Modellen auf WaveSpeedAI vorziehen sollten.
Vidu Q3 vs. Seedance 2.0
Seedance 2.0 bietet native Audiosynthese in jeder Variante und die Turbo-Stufe. Vidu Q3 ist deutlich günstiger und bietet Start-End-Interpolation als vollwertigen Endpunkt, den Seedance nicht hat.
Vidu Q3 vs. Kling 3.0
Kling 3.0 deckt Standard, Pro und 4K ab, mit Motion Control als Unter-Endpunkt. Vidu Q3 ist in den meisten Stufen günstiger und bietet Start-End-to-Video und Reference-to-Video (1–4 Referenzen) als Kernvarianten.
Vidu Q3 vs. Wan 2.7
Wan 2.7 bietet Reference-to-Video, Video-Edit, Video-Extend, Bildbearbeitung und Text-to-Image in derselben Familie. Vidu Q3 bleibt auf die Videogenerierung fokussiert, mit günstigeren Stufen und dem Workflow der Start-End-Interpolation.
FAQ
Vidu Q3 API — Häufig gestellte Fragen
Preise, Lizenz, Integration – häufige Fragen zur Nutzung von Vidu Q3 auf WaveSpeedAI.
Was ist die Vidu Q3-API?
Vidu Q3 ist ein Shengshu-Modell für Videogenerierung, das auf WaveSpeedAI als REST-API bereitgestellt wird. Shengshu Vidu Q3 – Text-to-Video, Image-to-Video, Reference-to-Video (1–4 Referenzbilder für Konsistenz mehrerer Entitäten) und Start-End-to-Video. Drei Stufen: Standard, Pro, Turbo. Ausgaben bis 16 Sekunden bei einigen Varianten. Sie können es programmatisch aufrufen oder im oben verlinkten Playground ausprobieren.
Wie rufe ich die Vidu Q3-API auf?
Registrieren Sie ein WaveSpeedAI-Konto, kopieren Sie Ihren API-Schlüssel von /accesskey und senden Sie dann per POST an https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video Ihre Eingabe als JSON. Der Endpunkt gibt eine Prediction-ID zurück. Fragen Sie den Ergebnis-Endpunkt etwa alle 2 Sekunden ab, verlängern Sie das Intervall bei lang laufenden Aufgaben und hören Sie bei jedem Endstatus auf. Produktionsnahe Beispiele in Python / Node.js / cURL finden Sie oben.
Was kostet die Vidu Q3-API?
Vidu Q3 beginnt bei $0.15 pro Aufruf. Die genauen Kosten richten sich nach den Parametern, die Sie setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen). Die Live-Kostenvorschau neben der Schaltfläche „Generieren“ im Playground zeigt den genauen Preis für Ihre aktuelle Eingabe.
Welche Varianten von Vidu Q3 sind verfügbar?
WaveSpeedAI stellt 13 aktive Vidu Q3-Endpunkte bereit: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video und weitere. Jede Variante hat eine eigene Playground-Seite und eigene Preise.
Kann ich die Ausgaben von Vidu Q3 kommerziell nutzen?
Die kommerziellen Nutzungsrechte richten sich nach der Modelllizenz von Shengshu. Die meisten Modelle von Shengshu erlauben die kommerzielle Nutzung der Ausgaben; die konkrete Lizenzzusammenfassung finden Sie auf der Playground-Seite des jeweiligen Modells, die Bedingungen auf Plattformebene in den Nutzungsbedingungen von WaveSpeedAI.
Warum Vidu Q3 auf WaveSpeedAI nutzen statt direkt?
Ein API-Schlüssel und ein Abrechnungskonto für Vidu Q3 UND über 1.000 weitere KI-Modelle anderer Anbieter. Keine SDK-Einrichtung pro Anbieter, keine separaten Rate Limits, kein Neuschreiben von Integrationscode pro Anbieter. Die Preise liegen in der Regel auf dem Niveau der direkten API von Shengshu oder darunter.
Anbieter
Über Shengshu
Das Team hinter Vidu Q3 und der übrigen Modellpalette von Shengshu auf WaveSpeedAI.
Shengshu Technology ist ein chinesisches KI-Labor, ausgegründet aus der Tsinghua-Universität, hinter der Vidu-Familie von Videogenerierungsmodellen. Vidu Q3 bietet Text-to-Video, Image-to-Video, Reference-to-Video (1–4 Referenzbilder für Konsistenz mehrerer Entitäten) und Start-End-to-Video (Keyframe-Interpolation zwischen zwei Standbildern) in den Stufen Standard, Pro und Turbo. Einige Varianten unterstützen Ausgaben bis 16 Sekunden.
Starten Sie mit Vidu Q3 auf WaveSpeedAI
Kostenlose Start-Credits bei der Registrierung. Ein API-Schlüssel für über 1.000 KI-Modelle von Shengshu und allen anderen Anbietern.