Vidu Q3 API
Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 immagini di riferimento per la coerenza di più entità) e start-end-to-video. Tre livelli: Standard, Pro, Turbo. Output fino a 16 secondi su alcune varianti.
Livelli Standard, Pro (output da 1-16 s) e Turbo (più veloce). Reference-to-video accetta 1-4 immagini di riferimento per video con più entità coerenti a 360p-1080p, fino a 16 secondi. Start-end-to-video collega due keyframe (1-16 s su Pro). La variante image-to-video-pro supporta 720p/1080p/2K/4K.
Panoramica
Informazioni su Vidu Q3 API
Cosa fa Vidu Q3, come si inserisce nella gamma di modelli di Shengshu e perché i team lo scelgono.
Vidu Q3 è un modello di generazione video di Shengshu, disponibile tramite l'API REST di WaveSpeedAI. Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 immagini di riferimento per la coerenza di più entità) e start-end-to-video. Tre livelli: Standard, Pro, Turbo. Output fino a 16 secondi su alcune varianti.
Livelli Standard, Pro (output da 1-16 s) e Turbo (più veloce). Reference-to-video accetta 1-4 immagini di riferimento per video con più entità coerenti a 360p-1080p, fino a 16 secondi. Start-end-to-video collega due keyframe (1-16 s su Pro). La variante image-to-video-pro supporta 720p/1080p/2K/4K.
La famiglia Vidu Q3 su WaveSpeedAI offre 13 endpoint REST che coprono i flussi di lavoro Text-To-Video, Image-To-Video, Reference-To-Video. Ogni variante ha il suo prezzo, i suoi parametri e i suoi esempi di output: scegli quella più adatta alla tua modalità di input e ai tuoi vincoli di produzione, oppure richiamane diverse con la stessa chiave API per comporre pipeline in più passaggi.
Usa Vidu Q3 con la stessa chiave API, lo stesso account di fatturazione e gli stessi limiti di frequenza che usi per gli altri oltre 1.000 modelli AI di WaveSpeedAI. Nessuna configurazione separata per fornitore, nessun SDK per provider, nessun limite di frequenza per fornitore: un'unica integrazione copre tutto, dal text-to-image e text-to-video alla sintesi audio, alla generazione 3D, all'upscaling e all'editing.
Endpoint
Tutti gli endpoint API Vidu Q3
13 endpoint Vidu Q3 disponibili ora su WaveSpeedAI: scegli la variante più adatta al tuo flusso di lavoro.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Esempi
Vidu Q3 in azione
Output reali generati dall'API Vidu Q3. Passa il mouse su un video per l'anteprima, clicca per aprire il visualizzatore a schermo intero.
Guida
Come usare l'API Vidu Q3
Quattro passaggi dalla registrazione alla generazione completata. Esempi completi in Python, Node.js e cURL sono nella sezione API qui sotto.
- 01
Ottieni una chiave API
Registrati su WaveSpeedAI e copia la tua chiave API dalla dashboard. I nuovi account includono crediti gratuiti di benvenuto: bastano per usare il playground qualche decina di volte prima che inizi la fatturazione.
- 02
Invia una predizione
Invia con POST il tuo input in formato JSON a https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. L'endpoint restituisce subito un id di predizione: le generazioni sono asincrone, quindi non devi tenere una connessione aperta durante l'inferenza.
- 03
Controlla il completamento
Fai GET su https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Restituisci gli output con completed; interrompi con un errore con failed, cancelled, timeout o deleted; continua il polling per ogni altro stato.
- 04
Leggi l'URL dell'output
Quando lo stato è "completed", leggi l'URL da data.outputs[0]. L'URL punta al tuo contenuto generato sulla CDN di WaveSpeedAI: immagine, video, audio o file 3D a seconda della variante di Vidu Q3 che hai richiamato.
Casi d'uso
Cosa puoi creare con Vidu Q3
I flussi di lavoro più comuni per cui sviluppatori e creator usano l'API Vidu Q3.
Reference-to-video con 1-4 riferimenti
vidu/q3/reference-to-video genera video con più entità coerenti da 1-4 immagini di riferimento con guida del prompt testuale. Supporta 360p-1080p, fino a 16 secondi, più proporzioni. Utile per scene corali in cui più soggetti di riferimento devono restare coerenti.
Interpolazione tra keyframe iniziale e finale
vidu/q3/start-end-to-video crea video interpolando tra due keyframe. Anche i livelli Pro e Turbo supportano start-end con durate di 1-16 s. Utile per storyboard in stile animatic quando si dispone degli still iniziale e finale.
Output fino a 16 secondi
Dichiarazione a catalogo per le varianti Pro e reference-to-video: durata di 1-16 secondi. Più lunga della finestra di 5-8 s di molti modelli video concorrenti — utile per momenti narrativi completi in una sola generazione.
Image-to-video ad alta risoluzione
vidu/q3/image-to-video-pro supporta 720p / 1080p / 2K / 4K da immagini. Utile per un output da consegna senza passaggio di upscaling quando si parte da uno still.
Livello Pro (il più economico)
vidu/q3-pro/* è il livello Vidu Q3 più economico — utile per il lavoro ad alto volume. Copre image-to-video, text-to-video e start-end-to-video con output di 1-16 secondi.
Consigli
Consigli per scrivere i prompt per Vidu Q3
Consigli pratici per ottenere output migliori da Vidu Q3, ricavati dagli schemi che funzionano con i modelli video nelle pipeline di produzione.
- 01
Sfrutta il supporto a 1-4 immagini di riferimento per scene con più entità
vidu/q3/reference-to-video accetta 1-4 immagini di riferimento per video con più entità coerenti, con guida del prompt testuale. Utile per scene con cast corale, presentazioni di gruppo di prodotti e storyboard multi-soggetto.
- 02
Interpolazione tra frame iniziale e finale per workflow a keyframe
vidu/q3/start-end-to-video collega due still con movimento generato. Particolarmente utile per lavori in stile animatic, storyboard basati su pose chiave e per trasformare concept art in movimento senza riscrivere il prompt per ogni segmento.
- 03
Scegli il livello con consapevolezza
Standard è il livello di consegna predefinito; il livello Pro (output di 1-16 secondi) è posizionato per il lavoro ad alto volume; il livello Turbo privilegia la velocità. Controlla la tabella dei prezzi aggiornata in questa pagina per il costo attuale di ogni livello — il livello Pro di Vidu Q3 è insolitamente competitivo.
- 04
Output fino a 16 secondi su alcune varianti
Dichiarazione a catalogo per le varianti Pro e reference-to-video: durata di 1-16 secondi. Più lunga della finestra di 5-8 s di molti modelli video concorrenti — utile per momenti narrativi completi in una sola generazione.
- 05
image-to-video-pro per l'output ad alta risoluzione
vidu/q3/image-to-video-pro supporta risoluzioni 720p / 1080p / 2K / 4K da immagini. Utile per un output da consegna senza passaggio di upscaling quando si parte da uno still.
Prezzi
Prezzi dell'API Vidu Q3
Il prezzo è per output. L'addebito finale dipende dai parametri impostati nel playground di ciascuna variante (risoluzione, durata, numero di output, riferimenti).
| Endpoint | Tipo | Prezzo di partenza |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Richiama l'API Vidu Q3
Ottieni una chiave API su wavespeed.ai/accesskey, poi invia una predizione tramite REST. Il playground genera esempi pronti da incollare per qualsiasi combinazione di input.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Confronto
Vidu Q3 a confronto con le alternative
Quando scegliere Vidu Q3 rispetto a modelli simili su WaveSpeedAI.
Vidu Q3 vs Seedance 2.0
Seedance 2.0 offre sintesi audio nativa in ogni variante e il livello Turbo. Vidu Q3 costa nettamente meno e offre l'interpolazione start-end come endpoint di prima classe, che Seedance non ha.
Vidu Q3 vs Kling 3.0
Kling 3.0 copre Standard, Pro e 4K con il controllo del movimento come sotto-endpoint. Vidu Q3 costa meno nella maggior parte dei livelli e offre start-end-to-video e reference-to-video (1-4 riferimenti) come varianti principali.
Vidu Q3 vs Wan 2.7
Wan 2.7 offre reference-to-video, video-edit, video-extend, image-edit e text-to-image nella stessa famiglia. Vidu Q3 resta concentrato sulla generazione video con livelli più economici e il workflow di interpolazione start-end.
FAQ
Vidu Q3 API — Domande frequenti
Prezzi, licenza, integrazione: le domande più comuni sull'uso di Vidu Q3 su WaveSpeedAI.
Che cos'è l'API Vidu Q3?
Vidu Q3 è un modello di generazione video di Shengshu reso disponibile come API REST su WaveSpeedAI. Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 immagini di riferimento per la coerenza di più entità) e start-end-to-video. Tre livelli: Standard, Pro, Turbo. Output fino a 16 secondi su alcune varianti. Puoi richiamarlo da codice o provarlo dal playground collegato qui sopra.
Come richiamo l'API Vidu Q3?
Registrati su WaveSpeedAI, copia la tua chiave API da /accesskey, poi invia con POST a https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video il tuo input in formato JSON. L'endpoint restituisce un id di predizione. Fai polling sull'endpoint dei risultati circa ogni 2 secondi, aumenta l'intervallo per le attività di lunga durata e fermati a qualsiasi stato terminale. Gli esempi in Python / Node.js / cURL orientati alla produzione sono qui sopra.
Quanto costa l'API Vidu Q3?
Vidu Q3 parte da $0.15 per esecuzione. Il costo esatto dipende dai parametri impostati (risoluzione, durata, numero di output, riferimenti). L'anteprima del costo in tempo reale accanto al pulsante Genera nel playground mostra il prezzo esatto per il tuo input attuale.
Quali varianti di Vidu Q3 sono disponibili?
WaveSpeedAI offre 13 endpoint Vidu Q3 attivi: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, e altri. Ogni variante ha la sua pagina playground e i suoi prezzi.
Posso usare gli output di Vidu Q3 a fini commerciali?
I diritti di uso commerciale seguono la licenza del modello di Shengshu. La maggior parte dei modelli di Shengshu consente l'uso commerciale degli output; consulta la pagina playground di ciascun modello per il riepilogo della licenza e i Termini di servizio di WaveSpeedAI per le condizioni a livello di piattaforma.
Perché usare Vidu Q3 su WaveSpeedAI invece di rivolgersi direttamente al fornitore?
Una sola chiave API e un solo account di fatturazione per Vidu Q3 E per oltre 1.000 altri modelli AI di altri provider. Nessuna configurazione di SDK per fornitore, nessun limite di frequenza separato, nessun codice di integrazione da riscrivere per ogni fornitore. I prezzi sono in genere in linea o inferiori a quelli dell'API diretta di Shengshu.
Provider
Informazioni su Shengshu
Il team dietro Vidu Q3 e dietro l'intera gamma di modelli di Shengshu su WaveSpeedAI.
Shengshu Technology è un laboratorio AI cinese nato dalla Tsinghua University, dietro la famiglia di modelli di generazione video Vidu. Vidu Q3 offre text-to-video, image-to-video, reference-to-video (1-4 immagini di riferimento per la coerenza di più entità) e start-end-to-video (interpolazione di keyframe tra due still) nei livelli Standard, Pro e Turbo. Alcune varianti supportano output fino a 16 secondi.
Inizia a creare con Vidu Q3 su WaveSpeedAI
Crediti gratuiti di benvenuto alla registrazione. Una sola chiave API per oltre 1.000 modelli AI di Shengshu e di ogni altro provider.