Vidu Q4 API
Shengshu Vidu Q4 — image-to-video e reference-to-video con clip da 3-16 secondi, output da 540p a 4K e audio generato opzionale. Reference-to-video accetta fino a 12 immagini di riferimento e fino a 3 clip audio di riferimento in un'unica richiesta.
Due endpoint: vidu/q4-preview/image-to-video anima una singola immagine, mentre vidu/q4-preview/reference-to-video costruisce una scena a partire da un prompt più fino a 12 immagini di riferimento e 3 clip audio di riferimento. Entrambi accettano qualsiasi durata in secondi interi da 3 a 16 secondi, cinque risoluzioni da 540p a 4K e un interruttore per l'audio.
Panoramica
Informazioni su Vidu Q4 API
Cosa fa Vidu Q4, come si inserisce nella gamma di modelli di Shengshu e perché i team lo scelgono.
Vidu Q4 è un modello di generazione video di Shengshu, disponibile tramite l'API REST di WaveSpeedAI. Shengshu Vidu Q4 — image-to-video e reference-to-video con clip da 3-16 secondi, output da 540p a 4K e audio generato opzionale. Reference-to-video accetta fino a 12 immagini di riferimento e fino a 3 clip audio di riferimento in un'unica richiesta.
Due endpoint: vidu/q4-preview/image-to-video anima una singola immagine, mentre vidu/q4-preview/reference-to-video costruisce una scena a partire da un prompt più fino a 12 immagini di riferimento e 3 clip audio di riferimento. Entrambi accettano qualsiasi durata in secondi interi da 3 a 16 secondi, cinque risoluzioni da 540p a 4K e un interruttore per l'audio.
La famiglia Vidu Q4 su WaveSpeedAI offre 2 endpoint REST che coprono i flussi di lavoro Reference-To-Video, Image-To-Video. Ogni variante ha il suo prezzo, i suoi parametri e i suoi esempi di output: scegli quella più adatta alla tua modalità di input e ai tuoi vincoli di produzione, oppure richiamane diverse con la stessa chiave API per comporre pipeline in più passaggi.
Usa Vidu Q4 con la stessa chiave API, lo stesso account di fatturazione e gli stessi limiti di frequenza che usi per gli altri oltre 1.000 modelli AI di WaveSpeedAI. Nessuna configurazione separata per fornitore, nessun SDK per provider, nessun limite di frequenza per fornitore: un'unica integrazione copre tutto, dal text-to-image e text-to-video alla sintesi audio, alla generazione 3D, all'upscaling e all'editing.
Specifiche
Funzionalità e stato di rilascio di Vidu Q4 API
I dettagli specifici del modello che gli sviluppatori cercano prima di scegliere un'API: disponibilità, durata prevista dell'output, supporto dei riferimenti e l'alternativa attiva al momento.
Endpoint
2 varianti
Image-to-video e reference-to-video.
Durata
3-16 s
Qualsiasi numero intero di secondi; il valore predefinito è 5 s.
Risoluzione
Da 540p a 4K
540p, 720p, 1080p, 2K, 4K; il valore predefinito è 720p.
Riferimenti
12 immagini + 3 audio
Su reference-to-video, insieme a un prompt testuale.
Endpoint
Tutti gli endpoint API Vidu Q4
2 endpoint Vidu Q4 disponibili ora su WaveSpeedAI: scegli la variante più adatta al tuo flusso di lavoro.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Esempi
Vidu Q4 in azione
Output reali generati dall'API Vidu Q4. Passa il mouse su un video per l'anteprima, clicca per aprire il visualizzatore a schermo intero.
Guida
Come usare l'API Vidu Q4
Quattro passaggi dalla registrazione alla generazione completata. Esempi completi in Python, Node.js e cURL sono nella sezione API qui sotto.
- 01
Ottieni una chiave API
Registrati su WaveSpeedAI e copia la tua chiave API dalla dashboard. I nuovi account includono crediti gratuiti di benvenuto: bastano per usare il playground qualche decina di volte prima che inizi la fatturazione.
- 02
Invia una predizione
Invia con POST il tuo input in formato JSON a https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. L'endpoint restituisce subito un id di predizione: le generazioni sono asincrone, quindi non devi tenere una connessione aperta durante l'inferenza.
- 03
Controlla il completamento
Fai GET su https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Restituisci gli output con completed; interrompi con un errore con failed, cancelled, timeout o deleted; continua il polling per ogni altro stato.
- 04
Leggi l'URL dell'output
Quando lo stato è "completed", leggi l'URL da data.outputs[0]. L'URL punta al tuo contenuto generato sulla CDN di WaveSpeedAI: immagine, video, audio o file 3D a seconda della variante di Vidu Q4 che hai richiamato.
Casi d'uso
Cosa puoi creare con Vidu Q4
I flussi di lavoro più comuni per cui sviluppatori e creator usano l'API Vidu Q4.
Animazione di prodotto da una sola foto
vidu/q4-preview/image-to-video trasforma un singolo scatto di prodotto in una clip promozionale. Descrivi il movimento di camera e il movimento che desideri; l'immagine resta l'ancora visiva.
Personaggi sempre fedeli al modello
vidu/q4-preview/reference-to-video accetta fino a 12 immagini di riferimento, così un personaggio ricorrente, una mascotte o un testimonial può essere mostrato da più angolazioni e restare riconoscibile in ogni clip.
Scene guidate dal suono
Aggiungi fino a 3 clip audio di riferimento tramite il campo audios insieme alle immagini e lascia attivo generate_audio per ottenere una clip con sonoro in una sola chiamata.
4K pronto per la consegna
Entrambi gli endpoint generano output a 540p, 720p, 1080p, 2K o 4K. Fai le bozze a 540p o 720p, poi rilancia il prompt approvato alla risoluzione di consegna senza un passaggio di upscaling separato.
Clip a misura di ritmo
La durata può essere qualsiasi numero intero di secondi da 3 a 16, così un loop da 3 secondi, un bumper da 6 secondi e uno spot da 15 secondi escono tutti dallo stesso endpoint.
Consigli
Consigli per scrivere i prompt per Vidu Q4
Consigli pratici per ottenere output migliori da Vidu Q4, ricavati dagli schemi che funzionano con i modelli video nelle pipeline di produzione.
- 01
Usa un'immagine sorgente pulita e ben illuminata
Con vidu/q4-preview/image-to-video è l'immagine a definire soggetto, inquadratura e stile. Scegli un'immagine nitida con un unico soggetto chiaro, poi usa il prompt per il movimento e la regia della camera invece di descrivere di nuovo ciò che è già visibile.
- 02
Dai a ogni riferimento un compito
Con vidu/q4-preview/reference-to-video, usa riferimenti che appartengono davvero alla scena — il personaggio, il prodotto, l'ambientazione — e spiega nel prompt come deve apparire ciascuno, invece di inviare immagini solo vagamente collegate.
- 03
Adatta l'azione alla durata
Chiedi una quantità di azione adeguata alla lunghezza della clip. Una clip da 3-5 secondi è adatta a un solo movimento o gesto; riserva le azioni in più fasi a 10-16 secondi.
- 04
Bozze in bassa, consegna in alta
Esplora le idee a 540p o 720p con durate brevi, poi rilancia il prompt scelto a 1080p, 2K o 4K per la consegna.
- 05
Decidi subito su audio e riscrittura del prompt
generate_audio è attivo per impostazione predefinita; disattivalo se aggiungerai una tua colonna sonora. Su image-to-video, imposta enable_prompt_expansion su false se vuoi che il prompt venga usato esattamente come scritto.
Prezzi
Prezzi dell'API Vidu Q4
Il prezzo è per output. L'addebito finale dipende dai parametri impostati nel playground di ciascuna variante (risoluzione, durata, numero di output, riferimenti).
| Endpoint | Tipo | Prezzo di partenza |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Richiama l'API Vidu Q4
Ottieni una chiave API su wavespeed.ai/accesskey, poi invia una predizione tramite REST. Il playground genera esempi pronti da incollare per qualsiasi combinazione di input.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Confronto
Vidu Q4 a confronto con le alternative
Quando scegliere Vidu Q4 rispetto a modelli simili su WaveSpeedAI.
Vidu Q4 vs Vidu Q3
Il reference-to-video di Vidu Q3 accetta 1-4 immagini di riferimento; Q4 ne accetta fino a 12 più fino a 3 riferimenti audio, ed entrambi gli endpoint Q4 arrivano al 4K. Q3 resta la scelta giusta per text-to-video, interpolazione tra keyframe iniziale e finale e i suoi livelli Pro e Turbo.
Vidu Q4 vs Seedance 2.5
Seedance 2.5 arriva a inquadrature singole fino a 30 secondi e aggiunge endpoint di editing ed estensione video. Vidu Q4 si concentra sulla generazione guidata da immagini e riferimenti, con output fino a 4K.
Vidu Q4 vs Wan 3.0
Wan 3.0 offre text-, image- e reference-to-video fino a 30 secondi e fino a 1080p. Vidu Q4 si ferma a 16 secondi, ma aggiunge output 2K e 4K e fino a 12 immagini di riferimento.
FAQ
Vidu Q4 API — Domande frequenti
Prezzi, licenza, integrazione: le domande più comuni sull'uso di Vidu Q4 su WaveSpeedAI.
Che cos'è l'API Vidu Q4?
Vidu Q4 è un modello di generazione video di Shengshu reso disponibile come API REST su WaveSpeedAI. Shengshu Vidu Q4 — image-to-video e reference-to-video con clip da 3-16 secondi, output da 540p a 4K e audio generato opzionale. Reference-to-video accetta fino a 12 immagini di riferimento e fino a 3 clip audio di riferimento in un'unica richiesta. Puoi richiamarlo da codice o provarlo dal playground collegato qui sopra.
Come richiamo l'API Vidu Q4?
Registrati su WaveSpeedAI, copia la tua chiave API da /accesskey, poi invia con POST a https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video il tuo input in formato JSON. L'endpoint restituisce un id di predizione. Fai polling sull'endpoint dei risultati circa ogni 2 secondi, aumenta l'intervallo per le attività di lunga durata e fermati a qualsiasi stato terminale. Gli esempi in Python / Node.js / cURL orientati alla produzione sono qui sopra.
Quanto costa l'API Vidu Q4?
Vidu Q4 parte da $0.25 per esecuzione. Il costo esatto dipende dai parametri impostati (risoluzione, durata, numero di output, riferimenti). L'anteprima del costo in tempo reale accanto al pulsante Genera nel playground mostra il prezzo esatto per il tuo input attuale.
Quali varianti di Vidu Q4 sono disponibili?
WaveSpeedAI offre 2 endpoint Vidu Q4 attivi: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Ogni variante ha la sua pagina playground e i suoi prezzi.
Posso usare gli output di Vidu Q4 a fini commerciali?
I diritti di uso commerciale seguono la licenza del modello di Shengshu. La maggior parte dei modelli di Shengshu consente l'uso commerciale degli output; consulta la pagina playground di ciascun modello per il riepilogo della licenza e i Termini di servizio di WaveSpeedAI per le condizioni a livello di piattaforma.
Perché usare Vidu Q4 su WaveSpeedAI invece di rivolgersi direttamente al fornitore?
Una sola chiave API e un solo account di fatturazione per Vidu Q4 E per oltre 1.000 altri modelli AI di altri provider. Nessuna configurazione di SDK per fornitore, nessun limite di frequenza separato, nessun codice di integrazione da riscrivere per ogni fornitore. I prezzi sono in genere in linea o inferiori a quelli dell'API diretta di Shengshu.
Provider
Informazioni su Shengshu
Il team dietro Vidu Q4 e dietro l'intera gamma di modelli di Shengshu su WaveSpeedAI.
Shengshu Technology è un laboratorio AI cinese nato dalla Tsinghua University, dietro la famiglia di modelli di generazione video Vidu. Vidu Q4, la generazione più recente, aggiunge image-to-video e reference-to-video con fino a 12 immagini di riferimento, fino a 3 clip audio di riferimento e output fino a 4K. Vidu Q3 offre text-to-video, image-to-video, reference-to-video (1-4 immagini di riferimento per la coerenza di più entità) e start-end-to-video (interpolazione di keyframe tra due still) nei livelli Standard, Pro e Turbo. Alcune varianti supportano output fino a 16 secondi.
Inizia a creare con Vidu Q4 su WaveSpeedAI
Crediti gratuiti di benvenuto alla registrazione. Una sola chiave API per oltre 1.000 modelli AI di Shengshu e di ogni altro provider.