Vidu Q4 API
Shengshu Vidu Q4 — image vers vidéo et référence vers vidéo avec des clips de 3 à 16 secondes, une sortie de 540p à 4K et un audio généré en option. Référence vers vidéo accepte jusqu'à 12 images de référence et jusqu'à 3 clips audio de référence en une seule requête.
Deux endpoints : vidu/q4-preview/image-to-video anime une seule image, et vidu/q4-preview/reference-to-video construit une scène à partir d'un prompt et de jusqu'à 12 images de référence et 3 clips audio de référence. Les deux acceptent n'importe quelle durée en secondes entières de 3 à 16, cinq résolutions de 540p à 4K et une option audio.
Présentation
À propos de Vidu Q4 API
Ce que fait Vidu Q4, sa place dans la gamme de modèles Shengshu, et pourquoi les équipes l’adoptent.
Vidu Q4 est un modèle de génération vidéo proposé par Shengshu, disponible via l’API REST de WaveSpeedAI. Shengshu Vidu Q4 — image vers vidéo et référence vers vidéo avec des clips de 3 à 16 secondes, une sortie de 540p à 4K et un audio généré en option. Référence vers vidéo accepte jusqu'à 12 images de référence et jusqu'à 3 clips audio de référence en une seule requête.
Deux endpoints : vidu/q4-preview/image-to-video anime une seule image, et vidu/q4-preview/reference-to-video construit une scène à partir d'un prompt et de jusqu'à 12 images de référence et 3 clips audio de référence. Les deux acceptent n'importe quelle durée en secondes entières de 3 à 16, cinq résolutions de 540p à 4K et une option audio.
La famille Vidu Q4 sur WaveSpeedAI propose 2 points d’accès REST couvrant les workflows Reference-To-Video, Image-To-Video. Chaque variante a ses propres tarifs, paramètres et exemples de résultats — choisissez celle qui correspond à votre type d’entrée et à vos contraintes de production, ou appelez-en plusieurs avec la même clé API pour composer des pipelines en plusieurs étapes.
Exécutez Vidu Q4 avec la même clé API, le même compte de facturation et les mêmes limites de débit que pour les plus de 1 000 autres modèles IA de WaveSpeedAI. Pas de configuration fournisseur distincte, pas de SDK par fournisseur, pas de limites de débit par fournisseur — une seule intégration couvre tout, du texte vers image et du texte vers vidéo à la synthèse audio, la génération 3D, l’agrandissement et l’édition.
Caractéristiques
Capacités de Vidu Q4 API et état de sortie
Les détails propres au modèle que les développeurs recherchent avant de choisir une API : disponibilité, durée de sortie attendue, prise en charge des références et alternative active actuelle.
Endpoints
2 variantes
Image vers vidéo et référence vers vidéo.
Durée
3 à 16 s
N'importe quel nombre entier de secondes ; 5 s par défaut.
Résolution
540p à 4K
540p, 720p, 1080p, 2K, 4K ; 720p par défaut.
Références
12 images + 3 audios
Sur référence vers vidéo, en complément d'un prompt textuel.
Points d’accès
Tous les points d’accès de l’API Vidu Q4
2 points d’accès Vidu Q4 disponibles dès maintenant sur WaveSpeedAI — choisissez la variante qui correspond à votre workflow.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemples
Vidu Q4 en action
De vrais résultats générés par l’API Vidu Q4. Survolez une vidéo pour la prévisualiser, cliquez pour ouvrir la visionneuse en taille réelle.
Mode d’emploi
Comment utiliser l’API Vidu Q4
Quatre étapes de l’inscription à une génération terminée. Des exemples complets en Python, Node.js et cURL se trouvent dans la section API ci-dessous.
- 01
Obtenez une clé API
Créez un compte WaveSpeedAI et copiez votre clé API depuis le tableau de bord. Les nouveaux comptes reçoivent des crédits de démarrage gratuits — de quoi utiliser le playground quelques dizaines de fois avant le début de la facturation.
- 02
Soumettez une prédiction
Envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Le point d’accès renvoie immédiatement un identifiant de prédiction — les générations sont asynchrones, vous ne gardez donc pas de connexion ouverte pendant l’inférence.
- 03
Interrogez jusqu’à la fin
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retournez les outputs sur completed ; arrêtez avec une erreur sur failed, cancelled, timeout ou deleted ; continuez d’interroger pour tout autre statut.
- 04
Lisez l’URL du résultat
Une fois le statut "completed", lisez l’URL dans data.outputs[0]. Elle pointe vers votre média généré sur le CDN de WaveSpeedAI — fichier image, vidéo, audio ou 3D selon la variante Vidu Q4 appelée.
Cas d’usage
Ce que vous pouvez créer avec Vidu Q4
Les workflows courants pour lesquels développeurs et créateurs utilisent l’API Vidu Q4.
Animer un produit à partir d'une seule photo
vidu/q4-preview/image-to-video transforme une simple photo produit en clip promotionnel. Décrivez le mouvement de caméra et l'animation souhaités ; l'image reste l'ancrage visuel.
Des personnages qui restent fidèles
vidu/q4-preview/reference-to-video accepte jusqu'à 12 images de référence : un personnage récurrent, une mascotte ou un porte-parole peut ainsi être montré sous plusieurs angles et rester reconnaissable d'un clip à l'autre.
Des scènes guidées par le son
Ajoutez jusqu'à 3 clips audio de référence via le champ audios en plus de vos images, et laissez generate_audio activé pour obtenir un clip sonorisé en un seul appel.
De la 4K prête à livrer
Les deux endpoints produisent du 540p, 720p, 1080p, 2K ou 4K. Faites vos brouillons en 540p ou 720p, puis relancez le prompt validé à la résolution de livraison, sans passe d'upscale séparée.
Tous les formats sociaux
Référence vers vidéo génère en 16:9, 9:16, 1:1, 3:4 ou 4:3 et couvre YouTube, Reels, Shorts, publications de feed et pages produit à partir des mêmes références.
Des clips calés sur le rythme
La durée peut être n'importe quel nombre entier de secondes de 3 à 16 : une boucle de 3 secondes, un bumper de 6 secondes et un spot de 15 secondes sortent tous du même endpoint.
Conseils
Conseils pour rédiger vos prompts avec Vidu Q4
Des conseils pratiques pour obtenir de meilleurs résultats avec Vidu Q4 — tirés des pratiques qui fonctionnent sur les modèles vidéo dans les pipelines de production.
- 01
Partez d'une image source nette et bien éclairée
Avec vidu/q4-preview/image-to-video, l'image définit le sujet, le cadrage et le style. Choisissez une image nette avec un sujet unique et clair, puis utilisez le prompt pour le mouvement et la direction de caméra plutôt que pour redécrire ce qui est déjà visible.
- 02
Donnez un rôle à chaque référence
Avec vidu/q4-preview/reference-to-video, utilisez des références qui ont leur place dans la scène — le personnage, le produit, le décor — et précisez dans le prompt comment chacune doit apparaître, plutôt que d'envoyer des images vaguement liées.
- 03
Adaptez l'action à la durée
Demandez une quantité d'action adaptée à la longueur du clip. Un clip de 3 à 5 secondes convient à un mouvement ou un geste ; réservez les actions en plusieurs étapes aux durées de 10 à 16 secondes.
- 04
Brouillon en basse résolution, livraison en haute
Explorez vos idées en 540p ou 720p avec des durées courtes, puis relancez le prompt retenu en 1080p, 2K ou 4K pour la livraison.
- 05
Décidez dès le départ de l'audio et de la réécriture du prompt
generate_audio est activé par défaut ; désactivez-le si vous ajoutez votre propre bande-son. Sur image vers vidéo, définissez enable_prompt_expansion sur false si vous voulez que votre prompt soit utilisé tel quel.
Tarifs
Tarifs de l’API Vidu Q4
La tarification se fait par résultat. Le montant final dépend des paramètres définis dans le playground de chaque variante (résolution, durée, nombre de résultats, références).
| Point d’accès | Type | Prix de départ |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Appelez l’API Vidu Q4
Obtenez une clé API sur wavespeed.ai/accesskey, puis soumettez une prédiction via REST. Le playground génère des exemples prêts à copier pour toute combinaison d’entrées.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparer
Vidu Q4 face aux alternatives
Quand choisir Vidu Q4 plutôt que des modèles similaires sur WaveSpeedAI.
Vidu Q4 vs Vidu Q3
Référence vers vidéo de Vidu Q3 accepte 1 à 4 images de référence ; Q4 accepte jusqu'à 12 images et jusqu'à 3 références audio, et les deux endpoints Q4 montent jusqu'à la 4K. Q3 reste le bon choix pour texte vers vidéo, l'interpolation d'images clés début-fin et ses niveaux Pro et Turbo.
Vidu Q4 vs Seedance 2.5
Seedance 2.5 va jusqu'à des plans uniques de 30 secondes et ajoute des endpoints d'édition et d'extension vidéo. Vidu Q4 se concentre sur la génération pilotée par image et par références, avec une sortie jusqu'en 4K.
Vidu Q4 vs Wan 3.0
Wan 3.0 propose texte, image et référence vers vidéo jusqu'à 30 secondes et jusqu'en 1080p. Vidu Q4 plafonne à 16 secondes mais ajoute la sortie 2K et 4K et jusqu'à 12 images de référence.
FAQ
Vidu Q4 API — Questions fréquentes
Tarifs, licence, intégration — les questions courantes sur l’utilisation de Vidu Q4 sur WaveSpeedAI.
Qu’est-ce que l’API Vidu Q4 ?
Vidu Q4 est un modèle Shengshu de génération vidéo exposé sous forme d’API REST sur WaveSpeedAI. Shengshu Vidu Q4 — image vers vidéo et référence vers vidéo avec des clips de 3 à 16 secondes, une sortie de 540p à 4K et un audio généré en option. Référence vers vidéo accepte jusqu'à 12 images de référence et jusqu'à 3 clips audio de référence en une seule requête. Vous pouvez l’appeler par programmation ou l’essayer depuis le playground indiqué ci-dessus.
Comment appeler l’API Vidu Q4 ?
Créez un compte WaveSpeedAI, copiez votre clé API depuis /accesskey, puis envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Le point d’accès renvoie un identifiant de prédiction. Interrogez le point d’accès de résultat environ toutes les 2 secondes, augmentez l’intervalle pour les tâches longues et arrêtez-vous à tout statut final. Des exemples Python / Node.js / cURL orientés production figurent ci-dessus.
Combien coûte l’API Vidu Q4 ?
Vidu Q4 démarre à $0.25 par exécution. Le coût exact dépend des paramètres définis (résolution, durée, nombre de résultats, références). L’estimation en direct à côté du bouton Générer dans le playground affiche le prix exact pour votre saisie actuelle.
Quelles variantes de Vidu Q4 sont disponibles ?
WaveSpeedAI héberge 2 points d’accès Vidu Q4 actifs : vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Chaque variante a sa propre page playground et ses propres tarifs.
Puis-je utiliser commercialement les résultats de Vidu Q4 ?
Les droits d’usage commercial suivent la licence du modèle Shengshu. La plupart des modèles Shengshu autorisent l’usage commercial des résultats ; consultez la page playground de chaque modèle pour le résumé de sa licence, et les Conditions d’utilisation de WaveSpeedAI pour les conditions au niveau de la plateforme.
Pourquoi utiliser Vidu Q4 sur WaveSpeedAI plutôt qu’en direct ?
Une seule clé API et un seul compte de facturation pour Vidu Q4 ET plus de 1 000 autres modèles IA d’autres fournisseurs. Pas de configuration de SDK par fournisseur, pas de limites de débit distinctes, pas de code d’intégration à réécrire pour chaque fournisseur. Les tarifs sont généralement au niveau de l’API directe de Shengshu, ou en dessous.
Fournisseur
À propos de Shengshu
L’équipe derrière Vidu Q4 et la gamme plus large de modèles Shengshu sur WaveSpeedAI.
Shengshu Technology est un laboratoire d'IA chinois issu de l'université Tsinghua, à l'origine de la famille de modèles de génération vidéo Vidu. Vidu Q4, la génération la plus récente, apporte image vers vidéo et référence vers vidéo avec jusqu'à 12 images de référence, jusqu'à 3 clips audio de référence et une sortie jusqu'en 4K. Vidu Q3 propose texte vers vidéo, image vers vidéo, référence vers vidéo (1 à 4 images de référence pour la cohérence multi-entités) et start-end-to-video (interpolation entre deux images clés) aux niveaux Standard, Pro et Turbo. Certaines variantes prennent en charge des sorties jusqu'à 16 secondes.
Commencez à créer avec Vidu Q4 sur WaveSpeedAI
Crédits de démarrage gratuits à l’inscription. Une seule clé API pour plus de 1 000 modèles IA de Shengshu et de tous les autres fournisseurs.