Vidu Q3 API
Shengshu Vidu Q3 — texte vers vidéo, image vers vidéo, référence vers vidéo (1 à 4 images de référence pour la cohérence multi-entités) et start-end-to-video. Trois niveaux : Standard, Pro, Turbo. Sorties jusqu'à 16 secondes sur certaines variantes.
Niveaux Standard, Pro (sorties de 1 à 16 s) et Turbo (plus rapide). Référence vers vidéo accepte 1 à 4 images de référence pour des vidéos multi-entités cohérentes de 360p à 1080p, jusqu'à 16 secondes. Start-end-to-video relie deux images clés (1 à 16 s en Pro). La variante image-to-video-pro prend en charge 720p/1080p/2K/4K.
Présentation
À propos de Vidu Q3 API
Ce que fait Vidu Q3, sa place dans la gamme de modèles Shengshu, et pourquoi les équipes l’adoptent.
Vidu Q3 est un modèle de génération vidéo proposé par Shengshu, disponible via l’API REST de WaveSpeedAI. Shengshu Vidu Q3 — texte vers vidéo, image vers vidéo, référence vers vidéo (1 à 4 images de référence pour la cohérence multi-entités) et start-end-to-video. Trois niveaux : Standard, Pro, Turbo. Sorties jusqu'à 16 secondes sur certaines variantes.
Niveaux Standard, Pro (sorties de 1 à 16 s) et Turbo (plus rapide). Référence vers vidéo accepte 1 à 4 images de référence pour des vidéos multi-entités cohérentes de 360p à 1080p, jusqu'à 16 secondes. Start-end-to-video relie deux images clés (1 à 16 s en Pro). La variante image-to-video-pro prend en charge 720p/1080p/2K/4K.
La famille Vidu Q3 sur WaveSpeedAI propose 13 points d’accès REST couvrant les workflows Text-To-Video, Image-To-Video, Reference-To-Video. Chaque variante a ses propres tarifs, paramètres et exemples de résultats — choisissez celle qui correspond à votre type d’entrée et à vos contraintes de production, ou appelez-en plusieurs avec la même clé API pour composer des pipelines en plusieurs étapes.
Exécutez Vidu Q3 avec la même clé API, le même compte de facturation et les mêmes limites de débit que pour les plus de 1 000 autres modèles IA de WaveSpeedAI. Pas de configuration fournisseur distincte, pas de SDK par fournisseur, pas de limites de débit par fournisseur — une seule intégration couvre tout, du texte vers image et du texte vers vidéo à la synthèse audio, la génération 3D, l’agrandissement et l’édition.
Points d’accès
Tous les points d’accès de l’API Vidu Q3
13 points d’accès Vidu Q3 disponibles dès maintenant sur WaveSpeedAI — choisissez la variante qui correspond à votre workflow.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemples
Vidu Q3 en action
De vrais résultats générés par l’API Vidu Q3. Survolez une vidéo pour la prévisualiser, cliquez pour ouvrir la visionneuse en taille réelle.
Mode d’emploi
Comment utiliser l’API Vidu Q3
Quatre étapes de l’inscription à une génération terminée. Des exemples complets en Python, Node.js et cURL se trouvent dans la section API ci-dessous.
- 01
Obtenez une clé API
Créez un compte WaveSpeedAI et copiez votre clé API depuis le tableau de bord. Les nouveaux comptes reçoivent des crédits de démarrage gratuits — de quoi utiliser le playground quelques dizaines de fois avant le début de la facturation.
- 02
Soumettez une prédiction
Envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Le point d’accès renvoie immédiatement un identifiant de prédiction — les générations sont asynchrones, vous ne gardez donc pas de connexion ouverte pendant l’inférence.
- 03
Interrogez jusqu’à la fin
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retournez les outputs sur completed ; arrêtez avec une erreur sur failed, cancelled, timeout ou deleted ; continuez d’interroger pour tout autre statut.
- 04
Lisez l’URL du résultat
Une fois le statut "completed", lisez l’URL dans data.outputs[0]. Elle pointe vers votre média généré sur le CDN de WaveSpeedAI — fichier image, vidéo, audio ou 3D selon la variante Vidu Q3 appelée.
Cas d’usage
Ce que vous pouvez créer avec Vidu Q3
Les workflows courants pour lesquels développeurs et créateurs utilisent l’API Vidu Q3.
Référence vers vidéo avec 1 à 4 références
vidu/q3/reference-to-video génère des vidéos multi-entités cohérentes à partir de 1 à 4 images de référence guidées par un prompt textuel. Prend en charge de 360p à 1080p, jusqu'à 16 secondes, plusieurs formats d'image. Utile pour les scènes d'ensemble où plusieurs sujets référencés doivent rester cohérents.
Interpolation entre images clés de début et de fin
vidu/q3/start-end-to-video crée des vidéos en interpolant entre deux images clés. Les niveaux Pro et Turbo prennent aussi en charge début-fin avec des durées de 1 à 16 s. Utile pour le storyboarding de type animatique lorsque vous disposez des images de début et de fin.
Sorties jusqu'à 16 secondes
Affirmation du catalogue pour les variantes Pro et référence vers vidéo : durée de 1 à 16 secondes. Plus long que la fenêtre de 5 à 8 s de nombreux modèles vidéo concurrents — utile pour des séquences narratives complètes en une seule génération.
Image vers vidéo haute résolution
vidu/q3/image-to-video-pro prend en charge 720p / 1080p / 2K / 4K à partir d'images. Utile pour une sortie de qualité livrable sans passe d'upscale lorsque l'on part d'une image fixe.
Niveau Pro (le moins cher)
vidu/q3-pro/* est le niveau Vidu Q3 le moins cher — utile pour le travail à gros volume. Couvre image vers vidéo, texte vers vidéo et start-end-to-video avec des sorties de 1 à 16 secondes.
Conseils
Conseils pour rédiger vos prompts avec Vidu Q3
Des conseils pratiques pour obtenir de meilleurs résultats avec Vidu Q3 — tirés des pratiques qui fonctionnent sur les modèles vidéo dans les pipelines de production.
- 01
Utilisez la prise en charge de 1 à 4 images de référence pour les scènes multi-entités
vidu/q3/reference-to-video accepte 1 à 4 images de référence pour des vidéos multi-entités cohérentes, guidées par un prompt textuel. Utile pour les scènes de distribution d'ensemble, les présentations de produits en groupe et les storyboards multi-sujets.
- 02
Interpolation entre frames de début et de fin pour les workflows par images clés
vidu/q3/start-end-to-video relie deux images fixes par un mouvement généré. Particulièrement utile pour le travail de type animatique, le storyboarding piloté par poses clés et pour transformer du concept art en mouvement sans re-prompter chaque segment.
- 03
Choisissez le niveau à bon escient
Standard est le niveau de livraison par défaut ; le niveau Pro (sorties de 1 à 16 secondes) est positionné pour le gros volume ; le niveau Turbo privilégie la vitesse. Consultez le tableau des tarifs de cette page pour le coût actuel de chaque niveau — le niveau Pro de Vidu Q3 est exceptionnellement compétitif.
- 04
Sorties jusqu'à 16 secondes sur certaines variantes
Affirmation du catalogue pour les variantes Pro et référence vers vidéo : durée de 1 à 16 secondes. Plus long que la fenêtre de 5 à 8 s de nombreux modèles vidéo concurrents — utile pour des séquences narratives complètes en une seule génération.
- 05
image-to-video-pro pour une sortie haute résolution
vidu/q3/image-to-video-pro prend en charge les résolutions 720p / 1080p / 2K / 4K à partir d'images. Utile pour une sortie de qualité livrable sans passe d'upscale lorsque l'on part d'une image fixe.
Tarifs
Tarifs de l’API Vidu Q3
La tarification se fait par résultat. Le montant final dépend des paramètres définis dans le playground de chaque variante (résolution, durée, nombre de résultats, références).
| Point d’accès | Type | Prix de départ |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Appelez l’API Vidu Q3
Obtenez une clé API sur wavespeed.ai/accesskey, puis soumettez une prédiction via REST. Le playground génère des exemples prêts à copier pour toute combinaison d’entrées.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparer
Vidu Q3 face aux alternatives
Quand choisir Vidu Q3 plutôt que des modèles similaires sur WaveSpeedAI.
Vidu Q3 vs Seedance 2.0
Seedance 2.0 propose la synthèse audio native dans chaque variante et le niveau Turbo. Vidu Q3 est nettement moins cher et propose l'interpolation début-fin comme endpoint à part entière, ce que Seedance n'a pas.
Vidu Q3 vs Kling 3.0
Kling 3.0 couvre Standard, Pro et 4K avec le contrôle du mouvement en sous-endpoint. Vidu Q3 est moins cher sur la plupart des niveaux et propose start-end-to-video et référence vers vidéo (1 à 4 références) comme variantes principales.
Vidu Q3 vs Wan 2.7
Wan 2.7 réunit référence vers vidéo, video-edit, video-extend, image-edit et texte vers image dans la même famille. Vidu Q3 reste centré sur la génération vidéo, avec des niveaux moins chers et le workflow d'interpolation début-fin.
FAQ
Vidu Q3 API — Questions fréquentes
Tarifs, licence, intégration — les questions courantes sur l’utilisation de Vidu Q3 sur WaveSpeedAI.
Qu’est-ce que l’API Vidu Q3 ?
Vidu Q3 est un modèle Shengshu de génération vidéo exposé sous forme d’API REST sur WaveSpeedAI. Shengshu Vidu Q3 — texte vers vidéo, image vers vidéo, référence vers vidéo (1 à 4 images de référence pour la cohérence multi-entités) et start-end-to-video. Trois niveaux : Standard, Pro, Turbo. Sorties jusqu'à 16 secondes sur certaines variantes. Vous pouvez l’appeler par programmation ou l’essayer depuis le playground indiqué ci-dessus.
Comment appeler l’API Vidu Q3 ?
Créez un compte WaveSpeedAI, copiez votre clé API depuis /accesskey, puis envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Le point d’accès renvoie un identifiant de prédiction. Interrogez le point d’accès de résultat environ toutes les 2 secondes, augmentez l’intervalle pour les tâches longues et arrêtez-vous à tout statut final. Des exemples Python / Node.js / cURL orientés production figurent ci-dessus.
Combien coûte l’API Vidu Q3 ?
Vidu Q3 démarre à $0.15 par exécution. Le coût exact dépend des paramètres définis (résolution, durée, nombre de résultats, références). L’estimation en direct à côté du bouton Générer dans le playground affiche le prix exact pour votre saisie actuelle.
Quelles variantes de Vidu Q3 sont disponibles ?
WaveSpeedAI héberge 13 points d’accès Vidu Q3 actifs : vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, et d’autres. Chaque variante a sa propre page playground et ses propres tarifs.
Puis-je utiliser commercialement les résultats de Vidu Q3 ?
Les droits d’usage commercial suivent la licence du modèle Shengshu. La plupart des modèles Shengshu autorisent l’usage commercial des résultats ; consultez la page playground de chaque modèle pour le résumé de sa licence, et les Conditions d’utilisation de WaveSpeedAI pour les conditions au niveau de la plateforme.
Pourquoi utiliser Vidu Q3 sur WaveSpeedAI plutôt qu’en direct ?
Une seule clé API et un seul compte de facturation pour Vidu Q3 ET plus de 1 000 autres modèles IA d’autres fournisseurs. Pas de configuration de SDK par fournisseur, pas de limites de débit distinctes, pas de code d’intégration à réécrire pour chaque fournisseur. Les tarifs sont généralement au niveau de l’API directe de Shengshu, ou en dessous.
Fournisseur
À propos de Shengshu
L’équipe derrière Vidu Q3 et la gamme plus large de modèles Shengshu sur WaveSpeedAI.
Shengshu Technology est un laboratoire d'IA chinois issu de l'université Tsinghua, à l'origine de la famille de modèles de génération vidéo Vidu. Vidu Q3 propose texte vers vidéo, image vers vidéo, référence vers vidéo (1 à 4 images de référence pour la cohérence multi-entités) et start-end-to-video (interpolation entre deux images clés) aux niveaux Standard, Pro et Turbo. Certaines variantes prennent en charge des sorties jusqu'à 16 secondes.
Commencez à créer avec Vidu Q3 sur WaveSpeedAI
Crédits de démarrage gratuits à l’inscription. Une seule clé API pour plus de 1 000 modèles IA de Shengshu et de tous les autres fournisseurs.