Vidu Q3 API
Vidu Q3 de Shengshu: texto a vídeo, imagen a vídeo, referencia a vídeo (de 1 a 4 imágenes de referencia para consistencia de varias entidades) y start-end-to-video. Tres niveles: Standard, Pro y Turbo. Salidas de hasta 16 segundos en algunas variantes.
Niveles Standard, Pro (salidas de 1 a 16 s) y Turbo (más rápido). Referencia a vídeo acepta de 1 a 4 imágenes de referencia para vídeos con varias entidades consistentes, de 360p a 1080p y hasta 16 segundos. Start-end-to-video une dos fotogramas clave (1-16 s en Pro). La variante image-to-video-pro admite 720p/1080p/2K/4K.
Resumen
Acerca de Vidu Q3 API
Qué hace Vidu Q3, cómo encaja en la gama de modelos de Shengshu y por qué los equipos lo eligen.
Vidu Q3 es un modelo de generación de vídeo de Shengshu, disponible a través de la API REST de WaveSpeedAI. Vidu Q3 de Shengshu: texto a vídeo, imagen a vídeo, referencia a vídeo (de 1 a 4 imágenes de referencia para consistencia de varias entidades) y start-end-to-video. Tres niveles: Standard, Pro y Turbo. Salidas de hasta 16 segundos en algunas variantes.
Niveles Standard, Pro (salidas de 1 a 16 s) y Turbo (más rápido). Referencia a vídeo acepta de 1 a 4 imágenes de referencia para vídeos con varias entidades consistentes, de 360p a 1080p y hasta 16 segundos. Start-end-to-video une dos fotogramas clave (1-16 s en Pro). La variante image-to-video-pro admite 720p/1080p/2K/4K.
La familia Vidu Q3 en WaveSpeedAI incluye 13 endpoints REST que cubren los flujos de trabajo de Text-To-Video, Image-To-Video, Reference-To-Video. Cada variante tiene su propio precio, parámetros y ejemplos de resultados: elige la que se ajuste a tu modalidad de entrada y a tus requisitos de producción, o llama a varias con la misma clave de API para componer flujos de varios pasos.
Ejecuta Vidu Q3 con la misma clave de API, la misma cuenta de facturación y los mismos límites de uso que ya usas para los demás más de 1.000 modelos de IA de WaveSpeedAI. Sin configuración aparte por proveedor, sin SDK por proveedor, sin límites de uso distintos por proveedor: una sola integración lo cubre todo, desde texto a imagen y texto a vídeo hasta síntesis de audio, generación 3D, escalado y edición.
Endpoints
Todos los endpoints de la API de Vidu Q3
13 endpoints de Vidu Q3 disponibles ahora en WaveSpeedAI: elige la variante que se ajuste a tu flujo de trabajo.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ejemplos
Mira Vidu Q3 en acción
Resultados reales generados con la API de Vidu Q3. Pasa el cursor sobre cualquier vídeo para previsualizarlo y haz clic para abrir el visor a tamaño completo.
Cómo empezar
Cómo usar la API de Vidu Q3
Cuatro pasos desde el registro hasta una generación terminada. Encontrarás ejemplos completos en Python, Node.js y cURL en la sección de API más abajo.
- 01
Obtén una clave de API
Regístrate en WaveSpeedAI y copia tu clave de API desde el panel. Las cuentas nuevas incluyen créditos gratuitos para empezar: suficientes para usar el playground unas decenas de veces antes de que empiece la facturación.
- 02
Envía una predicción
Haz POST de tu entrada como JSON a https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. El endpoint devuelve un id de predicción de inmediato: las generaciones son asíncronas, así que no mantienes una conexión abierta durante la inferencia.
- 03
Consulta hasta que termine
Haz GET a https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Devuelve los resultados con completed; detente con un error en failed, cancelled, timeout o deleted; sigue consultando con cualquier otro estado.
- 04
Lee la URL del resultado
Cuando status sea "completed", lee la URL de data.outputs[0]. La URL apunta a tu contenido generado en la CDN de WaveSpeedAI: imagen, vídeo, audio o archivo 3D según la variante de Vidu Q3 que hayas llamado.
Casos de uso
Qué puedes crear con Vidu Q3
Flujos de trabajo habituales para los que desarrolladores y creadores usan la API de Vidu Q3.
Referencia a vídeo con 1-4 referencias
vidu/q3/reference-to-video genera vídeos con varias entidades consistentes a partir de 1 a 4 imágenes de referencia y guía de un prompt de texto. Admite de 360p a 1080p, hasta 16 segundos y varias relaciones de aspecto. Útil para escenas corales en las que varios sujetos de referencia deben mantenerse coherentes.
Interpolación entre fotogramas clave inicial y final
vidu/q3/start-end-to-video crea vídeos interpolando entre dos fotogramas clave. Los niveles Pro y Turbo también admiten inicio-fin con duraciones de 1 a 16 s. Útil para storyboards al estilo animática cuando se tienen las imágenes inicial y final.
Salidas de hasta 16 segundos
Afirmación del catálogo sobre las variantes Pro y de referencia a vídeo: duración de 1 a 16 segundos. Más larga que la ventana de 5-8 s de muchos modelos de vídeo de la competencia; útil para momentos narrativos completos en una sola generación.
Imagen a vídeo en alta resolución
vidu/q3/image-to-video-pro admite 720p / 1080p / 2K / 4K a partir de imágenes. Útil para obtener una salida lista para entregar sin pasar por un escalado cuando se parte de una imagen fija.
Nivel Pro (el más barato)
vidu/q3-pro/* es el nivel más barato de Vidu Q3, útil para trabajo en volumen. Cubre imagen a vídeo, texto a vídeo y start-end-to-video con salidas de 1 a 16 segundos.
Consejos
Consejos para escribir prompts en Vidu Q3
Consejos prácticos para obtener mejores resultados con Vidu Q3, basados en los patrones que funcionan en modelos de vídeo en flujos de producción.
- 01
Aprovecha la compatibilidad con 1-4 imágenes de referencia en escenas con varias entidades
vidu/q3/reference-to-video acepta de 1 a 4 imágenes de referencia para vídeos con varias entidades consistentes, con guía de un prompt de texto. Útil para escenas corales, presentaciones de producto en grupo y storyboards con varios sujetos.
- 02
Interpolación entre fotogramas inicial y final para flujos de fotogramas clave
vidu/q3/start-end-to-video une dos imágenes fijas con movimiento generado. Especialmente útil para trabajo al estilo animática, storyboards basados en poses clave y para convertir arte conceptual en movimiento sin volver a escribir un prompt para cada segmento.
- 03
Elige el nivel con criterio
Standard es el nivel de entrega por defecto; el nivel Pro (salidas de 1 a 16 segundos) está pensado para trabajo en volumen; el nivel Turbo prioriza la velocidad. Consulta la tabla de precios en vivo de esta página para ver el coste actual por nivel: el nivel Pro de Vidu Q3 es especialmente competitivo.
- 04
Salidas de hasta 16 segundos en algunas variantes
Afirmación del catálogo sobre las variantes Pro y de referencia a vídeo: duración de 1 a 16 segundos. Más larga que la ventana de 5-8 s de muchos modelos de vídeo de la competencia; útil para momentos narrativos completos en una sola generación.
- 05
image-to-video-pro para salida de alta resolución
vidu/q3/image-to-video-pro admite resoluciones de 720p / 1080p / 2K / 4K a partir de imágenes. Útil para obtener una salida de calidad de entrega sin pasar por un escalado cuando se parte de una imagen fija.
Precios
Precios de la API de Vidu Q3
El precio es por resultado. El cargo final depende de los parámetros que definas en el playground de cada variante (resolución, duración, número de resultados, referencias).
| Endpoint | Tipo | Precio inicial |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Llama a la API de Vidu Q3
Obtén una clave de API en wavespeed.ai/accesskey y envía una predicción por REST. El playground genera ejemplos listos para pegar con cualquier combinación de entradas.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Vidu Q3 frente a las alternativas
Cuándo elegir Vidu Q3 en lugar de modelos similares en WaveSpeedAI.
Vidu Q3 frente a Seedance 2.0
Seedance 2.0 incluye síntesis de audio nativa en todas las variantes y el nivel Turbo. Vidu Q3 es bastante más barato y ofrece la interpolación inicio-fin como endpoint de primer nivel, algo que Seedance no tiene.
Vidu Q3 frente a Kling 3.0
Kling 3.0 cubre Standard, Pro y 4K, con el control de movimiento como subendpoint. Vidu Q3 es más barato en la mayoría de los niveles y ofrece start-end-to-video y referencia a vídeo (1-4 referencias) como variantes principales.
Vidu Q3 frente a Wan 2.7
Wan 2.7 reúne en la misma familia referencia a vídeo, edición de vídeo, extensión de vídeo, edición de imagen y texto a imagen. Vidu Q3 se centra en la generación de vídeo, con niveles más baratos y el flujo de interpolación inicio-fin.
Preguntas frecuentes
Vidu Q3 API — Preguntas frecuentes
Precios, licencia, integración: preguntas habituales sobre cómo ejecutar Vidu Q3 en WaveSpeedAI.
¿Qué es la API de Vidu Q3?
Vidu Q3 es un modelo de generación de vídeo de Shengshu expuesto como API REST en WaveSpeedAI. Vidu Q3 de Shengshu: texto a vídeo, imagen a vídeo, referencia a vídeo (de 1 a 4 imágenes de referencia para consistencia de varias entidades) y start-end-to-video. Tres niveles: Standard, Pro y Turbo. Salidas de hasta 16 segundos en algunas variantes. Puedes llamarlo por programación o probarlo desde el playground enlazado arriba.
¿Cómo llamo a la API de Vidu Q3?
Regístrate en WaveSpeedAI, copia tu clave de API desde /accesskey y haz POST a https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video con tu entrada como JSON. El endpoint devuelve un id de predicción. Consulta el endpoint de resultados aproximadamente cada 2 segundos, aumenta el intervalo en las tareas largas y detente ante cualquier estado final. Arriba tienes ejemplos en Python / Node.js / cURL orientados a producción.
¿Cuánto cuesta la API de Vidu Q3?
Vidu Q3 empieza en $0.15 por ejecución. El coste exacto depende de los parámetros que definas (resolución, duración, número de resultados, referencias). La vista previa del coste en tiempo real junto al botón Generar del playground muestra el precio exacto de tu entrada actual.
¿Qué variantes de Vidu Q3 hay disponibles?
WaveSpeedAI aloja 13 endpoints de Vidu Q3 en producción: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video y más. Cada variante tiene su propia página de playground y sus propios precios.
¿Puedo usar comercialmente los resultados de Vidu Q3?
Los derechos de uso comercial dependen de la licencia del modelo de Shengshu. La mayoría de los modelos de Shengshu permiten el uso comercial de los resultados; consulta la página del playground de cada modelo para ver el resumen de su licencia y los Términos del servicio de WaveSpeedAI para las condiciones de la plataforma.
¿Por qué usar Vidu Q3 en WaveSpeedAI en lugar de ir directamente al proveedor?
Una sola clave de API y una sola cuenta de facturación para Vidu Q3 Y más de 1.000 modelos de IA de otros proveedores. Sin configurar un SDK por proveedor, sin límites de uso aparte y sin reescribir el código de integración para cada proveedor. Los precios suelen ser iguales o inferiores a los de la API directa de Shengshu.
Proveedor
Acerca de Shengshu
El equipo detrás de Vidu Q3 y de la gama más amplia de modelos de Shengshu en WaveSpeedAI.
Shengshu Technology es un laboratorio de IA chino surgido de la Universidad de Tsinghua, detrás de la familia de modelos de generación de vídeo Vidu. Vidu Q3 ofrece texto a vídeo, imagen a vídeo, referencia a vídeo (de 1 a 4 imágenes de referencia para consistencia de varias entidades) y start-end-to-video (interpolación de fotogramas clave entre dos imágenes fijas) en los niveles Standard, Pro y Turbo. Algunas variantes admiten salidas de hasta 16 segundos.
Empieza a crear con Vidu Q3 en WaveSpeedAI
Créditos gratuitos al registrarte. Una sola clave de API para más de 1.000 modelos de IA de Shengshu y de todos los demás proveedores.