Vidu Q3 API
Shengshu Vidu Q3 — texto para vídeo, imagem para vídeo, referência para vídeo (1 a 4 imagens de referência para consistência de várias entidades) e start-end-to-video. Três níveis: Standard, Pro e Turbo. Saídas de até 16 segundos em algumas variantes.
Níveis Standard, Pro (saídas de 1 a 16 s) e Turbo (mais rápido). Referência para vídeo aceita de 1 a 4 imagens de referência para vídeos consistentes com várias entidades, de 360p a 1080p, com até 16 segundos. Start-end-to-video liga dois keyframes (1 a 16 s no Pro). A variante image-to-video-pro suporta 720p/1080p/2K/4K.
Visão geral
Sobre o Vidu Q3 API
O que o Vidu Q3 faz, como ele se encaixa na linha de modelos da Shengshu e por que as equipes o escolhem.
Vidu Q3 é um modelo de geração de vídeo da Shengshu, disponível pela API REST da WaveSpeedAI. Shengshu Vidu Q3 — texto para vídeo, imagem para vídeo, referência para vídeo (1 a 4 imagens de referência para consistência de várias entidades) e start-end-to-video. Três níveis: Standard, Pro e Turbo. Saídas de até 16 segundos em algumas variantes.
Níveis Standard, Pro (saídas de 1 a 16 s) e Turbo (mais rápido). Referência para vídeo aceita de 1 a 4 imagens de referência para vídeos consistentes com várias entidades, de 360p a 1080p, com até 16 segundos. Start-end-to-video liga dois keyframes (1 a 16 s no Pro). A variante image-to-video-pro suporta 720p/1080p/2K/4K.
A família Vidu Q3 na WaveSpeedAI traz 13 endpoints REST cobrindo os fluxos de Text-To-Video, Image-To-Video, Reference-To-Video. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.
Execute o Vidu Q3 com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.
Endpoints
Todos os endpoints da API de Vidu Q3
13 endpoints de Vidu Q3 disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemplos
Veja o Vidu Q3 em ação
Resultados reais gerados pela API do Vidu Q3. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.
Como usar
Como usar a API do Vidu Q3
Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.
- 01
Obtenha uma chave de API
Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.
- 02
Envie uma predição
Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.
- 03
Consulte até concluir
Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.
- 04
Leia a URL do resultado
Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do Vidu Q3 que você chamou.
Casos de uso
O que você pode criar com o Vidu Q3
Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do Vidu Q3.
Referência para vídeo com 1 a 4 referências
vidu/q3/reference-to-video gera vídeos consistentes com várias entidades a partir de 1 a 4 imagens de referência, com orientação por prompt de texto. Suporta de 360p a 1080p, até 16 segundos e várias proporções de tela. Útil para cenas em grupo em que vários sujeitos referenciados precisam permanecer coerentes.
Interpolação entre keyframes inicial e final
vidu/q3/start-end-to-video cria vídeos interpolando entre dois keyframes. Os níveis Pro e Turbo também suportam start-end com durações de 1 a 16 s. Útil para storyboards no estilo animatic, quando você tem as imagens inicial e final.
Saídas de até 16 segundos
Afirmação do catálogo nas variantes Pro e de referência para vídeo: duração de 1 a 16 segundos. Mais longa que a janela de 5 a 8 s de muitos modelos de vídeo concorrentes — útil para momentos narrativos completos em uma única geração.
Imagem para vídeo em alta resolução
vidu/q3/image-to-video-pro suporta 720p / 1080p / 2K / 4K a partir de imagens. Útil para saída com qualidade de entrega, sem passada de upscale, ao partir de uma imagem estática.
Nível Pro (o mais barato)
vidu/q3-pro/* é o nível mais barato do Vidu Q3 — útil para trabalho em alto volume. Cobre imagem para vídeo, texto para vídeo e start-end-to-video com saídas de 1 a 16 segundos.
Dicas
Dicas de prompt para o Vidu Q3
Conselhos práticos para obter melhores resultados com o Vidu Q3 — extraídos dos padrões que funcionam em modelos de vídeo em pipelines de produção.
- 01
Use o suporte a 1 a 4 imagens de referência em cenas com várias entidades
vidu/q3/reference-to-video aceita de 1 a 4 imagens de referência para vídeos consistentes com várias entidades, com orientação por prompt de texto. Útil para cenas com elenco, vitrines de produtos em grupo e storyboards com vários sujeitos.
- 02
Interpolação entre quadro inicial e final para workflows com keyframes
vidu/q3/start-end-to-video liga duas imagens estáticas com movimento gerado. Especialmente útil para trabalho no estilo animatic, storyboards guiados por poses-chave e para transformar arte conceitual em movimento sem refazer o prompt de cada segmento.
- 03
Escolha o nível de forma deliberada
O Standard é o nível padrão de entrega; o nível Pro (saídas de 1 a 16 segundos) é posicionado para trabalho em alto volume; o nível Turbo prioriza a velocidade. Consulte a tabela de preços ao vivo desta página para ver o custo atual por nível — o nível Pro do Vidu Q3 é incomumente competitivo.
- 04
Saídas de até 16 segundos em algumas variantes
Afirmação do catálogo nas variantes Pro e de referência para vídeo: duração de 1 a 16 segundos. Mais longa que a janela de 5 a 8 s de muitos modelos de vídeo concorrentes — útil para momentos narrativos completos em uma única geração.
- 05
image-to-video-pro para saída em alta resolução
vidu/q3/image-to-video-pro suporta resolução de 720p / 1080p / 2K / 4K a partir de imagens. Útil para saída com qualidade de entrega, sem passada de upscale, ao partir de uma imagem estática.
Preços
Preços da API de Vidu Q3
O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).
| Endpoint | Tipo | Preço inicial |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Chame a API de Vidu Q3
Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Vidu Q3 vs alternativas
Quando escolher o Vidu Q3 em vez de modelos semelhantes na WaveSpeedAI.
Vidu Q3 vs Seedance 2.0
O Seedance 2.0 traz síntese de áudio nativa em todas as variantes e o nível Turbo. O Vidu Q3 é bem mais barato e traz a interpolação inicial-final como endpoint de primeira classe, que o Seedance não tem.
Vidu Q3 vs Kling 3.0
O Kling 3.0 cobre Standard, Pro e 4K, com controle de movimento como subendpoint. O Vidu Q3 é mais barato na maioria dos níveis e traz start-end-to-video e referência para vídeo (1 a 4 referências) como variantes principais.
Vidu Q3 vs Wan 2.7
O Wan 2.7 traz referência para vídeo, video-edit, video-extend, image-edit e texto para imagem na mesma família. O Vidu Q3 permanece focado na geração de vídeo, com níveis mais baratos e o workflow de interpolação inicial-final.
FAQ
Vidu Q3 API — Perguntas frequentes
Preços, licença, integração — perguntas comuns sobre executar o Vidu Q3 na WaveSpeedAI.
O que é a API do Vidu Q3?
Vidu Q3 é um modelo de geração de vídeo da Shengshu disponibilizado como API REST na WaveSpeedAI. Shengshu Vidu Q3 — texto para vídeo, imagem para vídeo, referência para vídeo (1 a 4 imagens de referência para consistência de várias entidades) e start-end-to-video. Três níveis: Standard, Pro e Turbo. Saídas de até 16 segundos em algumas variantes. Você pode chamá-lo por código ou testá-lo no playground indicado acima.
Como chamo a API do Vidu Q3?
Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.
Quanto custa a API do Vidu Q3?
O Vidu Q3 começa em $0.15 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.
Quais variantes do Vidu Q3 estão disponíveis?
A WaveSpeedAI hospeda 13 endpoints de Vidu Q3 ativos: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, e mais. Cada variante tem sua própria página de playground e seu preço.
Posso usar os resultados do Vidu Q3 comercialmente?
Os direitos de uso comercial seguem a licença do modelo da Shengshu. A maioria dos modelos da Shengshu permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.
Por que usar o Vidu Q3 na WaveSpeedAI em vez de ir direto à fonte?
Uma chave de API e uma conta de cobrança para o Vidu Q3 E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da Shengshu.
Provedor
Sobre a Shengshu
A equipe por trás do Vidu Q3 e de toda a linha de modelos da Shengshu na WaveSpeedAI.
A Shengshu Technology é um laboratório chinês de IA surgido na Universidade Tsinghua, por trás da família de modelos de geração de vídeo Vidu. O Vidu Q3 traz texto para vídeo, imagem para vídeo, referência para vídeo (1 a 4 imagens de referência para consistência de várias entidades) e start-end-to-video (interpolação de keyframes entre duas imagens) nos níveis Standard, Pro e Turbo. Algumas variantes suportam saídas de até 16 segundos.
Comece a criar com o Vidu Q3 na WaveSpeedAI
Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da Shengshu e de todos os outros provedores.