Vidu Q4 API
Shengshu Vidu Q4 — imagem para vídeo e referência para vídeo com clipes de 3 a 16 segundos, saída de 540p a 4K e áudio gerado opcional. Referência para vídeo aceita até 12 imagens de referência e até 3 clipes de áudio de referência em uma única requisição.
Dois endpoints: vidu/q4-preview/image-to-video anima uma única imagem, e vidu/q4-preview/reference-to-video monta uma cena a partir de um prompt mais até 12 imagens de referência e 3 clipes de áudio de referência. Ambos aceitam qualquer duração em segundos inteiros de 3 a 16 segundos, cinco resoluções de 540p a 4K e uma opção para ativar o áudio.
Visão geral
Sobre o Vidu Q4 API
O que o Vidu Q4 faz, como ele se encaixa na linha de modelos da Shengshu e por que as equipes o escolhem.
Vidu Q4 é um modelo de geração de vídeo da Shengshu, disponível pela API REST da WaveSpeedAI. Shengshu Vidu Q4 — imagem para vídeo e referência para vídeo com clipes de 3 a 16 segundos, saída de 540p a 4K e áudio gerado opcional. Referência para vídeo aceita até 12 imagens de referência e até 3 clipes de áudio de referência em uma única requisição.
Dois endpoints: vidu/q4-preview/image-to-video anima uma única imagem, e vidu/q4-preview/reference-to-video monta uma cena a partir de um prompt mais até 12 imagens de referência e 3 clipes de áudio de referência. Ambos aceitam qualquer duração em segundos inteiros de 3 a 16 segundos, cinco resoluções de 540p a 4K e uma opção para ativar o áudio.
A família Vidu Q4 na WaveSpeedAI traz 2 endpoints REST cobrindo os fluxos de Reference-To-Video, Image-To-Video. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.
Execute o Vidu Q4 com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.
Especificações
Recursos e status de lançamento do Vidu Q4 API
Os detalhes específicos do modelo que desenvolvedores procuram antes de escolher uma API: disponibilidade, duração esperada do resultado, suporte a referências e a alternativa ativa atual.
Endpoints
2 variantes
Imagem para vídeo e referência para vídeo.
Duração
3 a 16 s
Qualquer número inteiro de segundos; o padrão é 5 s.
Resolução
540p a 4K
540p, 720p, 1080p, 2K, 4K; o padrão é 720p.
Referências
12 imagens + 3 áudios
Na referência para vídeo, junto com um prompt de texto.
Endpoints
Todos os endpoints da API de Vidu Q4
2 endpoints de Vidu Q4 disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemplos
Veja o Vidu Q4 em ação
Resultados reais gerados pela API do Vidu Q4. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.
Como usar
Como usar a API do Vidu Q4
Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.
- 01
Obtenha uma chave de API
Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.
- 02
Envie uma predição
Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.
- 03
Consulte até concluir
Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.
- 04
Leia a URL do resultado
Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do Vidu Q4 que você chamou.
Casos de uso
O que você pode criar com o Vidu Q4
Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do Vidu Q4.
Animação de produto a partir de uma foto
vidu/q4-preview/image-to-video transforma uma única foto de produto em um clipe promocional. Descreva o movimento de câmera e a ação que você quer; a imagem continua sendo a âncora visual.
Personagens que mantêm a aparência
vidu/q4-preview/reference-to-video aceita até 12 imagens de referência, então um personagem recorrente, mascote ou porta-voz pode ser mostrado de vários ângulos e continuar reconhecível de um clipe para outro.
Cenas guiadas pelo som
Adicione até 3 clipes de áudio de referência pelo campo audios junto com as suas imagens e mantenha generate_audio ativado para receber um clipe com som em uma única chamada.
4K pronto para entrega
Os dois endpoints geram 540p, 720p, 1080p, 2K ou 4K. Faça rascunhos em 540p ou 720p e depois rode de novo o prompt aprovado na resolução de entrega, sem uma passada de upscale separada.
Todos os formatos sociais
Referência para vídeo renderiza em 16:9, 9:16, 1:1, 3:4 ou 4:3, cobrindo YouTube, Reels, Shorts, posts de feed e páginas de produto a partir das mesmas referências.
Clipes no tamanho do ritmo
A duração pode ser qualquer número inteiro de segundos de 3 a 16, então um loop de 3 segundos, uma vinheta de 6 segundos e um spot de 15 segundos saem todos do mesmo endpoint.
Dicas
Dicas de prompt para o Vidu Q4
Conselhos práticos para obter melhores resultados com o Vidu Q4 — extraídos dos padrões que funcionam em modelos de vídeo em pipelines de produção.
- 01
Use uma imagem de origem limpa e bem iluminada
No vidu/q4-preview/image-to-video, a imagem define o sujeito, o enquadramento e o estilo. Escolha uma imagem nítida com um único sujeito claro e use o prompt para o movimento e a direção de câmera, em vez de descrever de novo o que já está visível.
- 02
Dê uma função a cada referência
Com o vidu/q4-preview/reference-to-video, use referências que pertencem à cena — o personagem, o produto, o cenário — e diga no prompt como cada uma deve aparecer, em vez de enviar imagens pouco relacionadas.
- 03
Ajuste a ação à duração
Peça uma quantidade de ação compatível com a duração do clipe. Um clipe de 3 a 5 segundos comporta um movimento ou gesto; deixe ações com várias etapas para 10 a 16 segundos.
- 04
Rascunhe em baixa, entregue em alta
Explore ideias em 540p ou 720p com durações curtas e depois rode de novo o prompt escolhido em 1080p, 2K ou 4K para a entrega.
- 05
Defina áudio e reescrita do prompt desde o início
generate_audio vem ativado por padrão; desative-o quando for adicionar sua própria trilha sonora. Na imagem para vídeo, defina enable_prompt_expansion como false quando quiser que o prompt seja usado exatamente como foi escrito.
Preços
Preços da API de Vidu Q4
O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).
| Endpoint | Tipo | Preço inicial |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Chame a API de Vidu Q4
Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Vidu Q4 vs alternativas
Quando escolher o Vidu Q4 em vez de modelos semelhantes na WaveSpeedAI.
Vidu Q4 vs Vidu Q3
A referência para vídeo do Vidu Q3 aceita de 1 a 4 imagens de referência; o Q4 aceita até 12 imagens mais até 3 referências de áudio, e os dois endpoints do Q4 chegam a 4K. O Q3 continua sendo a escolha para texto para vídeo, interpolação entre keyframes inicial e final e seus níveis Pro e Turbo.
Vidu Q4 vs Seedance 2.5
O Seedance 2.5 chega a tomadas únicas de até 30 segundos e adiciona endpoints de edição e extensão de vídeo. O Vidu Q4 foca na geração guiada por imagem e por referência, com saída de até 4K.
Vidu Q4 vs Wan 3.0
O Wan 3.0 oferece texto, imagem e referência para vídeo com até 30 segundos, em até 1080p. O Vidu Q4 vai até 16 segundos, mas adiciona saída em 2K e 4K e até 12 imagens de referência.
FAQ
Vidu Q4 API — Perguntas frequentes
Preços, licença, integração — perguntas comuns sobre executar o Vidu Q4 na WaveSpeedAI.
O que é a API do Vidu Q4?
Vidu Q4 é um modelo de geração de vídeo da Shengshu disponibilizado como API REST na WaveSpeedAI. Shengshu Vidu Q4 — imagem para vídeo e referência para vídeo com clipes de 3 a 16 segundos, saída de 540p a 4K e áudio gerado opcional. Referência para vídeo aceita até 12 imagens de referência e até 3 clipes de áudio de referência em uma única requisição. Você pode chamá-lo por código ou testá-lo no playground indicado acima.
Como chamo a API do Vidu Q4?
Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.
Quanto custa a API do Vidu Q4?
O Vidu Q4 começa em $0.25 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.
Quais variantes do Vidu Q4 estão disponíveis?
A WaveSpeedAI hospeda 2 endpoints de Vidu Q4 ativos: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Cada variante tem sua própria página de playground e seu preço.
Posso usar os resultados do Vidu Q4 comercialmente?
Os direitos de uso comercial seguem a licença do modelo da Shengshu. A maioria dos modelos da Shengshu permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.
Por que usar o Vidu Q4 na WaveSpeedAI em vez de ir direto à fonte?
Uma chave de API e uma conta de cobrança para o Vidu Q4 E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da Shengshu.
Provedor
Sobre a Shengshu
A equipe por trás do Vidu Q4 e de toda a linha de modelos da Shengshu na WaveSpeedAI.
A Shengshu Technology é um laboratório chinês de IA surgido na Universidade Tsinghua, por trás da família de modelos de geração de vídeo Vidu. O Vidu Q4, a geração mais recente, traz imagem para vídeo e referência para vídeo com até 12 imagens de referência, até 3 clipes de áudio de referência e saída de até 4K. O Vidu Q3 traz texto para vídeo, imagem para vídeo, referência para vídeo (1 a 4 imagens de referência para consistência de várias entidades) e start-end-to-video (interpolação de keyframes entre duas imagens) nos níveis Standard, Pro e Turbo. Algumas variantes suportam saídas de até 16 segundos.
Comece a criar com o Vidu Q4 na WaveSpeedAI
Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da Shengshu e de todos os outros provedores.