Wan 2.2 API
Alibaba Wan 2.2 — kit de vídeo de pesos abertos implantado na WaveSpeedAI com mais de 35 variantes próprias: Animate (animação de personagens de 120 s), Video Edit, Speech-to-Video (10 min guiados por áudio), Fun-Control (licença Apache 2.0), além de imagem para vídeo e texto para vídeo em vários tamanhos de modelo (5B, A14B) e resoluções (480p / 720p).
Apenas variantes hospedadas na WaveSpeedAI. O Animate produz clipes 720p de até 120 segundos; o Speech-to-Video produz clipes 480p de até 10 minutos; o Fun-Control usa Control Codes predefinidos sob a licença Apache 2.0 para uso comercial. Os endpoints de treino de LoRA fazem o ajuste fino em minutos.
Visão geral
Sobre o Wan 2.2 API
O que o Wan 2.2 faz, como ele se encaixa na linha de modelos da Alibaba e por que as equipes o escolhem.
Wan 2.2 é um modelo de geração de vídeo da Alibaba, disponível pela API REST da WaveSpeedAI. Alibaba Wan 2.2 — kit de vídeo de pesos abertos implantado na WaveSpeedAI com mais de 35 variantes próprias: Animate (animação de personagens de 120 s), Video Edit, Speech-to-Video (10 min guiados por áudio), Fun-Control (licença Apache 2.0), além de imagem para vídeo e texto para vídeo em vários tamanhos de modelo (5B, A14B) e resoluções (480p / 720p).
Apenas variantes hospedadas na WaveSpeedAI. O Animate produz clipes 720p de até 120 segundos; o Speech-to-Video produz clipes 480p de até 10 minutos; o Fun-Control usa Control Codes predefinidos sob a licença Apache 2.0 para uso comercial. Os endpoints de treino de LoRA fazem o ajuste fino em minutos.
A família Wan 2.2 na WaveSpeedAI traz 32 endpoints REST cobrindo os fluxos de Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.
Execute o Wan 2.2 com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.
Endpoints
Todos os endpoints da API de Wan 2.2
32 endpoints de Wan 2.2 disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemplos
Veja o Wan 2.2 em ação
Resultados reais gerados pela API do Wan 2.2. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.
Como usar
Como usar a API do Wan 2.2
Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.
- 01
Obtenha uma chave de API
Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.
- 02
Envie uma predição
Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.
- 03
Consulte até concluir
Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.
- 04
Leia a URL do resultado
Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do Wan 2.2 que você chamou.
Casos de uso
O que você pode criar com o Wan 2.2
Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do Wan 2.2.
Wan 2.2 Animate — animação de personagens de até 120 s
wavespeed-ai/wan-2.2/animate é um "modelo unificado de animação e substituição de personagens que replica movimento e expressão; gera vídeos 720p de até 120 s". Afirmação do catálogo. Bem mais longo que a maioria das ferramentas de animação guiadas por pose.
Speech-to-Video de até 10 minutos
wavespeed-ai/wan-2.2/speech-to-video "transforma imagens e fala em vídeos de alta fidelidade com movimento facial e corporal realista; suporta clipes de até 10 minutos em 480p". Útil para conteúdo falado de longa duração.
Video Edit com alterações guiadas por prompt
wavespeed-ai/wan-2.2/video-edit permite modificar vídeos por prompts de texto (exemplos do catálogo: trocar roupas ou personagens). Suporta 480p e 720p, até 120 s.
Fun-Control com licença Apache 2.0
wavespeed-ai/wan-2.2/fun-control usa "Control Codes e entradas multimodais para gerar vídeos controlados por predefinições de até 120 s em 720p; lançado sob Apache 2.0 para uso comercial". A licença Apache 2.0 é um diferencial real para pipelines comerciais.
Treino de LoRA (10× mais rápido)
wavespeed-ai/wan-2.2-image-lora-trainer para LoRA de imagem, wavespeed-ai/wan-2.2-i2v-lora-trainer para LoRA de I2V. Afirmação do catálogo: "treino 10x mais rápido". Suporta treino de estilo, personagem, objeto, movimento, ação e efeitos de vídeo. Envie um arquivo ZIP para começar.
Imagem para vídeo em vários tamanhos (5B / A14B)
Escolha o tamanho do modelo: 5B (menor) para velocidade/custo, ou A14B para qualidade total. I2V padrão para 480p; variantes com suporte a LoRA; variantes ultrarrápidas.
Dicas
Dicas de prompt para o Wan 2.2
Conselhos práticos para obter melhores resultados com o Wan 2.2 — extraídos dos padrões que funcionam em modelos de vídeo em pipelines de produção.
- 01
Escolha a variante para a sua tarefa
O Wan 2.2 traz endpoints especializados em vez de um único modelo de uso geral. Animate para movimento guiado por pose, video-edit para alterações pontuais, speech-to-video para conteúdo falado e image-to-video para geração geral. Combine o endpoint com a tarefa — a saída é muito melhor do que pedir a um modelo geral que faça tudo.
- 02
Treine uma LoRA para consistência em escala de produção
Os endpoints de treinamento de LoRA do Wan 2.2 são recursos de API de primeira classe, não uma ferramenta secundária. Em produções que precisam de identidade recorrente em centenas de gerações (mascote de marca, personagem recorrente, estilo característico), treine uma LoRA uma vez e chame o endpoint de inferência com LoRA a cada geração.
- 03
Pesos abertos permitem o ajuste fino
Concorrentes de pesos fechados prendem você ao comportamento do modelo do fornecedor. O Wan 2.2 é de pesos abertos por baixo, então, quando você bate em uma limitação que o modelo base não resolve, o ajuste fino é uma opção — a maioria das outras APIs de vídeo comerciais não oferece esse caminho.
- 04
Compare o Animate com o Kling Motion Control
Ambos oferecem animação guiada por pose, com compensações diferentes. O Wan 2.2 Animate tem suporte a LoRA e pesos abertos; o Kling Motion Control tem preservação de identidade mais forte. Escolha conforme o ajuste fino importe mais ou a qualidade da identidade importe mais.
Preços
Preços da API de Wan 2.2
O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).
API
Chame a API de Wan 2.2
Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Wan 2.2 vs alternativas
Quando escolher o Wan 2.2 em vez de modelos semelhantes na WaveSpeedAI.
Wan 2.2 vs Wan 2.7
O Wan 2.7 (alibaba/wan-2.7/*) é a arquitetura mais nova da Alibaba, com referência para vídeo, video-edit, image-edit e texto para imagem em uma só família — um kit multimodal mais amplo. O Wan 2.2 (variantes da WaveSpeedAI) traz endpoints especializados — Animate (120 s), Speech-to-Video (10 min), Fun-Control (Apache 2.0), treinadores de LoRA — que o 2.7 não expõe.
Wan 2.2 vs Seedance 2.0
O Seedance 2.0 entrega saída de nível hollywoodiano com áudio nativo em todas as variantes. O Wan 2.2 vence no leque de variantes (mais de 35 endpoints) e no treino de LoRA — a escolha certa quando você precisa de uma capacidade especializada (Animate, Speech-to-Video, Fun-Control) em vez de um modelo de vídeo de uso geral.
Wan 2.2 vs Kling 3.0 Motion Control
Ambos trazem animação de personagens guiada por pose. O Wan 2.2 Animate produz clipes 720p de 120 s e inclui ajuste fino com LoRA. O Kling Motion Control é limitado à duração do vídeo de referência (3 a 30 s), mas foi treinado no acervo de vídeos da Kuaishou para ter priors de movimento mais fortes.
FAQ
Wan 2.2 API — Perguntas frequentes
Preços, licença, integração — perguntas comuns sobre executar o Wan 2.2 na WaveSpeedAI.
O que é a API do Wan 2.2?
Wan 2.2 é um modelo de geração de vídeo da Alibaba disponibilizado como API REST na WaveSpeedAI. Alibaba Wan 2.2 — kit de vídeo de pesos abertos implantado na WaveSpeedAI com mais de 35 variantes próprias: Animate (animação de personagens de 120 s), Video Edit, Speech-to-Video (10 min guiados por áudio), Fun-Control (licença Apache 2.0), além de imagem para vídeo e texto para vídeo em vários tamanhos de modelo (5B, A14B) e resoluções (480p / 720p). Você pode chamá-lo por código ou testá-lo no playground indicado acima.
Como chamo a API do Wan 2.2?
Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.
Quanto custa a API do Wan 2.2?
O Wan 2.2 começa em $0.02 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.
Quais variantes do Wan 2.2 estão disponíveis?
A WaveSpeedAI hospeda 32 endpoints de Wan 2.2 ativos: wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control, e mais. Cada variante tem sua própria página de playground e seu preço.
Posso usar os resultados do Wan 2.2 comercialmente?
Os direitos de uso comercial seguem a licença do modelo da Alibaba. A maioria dos modelos da Alibaba permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.
Por que usar o Wan 2.2 na WaveSpeedAI em vez de ir direto à fonte?
Uma chave de API e uma conta de cobrança para o Wan 2.2 E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da Alibaba.
Provedor
Sobre a Alibaba
A equipe por trás do Wan 2.2 e de toda a linha de modelos da Alibaba na WaveSpeedAI.
O Tongyi Lab da Alibaba produz a família de modelos de vídeo Wan e a família de LLMs Qwen. O Wan se destaca por ter sido lançado com pesos abertos, ampla cobertura de variantes (texto para vídeo, imagem para vídeo, referência para vídeo, video-edit, video-extend, image-edit, texto para imagem) e força constante em estabilidade de movimento e aderência ao prompt com prompts em vários idiomas.
Comece a criar com o Wan 2.2 na WaveSpeedAI
Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da Alibaba e de todos os outros provedores.