Wan 2.2 API
Wan 2.2 de Alibaba: un conjunto de herramientas de vídeo de pesos abiertos desplegado en WaveSpeedAI con más de 35 variantes propias: Animate (animación de personajes de 120 s), Video Edit, Speech-to-Video (10 minutos guiados por audio), Fun-Control (con licencia Apache 2.0), además de imagen a vídeo y texto a vídeo en varios tamaños de modelo (5B, A14B) y resoluciones (480p / 720p).
Solo variantes alojadas en WaveSpeedAI. Animate produce clips 720p de hasta 120 segundos; Speech-to-Video produce clips 480p de hasta 10 minutos; Fun-Control usa Control Codes predefinidos bajo Apache 2.0 para uso comercial. Los endpoints de entrenamiento de LoRA hacen el ajuste fino en minutos.
Resumen
Acerca de Wan 2.2 API
Qué hace Wan 2.2, cómo encaja en la gama de modelos de Alibaba y por qué los equipos lo eligen.
Wan 2.2 es un modelo de generación de vídeo de Alibaba, disponible a través de la API REST de WaveSpeedAI. Wan 2.2 de Alibaba: un conjunto de herramientas de vídeo de pesos abiertos desplegado en WaveSpeedAI con más de 35 variantes propias: Animate (animación de personajes de 120 s), Video Edit, Speech-to-Video (10 minutos guiados por audio), Fun-Control (con licencia Apache 2.0), además de imagen a vídeo y texto a vídeo en varios tamaños de modelo (5B, A14B) y resoluciones (480p / 720p).
Solo variantes alojadas en WaveSpeedAI. Animate produce clips 720p de hasta 120 segundos; Speech-to-Video produce clips 480p de hasta 10 minutos; Fun-Control usa Control Codes predefinidos bajo Apache 2.0 para uso comercial. Los endpoints de entrenamiento de LoRA hacen el ajuste fino en minutos.
La familia Wan 2.2 en WaveSpeedAI incluye 32 endpoints REST que cubren los flujos de trabajo de Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. Cada variante tiene su propio precio, parámetros y ejemplos de resultados: elige la que se ajuste a tu modalidad de entrada y a tus requisitos de producción, o llama a varias con la misma clave de API para componer flujos de varios pasos.
Ejecuta Wan 2.2 con la misma clave de API, la misma cuenta de facturación y los mismos límites de uso que ya usas para los demás más de 1.000 modelos de IA de WaveSpeedAI. Sin configuración aparte por proveedor, sin SDK por proveedor, sin límites de uso distintos por proveedor: una sola integración lo cubre todo, desde texto a imagen y texto a vídeo hasta síntesis de audio, generación 3D, escalado y edición.
Endpoints
Todos los endpoints de la API de Wan 2.2
32 endpoints de Wan 2.2 disponibles ahora en WaveSpeedAI: elige la variante que se ajuste a tu flujo de trabajo.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ejemplos
Mira Wan 2.2 en acción
Resultados reales generados con la API de Wan 2.2. Pasa el cursor sobre cualquier vídeo para previsualizarlo y haz clic para abrir el visor a tamaño completo.
Cómo empezar
Cómo usar la API de Wan 2.2
Cuatro pasos desde el registro hasta una generación terminada. Encontrarás ejemplos completos en Python, Node.js y cURL en la sección de API más abajo.
- 01
Obtén una clave de API
Regístrate en WaveSpeedAI y copia tu clave de API desde el panel. Las cuentas nuevas incluyen créditos gratuitos para empezar: suficientes para usar el playground unas decenas de veces antes de que empiece la facturación.
- 02
Envía una predicción
Haz POST de tu entrada como JSON a https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. El endpoint devuelve un id de predicción de inmediato: las generaciones son asíncronas, así que no mantienes una conexión abierta durante la inferencia.
- 03
Consulta hasta que termine
Haz GET a https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Devuelve los resultados con completed; detente con un error en failed, cancelled, timeout o deleted; sigue consultando con cualquier otro estado.
- 04
Lee la URL del resultado
Cuando status sea "completed", lee la URL de data.outputs[0]. La URL apunta a tu contenido generado en la CDN de WaveSpeedAI: imagen, vídeo, audio o archivo 3D según la variante de Wan 2.2 que hayas llamado.
Casos de uso
Qué puedes crear con Wan 2.2
Flujos de trabajo habituales para los que desarrolladores y creadores usan la API de Wan 2.2.
Wan 2.2 Animate: animación de personajes de hasta 120 s
wavespeed-ai/wan-2.2/animate es un «modelo unificado de animación y sustitución de personajes que replica movimientos y expresiones; genera vídeos 720p de hasta 120 s». Afirmación del catálogo. Mucho más largo que la mayoría de las herramientas de animación guiadas por pose.
Speech-to-Video de hasta 10 minutos
wavespeed-ai/wan-2.2/speech-to-video «convierte imágenes y voz en vídeos de alta fidelidad con movimiento facial y corporal realista; admite clips de hasta 10 minutos en 480p». Útil para contenido hablado de formato largo.
Video Edit con cambios guiados por prompt
wavespeed-ai/wan-2.2/video-edit permite modificar vídeos mediante prompts de texto (ejemplos del catálogo: cambiar la ropa o los personajes). Admite 480p y 720p, hasta 120 s.
Fun-Control con licencia Apache 2.0
wavespeed-ai/wan-2.2/fun-control usa «Control Codes y entradas multimodales para generar vídeos controlados por ajustes predefinidos de hasta 120 s en 720p; publicado bajo Apache 2.0 para uso comercial». La licencia Apache 2.0 es un diferenciador real para pipelines comerciales.
Entrenamiento de LoRA (10× más rápido)
wavespeed-ai/wan-2.2-image-lora-trainer para LoRA de imagen, wavespeed-ai/wan-2.2-i2v-lora-trainer para LoRA de I2V. Afirmación del catálogo: «entrenamiento 10 veces más rápido». Admite entrenamiento de estilo, personaje, objeto, movimiento, acción y efectos de vídeo. Sube un archivo ZIP para empezar.
Imagen a vídeo en varios tamaños (5B / A14B)
Elige el tamaño del modelo: 5B (más pequeño) para velocidad y coste, o A14B para calidad completa. I2V estándar para 480p; variantes compatibles con LoRA; variantes ultrarrápidas.
Consejos
Consejos para escribir prompts en Wan 2.2
Consejos prácticos para obtener mejores resultados con Wan 2.2, basados en los patrones que funcionan en modelos de vídeo en flujos de producción.
- 01
Elige la variante para tu tarea
Wan 2.2 ofrece endpoints especializados en lugar de un único modelo de propósito general. Animate para movimiento guiado por pose, video-edit para cambios concretos, speech-to-video para contenido hablado e imagen a vídeo para generación general. Haz coincidir el endpoint con la tarea: los resultados son bastante mejores que pedirle a un modelo general que lo haga todo.
- 02
Entrena una LoRA para lograr consistencia a escala de producción
Los endpoints de entrenamiento de LoRA de Wan 2.2 son funciones de API de primer nivel, no una herramienta secundaria. Para producciones que necesitan una identidad recurrente a lo largo de cientos de generaciones (mascota de marca, personaje recurrente, estilo distintivo), entrena una LoRA una vez y llama al endpoint de inferencia con LoRA en cada generación.
- 03
Los pesos abiertos permiten el ajuste fino
Los competidores de pesos cerrados te atan al comportamiento del modelo del proveedor. Wan 2.2 es de pesos abiertos en su base, así que cuando te topas con una limitación que el modelo base no resuelve, el ajuste fino es una opción; la mayoría de las demás API comerciales de vídeo no ofrecen esta vía.
- 04
Combina Animate con Kling Motion Control
Ambos ofrecen animación guiada por pose, con compromisos distintos. Wan 2.2 Animate tiene compatibilidad con LoRA y pesos abiertos; Kling Motion Control conserva mejor la identidad. Elige según te importe más el ajuste fino o la calidad de la identidad.
Precios
Precios de la API de Wan 2.2
El precio es por resultado. El cargo final depende de los parámetros que definas en el playground de cada variante (resolución, duración, número de resultados, referencias).
API
Llama a la API de Wan 2.2
Obtén una clave de API en wavespeed.ai/accesskey y envía una predicción por REST. El playground genera ejemplos listos para pegar con cualquier combinación de entradas.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Wan 2.2 frente a las alternativas
Cuándo elegir Wan 2.2 en lugar de modelos similares en WaveSpeedAI.
Wan 2.2 frente a Wan 2.7
Wan 2.7 (alibaba/wan-2.7/*) es la arquitectura más reciente de Alibaba, con referencia a vídeo, edición de vídeo, edición de imagen y texto a imagen en una sola familia: un conjunto de herramientas multimodal más amplio. Wan 2.2 (variantes de WaveSpeedAI) ofrece endpoints especializados (Animate, 120 s; Speech-to-Video, 10 minutos; Fun-Control, Apache 2.0; entrenadores de LoRA) que 2.7 no expone.
Wan 2.2 frente a Seedance 2.0
Seedance 2.0 ofrece una salida de nivel Hollywood con audio nativo en todas las variantes. Wan 2.2 gana en variedad de variantes (más de 35 endpoints) y en entrenamiento de LoRA: la opción adecuada cuando se necesita una capacidad especializada concreta (Animate, Speech-to-Video, Fun-Control) y no un modelo de vídeo de propósito general.
Wan 2.2 frente a Kling 3.0 Motion Control
Ambos ofrecen animación de personajes guiada por pose. Wan 2.2 Animate produce clips 720p de 120 s e incluye ajuste fino con LoRA. Kling Motion Control está limitado a la duración del vídeo de referencia (3-30 s), pero se ha entrenado con el corpus de vídeo de Kuaishou para obtener priors de movimiento más sólidos.
Preguntas frecuentes
Wan 2.2 API — Preguntas frecuentes
Precios, licencia, integración: preguntas habituales sobre cómo ejecutar Wan 2.2 en WaveSpeedAI.
¿Qué es la API de Wan 2.2?
Wan 2.2 es un modelo de generación de vídeo de Alibaba expuesto como API REST en WaveSpeedAI. Wan 2.2 de Alibaba: un conjunto de herramientas de vídeo de pesos abiertos desplegado en WaveSpeedAI con más de 35 variantes propias: Animate (animación de personajes de 120 s), Video Edit, Speech-to-Video (10 minutos guiados por audio), Fun-Control (con licencia Apache 2.0), además de imagen a vídeo y texto a vídeo en varios tamaños de modelo (5B, A14B) y resoluciones (480p / 720p). Puedes llamarlo por programación o probarlo desde el playground enlazado arriba.
¿Cómo llamo a la API de Wan 2.2?
Regístrate en WaveSpeedAI, copia tu clave de API desde /accesskey y haz POST a https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video con tu entrada como JSON. El endpoint devuelve un id de predicción. Consulta el endpoint de resultados aproximadamente cada 2 segundos, aumenta el intervalo en las tareas largas y detente ante cualquier estado final. Arriba tienes ejemplos en Python / Node.js / cURL orientados a producción.
¿Cuánto cuesta la API de Wan 2.2?
Wan 2.2 empieza en $0.02 por ejecución. El coste exacto depende de los parámetros que definas (resolución, duración, número de resultados, referencias). La vista previa del coste en tiempo real junto al botón Generar del playground muestra el precio exacto de tu entrada actual.
¿Qué variantes de Wan 2.2 hay disponibles?
WaveSpeedAI aloja 32 endpoints de Wan 2.2 en producción: wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control y más. Cada variante tiene su propia página de playground y sus propios precios.
¿Puedo usar comercialmente los resultados de Wan 2.2?
Los derechos de uso comercial dependen de la licencia del modelo de Alibaba. La mayoría de los modelos de Alibaba permiten el uso comercial de los resultados; consulta la página del playground de cada modelo para ver el resumen de su licencia y los Términos del servicio de WaveSpeedAI para las condiciones de la plataforma.
¿Por qué usar Wan 2.2 en WaveSpeedAI en lugar de ir directamente al proveedor?
Una sola clave de API y una sola cuenta de facturación para Wan 2.2 Y más de 1.000 modelos de IA de otros proveedores. Sin configurar un SDK por proveedor, sin límites de uso aparte y sin reescribir el código de integración para cada proveedor. Los precios suelen ser iguales o inferiores a los de la API directa de Alibaba.
Proveedor
Acerca de Alibaba
El equipo detrás de Wan 2.2 y de la gama más amplia de modelos de Alibaba en WaveSpeedAI.
Tongyi Lab, de Alibaba, produce la familia de modelos de vídeo Wan y la familia de LLM Qwen. Wan destaca por publicarse con pesos abiertos, por su amplia cobertura de variantes (texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo, extensión de vídeo, edición de imagen, texto a imagen) y por su solidez constante en estabilidad del movimiento y fidelidad al prompt con prompts multilingües.
Empieza a crear con Wan 2.2 en WaveSpeedAI
Créditos gratuitos al registrarte. Una sola clave de API para más de 1.000 modelos de IA de Alibaba y de todos los demás proveedores.