Wan 2.7 API
WAN 2.7 de Alibaba: vídeo cinematográfico coherente con detalle nítido, movimiento estable y buen seguimiento de instrucciones. Endpoints separados para texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo y extensión de vídeo, además de variantes de edición de imagen y texto a imagen en la misma familia.
Salida de vídeo en 720p (por defecto) o 1080p. Ediciones de imagen con la variante Edit base o la variante Pro (salida de hasta 2K). Texto a imagen con la variante base o la variante Pro (hasta 4K con modo de razonamiento). Imagen a vídeo admite control de primer y último fotograma; la extensión de vídeo admite último fotograma y audio.
Resumen
Acerca de Wan 2.7 API
Qué hace Wan 2.7, cómo encaja en la gama de modelos de Alibaba y por qué los equipos lo eligen.
Wan 2.7 es un modelo de generación de vídeo de Alibaba, disponible a través de la API REST de WaveSpeedAI. WAN 2.7 de Alibaba: vídeo cinematográfico coherente con detalle nítido, movimiento estable y buen seguimiento de instrucciones. Endpoints separados para texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo y extensión de vídeo, además de variantes de edición de imagen y texto a imagen en la misma familia.
Salida de vídeo en 720p (por defecto) o 1080p. Ediciones de imagen con la variante Edit base o la variante Pro (salida de hasta 2K). Texto a imagen con la variante base o la variante Pro (hasta 4K con modo de razonamiento). Imagen a vídeo admite control de primer y último fotograma; la extensión de vídeo admite último fotograma y audio.
La familia Wan 2.7 en WaveSpeedAI incluye 10 endpoints REST que cubren los flujos de trabajo de Text-To-Image, Video-Extend, Reference-To-Video, Text-To-Video, Video-To-Video, Image-To-Image, Image-To-Video. Cada variante tiene su propio precio, parámetros y ejemplos de resultados: elige la que se ajuste a tu modalidad de entrada y a tus requisitos de producción, o llama a varias con la misma clave de API para componer flujos de varios pasos.
Ejecuta Wan 2.7 con la misma clave de API, la misma cuenta de facturación y los mismos límites de uso que ya usas para los demás más de 1.000 modelos de IA de WaveSpeedAI. Sin configuración aparte por proveedor, sin SDK por proveedor, sin límites de uso distintos por proveedor: una sola integración lo cubre todo, desde texto a imagen y texto a vídeo hasta síntesis de audio, generación 3D, escalado y edición.
Endpoints
Todos los endpoints de la API de Wan 2.7
10 endpoints de Wan 2.7 disponibles ahora en WaveSpeedAI: elige la variante que se ajuste a tu flujo de trabajo.
/filters:quality(82)/media/images/20260408104400_gquo9ixf.webp)
Wan 2.7 Text To Image
WAN 2.7 Text-to-Image generates high-quality images from text prompts with thinking mode for enhanced image quality. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104356_turpamao.webp)
Wan 2.7 Text To Image Pro
WAN 2.7 Text-to-Image Pro generates high-quality images up to 4K from text prompts with thinking mode for enhanced image quality. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104334_n09m1gpi.webp)
Wan 2.7 Video Extend
WAN 2.7 Video Extend extends existing videos with optional last frame control and audio support, supporting 720p/1080p output. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408104342_ej302cia.webp)
Wan 2.7 Reference To Video
WAN 2.7 Reference-to-Video turns character, prop, or scene references from images or videos into new video shots with preserved identity, style, and layout plus smooth, coherent motion. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408104404_mqejvdc5.webp)
Wan 2.7 Text To Video
WAN 2.7 Text-to-Video turns plain prompts into coherent, cinematic clips with crisp detail, stable motion, and strong instruction-following—great for ads, explainers, and social posts. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408104408_wr1r10h3.webp)
Wan 2.7 Video Edit
WAN 2.7 Video Edit performs prompt-driven video editing with multi-image reference support, supporting 720p/1080p output. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104411_n33dp5gc.webp)
Wan 2.7 Image Edit
WAN 2.7 Image Edit performs prompt-driven image editing with support for multiple-image references. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104338_4kdl2itm.webp)
Wan 2.7 Image To Video
WAN 2.7 converts images into videos (720p/1080p) with optional audio, supporting first and last frame control. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1780805363960584973_J6AfozIS.webp)
Wan 2.7 Image To Video Pro
Wan 2.7 Image to Video Pro is a fast AI image-to-video generation model that converts images into premium-quality videos with superior motion dynamics, enhanced visual fidelity, and professional cinematic output. Ready-to-use REST inference API for product videos, advertising creatives, cinematic clips, social media content, character animation, visual storytelling, and professional image-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/20260408104351_icjk73ba.webp)
Wan 2.7 Image Edit Pro
WAN 2.7 Image Edit Pro performs prompt-driven image editing with multi-image reference support and up to 2K output. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ejemplos
Mira Wan 2.7 en acción
Resultados reales generados con la API de Wan 2.7. Pasa el cursor sobre cualquier vídeo para previsualizarlo y haz clic para abrir el visor a tamaño completo.
Cómo empezar
Cómo usar la API de Wan 2.7
Cuatro pasos desde el registro hasta una generación terminada. Encontrarás ejemplos completos en Python, Node.js y cURL en la sección de API más abajo.
- 01
Obtén una clave de API
Regístrate en WaveSpeedAI y copia tu clave de API desde el panel. Las cuentas nuevas incluyen créditos gratuitos para empezar: suficientes para usar el playground unas decenas de veces antes de que empiece la facturación.
- 02
Envía una predicción
Haz POST de tu entrada como JSON a https://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video. El endpoint devuelve un id de predicción de inmediato: las generaciones son asíncronas, así que no mantienes una conexión abierta durante la inferencia.
- 03
Consulta hasta que termine
Haz GET a https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Devuelve los resultados con completed; detente con un error en failed, cancelled, timeout o deleted; sigue consultando con cualquier otro estado.
- 04
Lee la URL del resultado
Cuando status sea "completed", lee la URL de data.outputs[0]. La URL apunta a tu contenido generado en la CDN de WaveSpeedAI: imagen, vídeo, audio o archivo 3D según la variante de Wan 2.7 que hayas llamado.
Casos de uso
Qué puedes crear con Wan 2.7
Flujos de trabajo habituales para los que desarrolladores y creadores usan la API de Wan 2.7.
Texto a vídeo con buen seguimiento de instrucciones
alibaba/wan-2.7/text-to-video convierte prompts sencillos en clips cinematográficos coherentes. Planteamiento del catálogo: «ideal para anuncios, vídeos explicativos y publicaciones sociales». 720p por defecto, 1080p disponible.
Imagen a vídeo con control de fotogramas
alibaba/wan-2.7/image-to-video admite control del primer y el último fotograma, además de audio opcional; útil para clips en los que la generación debe empezar Y terminar en imágenes fijas concretas.
Referencia a vídeo para la identidad
alibaba/wan-2.7/reference-to-video usa referencias de personaje, objeto o escena (a partir de imágenes o vídeos) para generar planos nuevos con la identidad, el estilo y la composición conservados. Movimiento fluido y coherente a lo largo de la generación.
Edición de vídeo con referencias de varias imágenes
alibaba/wan-2.7/video-edit realiza edición guiada por prompt sobre vídeos de entrada con compatibilidad con referencias de varias imágenes y salida 720p/1080p. Útil para reediciones de estilo y modificaciones concretas sobre metraje existente.
Edición de imágenes en la misma familia
alibaba/wan-2.7/image-edit e image-edit-pro (salida de hasta 2K) se encargan de la edición de imágenes guiada por prompt con referencias de varias imágenes; es la misma familia que las herramientas de vídeo, útil para pipelines de imagen fija a vídeo.
Texto a imagen con modo de razonamiento
alibaba/wan-2.7/text-to-image-pro genera imágenes de hasta 4K con «modo de razonamiento» para mejorar la calidad. Útil para trabajo con imágenes fijas dentro de la misma familia Wan 2.7 que tus generaciones de vídeo.
Consejos
Consejos para escribir prompts en Wan 2.7
Consejos prácticos para obtener mejores resultados con Wan 2.7, basados en los patrones que funcionan en modelos de vídeo en flujos de producción.
- 01
Elige la variante para tu tarea
Wan 2.7 ofrece endpoints separados para texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo, extensión de vídeo, edición de imagen (y image-edit-pro) y texto a imagen (y text-to-image-pro). Elige el endpoint que corresponda a tu entrada: el resultado es bastante mejor que pedirle a una sola variante que lo haga todo.
- 02
Referencia a vídeo conserva la identidad
alibaba/wan-2.7/reference-to-video usa referencias de personaje, objeto o escena (a partir de imágenes o vídeos) para generar planos nuevos con la identidad, el estilo y la composición conservados. La opción adecuada cuando el material de origen tiene sujetos concretos que deben seguir siendo reconocibles.
- 03
Imagen a vídeo admite control de primer y último fotograma
alibaba/wan-2.7/image-to-video te permite especificar el primer y el último fotograma del clip generado, además de audio opcional. Útil cuando los estados inicial y final están fijados y el modelo debe rellenar el movimiento que los conecta.
- 04
Extensión de vídeo con control del último fotograma y del audio
alibaba/wan-2.7/video-extend amplía un vídeo existente con control opcional del último fotograma y compatibilidad con audio, con salida 720p/1080p. Útil para montar secuencias extendidas en las que quieres un control explícito de dónde acaba la extensión.
- 05
Usa el «modo de razonamiento» en text-to-image-pro
alibaba/wan-2.7/text-to-image-pro genera hasta 4K con «modo de razonamiento» para mejorar la calidad de imagen. Útil cuando el trabajo con imágenes fijas comparte la familia Wan 2.7 con tus generaciones de vídeo y quieres un estilo consistente entre imágenes y movimiento.
- 06
Elige 720p o 1080p con criterio
Wan 2.7 admite tanto 720p como 1080p en la mayoría de las variantes. 720p es el valor por defecto y la opción más barata; elige 1080p cuando importe la resolución de entrega y el detalle adicional justifique el coste.
Precios
Precios de la API de Wan 2.7
El precio es por resultado. El cargo final depende de los parámetros que definas en el playground de cada variante (resolución, duración, número de resultados, referencias).
| Endpoint | Tipo | Precio inicial |
|---|---|---|
| alibaba/ | text-to-image | $0.03 |
| alibaba/ | text-to-image | $0.075 |
| alibaba/ | video-extend | $0.50 |
| alibaba/ | reference-to-video | $0.50 |
| alibaba/ | text-to-video | $0.50 |
| alibaba/ | video-to-video | $0.50 |
| alibaba/ | image-to-image | $0.03 |
| alibaba/ | image-to-video | $0.50 |
| alibaba/ | image-to-video | $0.60 |
| alibaba/ | image-to-image | $0.075 |
API
Llama a la API de Wan 2.7
Obtén una clave de API en wavespeed.ai/accesskey y envía una predicción por REST. El playground genera ejemplos listos para pegar con cualquier combinación de entradas.
POSThttps://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"resolution": "720p",
"aspect_ratio": "16:9",
"duration": 5,
"enable_prompt_expansion": false
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"resolution": "720p",
"aspect_ratio": "16:9",
"duration": 5,
"enable_prompt_expansion": false
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"resolution": "720p",
"aspect_ratio": "16:9",
"duration": 5,
"enable_prompt_expansion": False
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Wan 2.7 frente a las alternativas
Cuándo elegir Wan 2.7 en lugar de modelos similares en WaveSpeedAI.
Wan 2.7 frente a Seedance 2.0
Seedance 2.0 incluye audio nativo en todas las variantes (Wan 2.7 solo tiene audio opcional en imagen a vídeo y extensión de vídeo) y un nivel Turbo rápido. Wan 2.7 gana en amplitud multimodal: variantes de edición de imagen y texto a imagen en la misma familia.
Wan 2.7 frente a Kling 3.0
Kling 3.0 tiene niveles Pro y 4K, además de un endpoint de control de movimiento. Wan 2.7 añade variantes de referencia a vídeo, image-edit, image-edit-pro y texto a imagen que Kling no ofrece.
Wan 2.7 frente a Wan 2.2
Wan 2.7 es la arquitectura más reciente. Wan 2.2 (variantes de WaveSpeedAI) ofrece endpoints especializados (Animate, animación de personajes de 120 s; Speech-to-Video, 10 minutos guiados por audio; Fun-Control, Apache 2.0; entrenadores de LoRA) que 2.7 no expone.
Preguntas frecuentes
Wan 2.7 API — Preguntas frecuentes
Precios, licencia, integración: preguntas habituales sobre cómo ejecutar Wan 2.7 en WaveSpeedAI.
¿Qué es la API de Wan 2.7?
Wan 2.7 es un modelo de generación de vídeo de Alibaba expuesto como API REST en WaveSpeedAI. WAN 2.7 de Alibaba: vídeo cinematográfico coherente con detalle nítido, movimiento estable y buen seguimiento de instrucciones. Endpoints separados para texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo y extensión de vídeo, además de variantes de edición de imagen y texto a imagen en la misma familia. Puedes llamarlo por programación o probarlo desde el playground enlazado arriba.
¿Cómo llamo a la API de Wan 2.7?
Regístrate en WaveSpeedAI, copia tu clave de API desde /accesskey y haz POST a https://api.wavespeed.ai/api/v3/alibaba/wan-2.7/text-to-video con tu entrada como JSON. El endpoint devuelve un id de predicción. Consulta el endpoint de resultados aproximadamente cada 2 segundos, aumenta el intervalo en las tareas largas y detente ante cualquier estado final. Arriba tienes ejemplos en Python / Node.js / cURL orientados a producción.
¿Cuánto cuesta la API de Wan 2.7?
Wan 2.7 empieza en $0.03 por ejecución. El coste exacto depende de los parámetros que definas (resolución, duración, número de resultados, referencias). La vista previa del coste en tiempo real junto al botón Generar del playground muestra el precio exacto de tu entrada actual.
¿Qué variantes de Wan 2.7 hay disponibles?
WaveSpeedAI aloja 10 endpoints de Wan 2.7 en producción: alibaba/wan-2.7/text-to-image, alibaba/wan-2.7/text-to-image-pro, alibaba/wan-2.7/video-extend, alibaba/wan-2.7/reference-to-video, alibaba/wan-2.7/text-to-video, alibaba/wan-2.7/video-edit, alibaba/wan-2.7/image-edit, alibaba/wan-2.7/image-to-video y más. Cada variante tiene su propia página de playground y sus propios precios.
¿Puedo usar comercialmente los resultados de Wan 2.7?
Los derechos de uso comercial dependen de la licencia del modelo de Alibaba. La mayoría de los modelos de Alibaba permiten el uso comercial de los resultados; consulta la página del playground de cada modelo para ver el resumen de su licencia y los Términos del servicio de WaveSpeedAI para las condiciones de la plataforma.
¿Por qué usar Wan 2.7 en WaveSpeedAI en lugar de ir directamente al proveedor?
Una sola clave de API y una sola cuenta de facturación para Wan 2.7 Y más de 1.000 modelos de IA de otros proveedores. Sin configurar un SDK por proveedor, sin límites de uso aparte y sin reescribir el código de integración para cada proveedor. Los precios suelen ser iguales o inferiores a los de la API directa de Alibaba.
Proveedor
Acerca de Alibaba
El equipo detrás de Wan 2.7 y de la gama más amplia de modelos de Alibaba en WaveSpeedAI.
Tongyi Lab, de Alibaba, produce la familia de modelos de vídeo Wan y la familia de LLM Qwen. Wan destaca por publicarse con pesos abiertos, por su amplia cobertura de variantes (texto a vídeo, imagen a vídeo, referencia a vídeo, edición de vídeo, extensión de vídeo, edición de imagen, texto a imagen) y por su solidez constante en estabilidad del movimiento y fidelidad al prompt con prompts multilingües.
Empieza a crear con Wan 2.7 en WaveSpeedAI
Créditos gratuitos al registrarte. Una sola clave de API para más de 1.000 modelos de IA de Alibaba y de todos los demás proveedores.