Wan 2.2 API
Alibabas Wan 2.2 – ein Open-Weight-Video-Toolkit, auf WaveSpeedAI mit über 35 hauseigenen Varianten bereitgestellt: Animate (120 s Charakteranimation), Video Edit, Speech-to-Video (10 Minuten, audiogesteuert), Fun-Control (unter Apache 2.0 lizenziert) sowie Image-to-Video und Text-to-Video in mehreren Modellgrößen (5B, A14B) und Auflösungen (480p / 720p).
Nur von WaveSpeedAI gehostete Varianten. Animate erzeugt 720p-Clips bis 120 Sekunden; Speech-to-Video erzeugt 480p-Clips bis 10 Minuten; Fun-Control nutzt voreingestellte Control Codes unter Apache 2.0 für kommerzielle Nutzung. Endpunkte für LoRA-Training fine-tunen in Minuten.
Überblick
Über Wan 2.2 API
Was Wan 2.2 leistet, wie es in die Modellpalette von Alibaba passt und warum Teams darauf zurückgreifen.
Wan 2.2 ist ein Modell von Alibaba für Videogenerierung, verfügbar über die WaveSpeedAI-REST-API. Alibabas Wan 2.2 – ein Open-Weight-Video-Toolkit, auf WaveSpeedAI mit über 35 hauseigenen Varianten bereitgestellt: Animate (120 s Charakteranimation), Video Edit, Speech-to-Video (10 Minuten, audiogesteuert), Fun-Control (unter Apache 2.0 lizenziert) sowie Image-to-Video und Text-to-Video in mehreren Modellgrößen (5B, A14B) und Auflösungen (480p / 720p).
Nur von WaveSpeedAI gehostete Varianten. Animate erzeugt 720p-Clips bis 120 Sekunden; Speech-to-Video erzeugt 480p-Clips bis 10 Minuten; Fun-Control nutzt voreingestellte Control Codes unter Apache 2.0 für kommerzielle Nutzung. Endpunkte für LoRA-Training fine-tunen in Minuten.
Die Familie Wan 2.2 auf WaveSpeedAI umfasst 32 REST-Endpunkte für die Workflows Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. Jede Variante hat eigene Preise, Parameter und Beispielausgaben – wählen Sie die, die zu Ihrer Eingabemodalität und Ihren Produktionsanforderungen passt, oder rufen Sie mit demselben API-Schlüssel mehrere auf, um mehrstufige Pipelines zu bauen.
Nutzen Sie Wan 2.2 mit demselben API-Schlüssel, demselben Abrechnungskonto und denselben Rate Limits wie die über 1.000 weiteren KI-Modelle auf WaveSpeedAI. Keine separate Einrichtung bei Anbietern, keine SDKs pro Anbieter, keine Rate Limits pro Anbieter – eine Integration deckt alles ab, von Text-zu-Bild und Text-zu-Video über Audiosynthese, 3D-Generierung und Hochskalierung bis zur Bearbeitung.
Endpunkte
Alle Wan 2.2-API-Endpunkte
32 Wan 2.2-Endpunkte jetzt auf WaveSpeedAI verfügbar – wählen Sie die Variante, die zu Ihrem Workflow passt.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Beispiele
Wan 2.2 in Aktion
Echte Ausgaben der Wan 2.2-API. Fahren Sie über ein Video für eine Vorschau und klicken Sie, um den Viewer in voller Größe zu öffnen.
Anleitung
So verwenden Sie die Wan 2.2-API
Vier Schritte von der Registrierung bis zur fertigen Generierung. Vollständige Beispiele in Python, Node.js und cURL finden Sie unten im Abschnitt „API“.
- 01
API-Schlüssel holen
Registrieren Sie ein WaveSpeedAI-Konto und kopieren Sie Ihren API-Schlüssel aus dem Dashboard. Neue Konten erhalten kostenlose Start-Credits – genug, um den Playground einige Dutzend Mal zu nutzen, bevor die Abrechnung beginnt.
- 02
Prediction senden
Senden Sie Ihre Eingabe als JSON per POST an https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. Der Endpunkt gibt sofort eine Prediction-ID zurück – Generierungen laufen asynchron, sodass Sie während der Inferenz keine Verbindung offen halten.
- 03
Auf Abschluss prüfen
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Geben Sie bei „completed“ die Ausgaben zurück; brechen Sie bei „failed“, „cancelled“, „timeout“ oder „deleted“ mit einem Fehler ab; fragen Sie bei allen anderen Status weiter ab.
- 04
Ausgabe-URL lesen
Sobald der Status „completed“ ist, lesen Sie die URL aus data.outputs[0]. Die URL verweist auf Ihre generierten Medien im WaveSpeedAI-CDN – Bild, Video, Audio oder 3D-Datei, je nach aufgerufener Variante von Wan 2.2.
Anwendungsfälle
Was Sie mit Wan 2.2 bauen können
Gängige Workflows, für die Entwickler und Kreative die Wan 2.2-API nutzen.
Wan 2.2 Animate – Charakteranimation bis 120 s
wavespeed-ai/wan-2.2/animate ist ein „einheitliches Modell für Charakteranimation und -austausch, das Bewegung und Mimik nachbildet und 720p-Videos bis 120 s erzeugt“. Katalogangabe. Deutlich länger als die meisten posengesteuerten Animations-Tools.
Speech-to-Video bis 10 Minuten
wavespeed-ai/wan-2.2/speech-to-video „macht aus Bildern und Sprache hochwertige Videos mit realistischer Gesichts- und Körperbewegung; unterstützt Clips bis 10 Minuten in 480p“. Nützlich für lange Sprechinhalte.
Video Edit mit promptgesteuerten Änderungen
Mit wavespeed-ai/wan-2.2/video-edit ändern Sie Videos per Text-Prompt (Beispiele aus dem Katalog: Kleidung oder Figuren ändern). Unterstützt 480p und 720p, bis 120 s.
Fun-Control unter Apache-2.0-Lizenz
wavespeed-ai/wan-2.2/fun-control nutzt „Control Codes und multimodale Eingaben, um voreingestellt gesteuerte Videos bis 120 s in 720p zu erzeugen; veröffentlicht unter Apache 2.0 für kommerzielle Nutzung“. Die Apache-2.0-Lizenz ist für kommerzielle Pipelines ein echtes Unterscheidungsmerkmal.
LoRA-Training (10× schneller)
wavespeed-ai/wan-2.2-image-lora-trainer für Bild-LoRA, wavespeed-ai/wan-2.2-i2v-lora-trainer für I2V-LoRA. Katalogangabe: „10x schnelleres Training“. Training für Stil, Figur, Objekt, Bewegung, Action und Videoeffekte wird unterstützt. Laden Sie zum Start eine ZIP-Datei hoch.
Image-to-Video in mehreren Größen (5B / A14B)
Wählen Sie die Modellgröße: 5B (kleiner) für Geschwindigkeit und Kosten oder A14B für volle Qualität. Standard-I2V für 480p; Varianten mit LoRA-Unterstützung; ultraschnelle Varianten.
Tipps
Tipps zum Prompting von Wan 2.2
Praktische Ratschläge für bessere Ausgaben von Wan 2.2 – abgeleitet aus Mustern, die bei Video-Modellen in Produktions-Pipelines funktionieren.
- 01
Die passende Variante für Ihre Aufgabe wählen
Wan 2.2 bietet spezialisierte Endpunkte statt eines Universalmodells. Animate für posengesteuerte Bewegung, Video-Edit für gezielte Änderungen, Speech-to-Video für Sprechinhalte, Image-to-Video für allgemeine Generierung. Ordnen Sie den Endpunkt der Aufgabe zu – deutlich bessere Ausgabe, als wenn ein Universalmodell alles können soll.
- 02
Ein LoRA für Konsistenz im Produktionsmaßstab trainieren
Die LoRA-Trainer-Endpunkte von Wan 2.2 sind vollwertige API-Funktionen und kein Nebenwerkzeug. Für Produktionen, die über Hunderte Generierungen wiederkehrende Identität brauchen (Marken-Maskottchen, wiederkehrende Figur, Signature-Stil), trainieren Sie einmal ein LoRA und rufen Sie für jede Generierung den LoRA-Inferenz-Endpunkt auf.
- 03
Offene Gewichte ermöglichen Fine-Tuning
Konkurrenten mit geschlossenen Gewichten binden Sie an das Modellverhalten des Anbieters. Wan 2.2 hat im Kern offene Gewichte; stoßen Sie an eine Grenze, die das Basismodell nicht lösen kann, ist Fine-Tuning möglich – die meisten anderen kommerziellen Video-APIs bieten diesen Weg nicht.
- 04
Animate mit Kling Motion Control kombinieren
Beide bieten posengesteuerte Animation mit unterschiedlichen Kompromissen. Wan 2.2 Animate hat LoRA-Unterstützung und offene Gewichte; Kling Motion Control bewahrt die Identität stärker. Entscheiden Sie danach, ob Ihnen Fine-Tuning oder Identitätsqualität wichtiger ist.
Preise
Wan 2.2-API-Preise
Die Abrechnung erfolgt pro Ausgabe. Der Endpreis richtet sich nach den Parametern, die Sie im Playground jeder Variante setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen).
API
Die Wan 2.2-API aufrufen
Holen Sie sich unter wavespeed.ai/accesskey einen API-Schlüssel und senden Sie dann eine Prediction per REST. Der Playground erzeugt einfügefertige Beispiele für jede Kombination von Eingaben.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Vergleich
Wan 2.2 im Vergleich zu Alternativen
Wann Sie Wan 2.2 ähnlichen Modellen auf WaveSpeedAI vorziehen sollten.
Wan 2.2 vs. Wan 2.7
Wan 2.7 (alibaba/wan-2.7/*) ist die neuere Alibaba-Architektur mit Reference-to-Video, Video-Edit, Bildbearbeitung und Text-to-Image in einer Familie – ein breiteres modalitätsübergreifendes Toolkit. Wan 2.2 (WaveSpeedAI-Varianten) bietet spezialisierte Endpunkte – Animate (120 s), Speech-to-Video (10 Min.), Fun-Control (Apache 2.0), LoRA-Trainer –, die 2.7 nicht bereitstellt.
Wan 2.2 vs. Seedance 2.0
Seedance 2.0 liefert Ausgabe auf Hollywood-Niveau mit nativem Audio in jeder Variante. Wan 2.2 punktet beim Variantenangebot (über 35 Endpunkte) und beim LoRA-Training – die richtige Wahl, wenn Sie eine bestimmte Spezialfunktion brauchen (Animate, Speech-to-Video, Fun-Control) und kein universelles Videomodell.
Wan 2.2 vs. Kling 3.0 Motion Control
Beide bieten posengesteuerte Charakteranimation. Wan 2.2 Animate erzeugt 120-s-Clips in 720p und bietet LoRA-Fine-Tuning. Kling Motion Control ist an die Dauer des Referenzvideos gebunden (3–30 s), wurde aber mit dem Videokorpus von Kuaishou für stärkere Bewegungs-Priors trainiert.
FAQ
Wan 2.2 API — Häufig gestellte Fragen
Preise, Lizenz, Integration – häufige Fragen zur Nutzung von Wan 2.2 auf WaveSpeedAI.
Was ist die Wan 2.2-API?
Wan 2.2 ist ein Alibaba-Modell für Videogenerierung, das auf WaveSpeedAI als REST-API bereitgestellt wird. Alibabas Wan 2.2 – ein Open-Weight-Video-Toolkit, auf WaveSpeedAI mit über 35 hauseigenen Varianten bereitgestellt: Animate (120 s Charakteranimation), Video Edit, Speech-to-Video (10 Minuten, audiogesteuert), Fun-Control (unter Apache 2.0 lizenziert) sowie Image-to-Video und Text-to-Video in mehreren Modellgrößen (5B, A14B) und Auflösungen (480p / 720p). Sie können es programmatisch aufrufen oder im oben verlinkten Playground ausprobieren.
Wie rufe ich die Wan 2.2-API auf?
Registrieren Sie ein WaveSpeedAI-Konto, kopieren Sie Ihren API-Schlüssel von /accesskey und senden Sie dann per POST an https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video Ihre Eingabe als JSON. Der Endpunkt gibt eine Prediction-ID zurück. Fragen Sie den Ergebnis-Endpunkt etwa alle 2 Sekunden ab, verlängern Sie das Intervall bei lang laufenden Aufgaben und hören Sie bei jedem Endstatus auf. Produktionsnahe Beispiele in Python / Node.js / cURL finden Sie oben.
Was kostet die Wan 2.2-API?
Wan 2.2 beginnt bei $0.02 pro Aufruf. Die genauen Kosten richten sich nach den Parametern, die Sie setzen (Auflösung, Dauer, Anzahl der Ausgaben, Referenzen). Die Live-Kostenvorschau neben der Schaltfläche „Generieren“ im Playground zeigt den genauen Preis für Ihre aktuelle Eingabe.
Welche Varianten von Wan 2.2 sind verfügbar?
WaveSpeedAI stellt 32 aktive Wan 2.2-Endpunkte bereit: wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control und weitere. Jede Variante hat eine eigene Playground-Seite und eigene Preise.
Kann ich die Ausgaben von Wan 2.2 kommerziell nutzen?
Die kommerziellen Nutzungsrechte richten sich nach der Modelllizenz von Alibaba. Die meisten Modelle von Alibaba erlauben die kommerzielle Nutzung der Ausgaben; die konkrete Lizenzzusammenfassung finden Sie auf der Playground-Seite des jeweiligen Modells, die Bedingungen auf Plattformebene in den Nutzungsbedingungen von WaveSpeedAI.
Warum Wan 2.2 auf WaveSpeedAI nutzen statt direkt?
Ein API-Schlüssel und ein Abrechnungskonto für Wan 2.2 UND über 1.000 weitere KI-Modelle anderer Anbieter. Keine SDK-Einrichtung pro Anbieter, keine separaten Rate Limits, kein Neuschreiben von Integrationscode pro Anbieter. Die Preise liegen in der Regel auf dem Niveau der direkten API von Alibaba oder darunter.
Anbieter
Über Alibaba
Das Team hinter Wan 2.2 und der übrigen Modellpalette von Alibaba auf WaveSpeedAI.
Alibabas Tongyi Lab entwickelt die Wan-Familie von Videomodellen und die Qwen-Familie von LLMs. Wan zeichnet sich dadurch aus, dass es mit offenen Gewichten veröffentlicht wird, ein breites Variantenangebot bietet (Text-to-Video, Image-to-Video, Reference-to-Video, Video-Edit, Video-Extend, Bildbearbeitung, Text-to-Image) und bei mehrsprachigen Prompts durchgehend stark in Bewegungsstabilität und Prompt-Treue ist.
Starten Sie mit Wan 2.2 auf WaveSpeedAI
Kostenlose Start-Credits bei der Registrierung. Ein API-Schlüssel für über 1.000 KI-Modelle von Alibaba und allen anderen Anbietern.