Wan 2.2 API
Alibaba Wan 2.2 — zestaw narzędzi wideo open-weight wdrożony w WaveSpeedAI z ponad 35 własnymi wariantami: Animate (120-sekundowa animacja postaci), Video Edit, Speech-to-Video (10-minutowe wideo sterowane dźwiękiem), Fun-Control (licencja Apache 2.0) oraz obraz na wideo i tekst na wideo w wielu rozmiarach modelu (5B, A14B) i rozdzielczościach (480p / 720p).
Tylko warianty hostowane przez WaveSpeedAI. Animate tworzy klipy 720p do 120 sekund; Speech-to-Video tworzy klipy 480p do 10 minut; Fun-Control używa gotowych Control Codes na licencji Apache 2.0 do użytku komercyjnego. Endpointy trenowania LoRA dostrajają w kilka minut.
Przegląd
O modelu Wan 2.2 API
Co robi Wan 2.2, jakie miejsce zajmuje w linii modeli Alibaba i dlaczego zespoły po niego sięgają.
Wan 2.2 to model generowania wideo od Alibaba, dostępny przez REST API WaveSpeedAI. Alibaba Wan 2.2 — zestaw narzędzi wideo open-weight wdrożony w WaveSpeedAI z ponad 35 własnymi wariantami: Animate (120-sekundowa animacja postaci), Video Edit, Speech-to-Video (10-minutowe wideo sterowane dźwiękiem), Fun-Control (licencja Apache 2.0) oraz obraz na wideo i tekst na wideo w wielu rozmiarach modelu (5B, A14B) i rozdzielczościach (480p / 720p).
Tylko warianty hostowane przez WaveSpeedAI. Animate tworzy klipy 720p do 120 sekund; Speech-to-Video tworzy klipy 480p do 10 minut; Fun-Control używa gotowych Control Codes na licencji Apache 2.0 do użytku komercyjnego. Endpointy trenowania LoRA dostrajają w kilka minut.
Rodzina Wan 2.2 w WaveSpeedAI zawiera 32 endpointy REST obejmujące workflowy: Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.
Uruchamiaj Wan 2.2 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.
Endpointy
Wszystkie endpointy API Wan 2.2
32 endpointy Wan 2.2 dostępne teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Przykłady
Wan 2.2 w akcji
Prawdziwe wyniki wygenerowane przez API Wan 2.2. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.
Jak zacząć
Jak korzystać z API Wan 2.2
Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.
- 01
Uzyskaj klucz API
Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.
- 02
Wyślij predykcję
Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.
- 03
Sprawdzaj ukończenie
Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.
- 04
Odczytaj adres wyniku
Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu Wan 2.2.
Zastosowania
Co możesz zbudować z Wan 2.2
Typowe workflowy, do których deweloperzy i twórcy używają API Wan 2.2.
Wan 2.2 Animate — animacja postaci do 120 s
wavespeed-ai/wan-2.2/animate to „ujednolicony model animacji i zastępowania postaci, który odtwarza ruch i mimikę; generuje wideo 720p do 120 s”. Deklaracja z katalogu. Znacznie dłużej niż w większości narzędzi do animacji sterowanej pozą.
Speech-to-Video do 10 minut
wavespeed-ai/wan-2.2/speech-to-video „zamienia obrazy i mowę w wierne wideo z realistycznym ruchem twarzy i ciała; obsługuje klipy do 10 minut w 480p”. Przydatne w długich treściach z mówiącą postacią.
Video Edit ze zmianami sterowanymi promptem
wavespeed-ai/wan-2.2/video-edit pozwala modyfikować wideo za pomocą promptów tekstowych (przykłady z katalogu: zmiana ubrań lub postaci). Obsługuje 480p i 720p, do 120 s.
Fun-Control na licencji Apache 2.0
wavespeed-ai/wan-2.2/fun-control używa „Control Codes i danych wejściowych multimodalnych do generowania wideo sterowanego presetami do 120 s w 720p; wydany na licencji Apache 2.0 do użytku komercyjnego”. Licencja Apache 2.0 to realny wyróżnik dla potoków komercyjnych.
Trenowanie LoRA (10× szybciej)
wavespeed-ai/wan-2.2-image-lora-trainer dla LoRA obrazów, wavespeed-ai/wan-2.2-i2v-lora-trainer dla LoRA I2V. Deklaracja z katalogu: „10x szybsze trenowanie”. Obsługiwane trenowanie stylu, postaci, obiektu, ruchu, akcji i efektów wideo. Wgraj plik ZIP, aby zacząć.
Obraz na wideo w wielu rozmiarach (5B / A14B)
Wybierz rozmiar modelu: 5B (mniejszy) dla szybkości/kosztu lub A14B dla pełnej jakości. Standardowe i2v dla 480p; warianty z obsługą LoRA; ultraszybkie warianty.
Wskazówki
Wskazówki do promptów dla Wan 2.2
Praktyczne rady, jak uzyskiwać lepsze wyniki z Wan 2.2 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli wideo.
- 01
Wybierz wariant do zadania
Wan 2.2 oferuje wyspecjalizowane endpointy zamiast jednego modelu ogólnego przeznaczenia. Animate dla ruchu sterowanego pozą, video-edit dla ukierunkowanych zmian, speech-to-video dla treści z mówiącą postacią, obraz na wideo dla generowania ogólnego. Dopasuj endpoint do zadania — wyniki są znacznie lepsze niż przy proszeniu modelu ogólnego o wszystko.
- 02
Wytrenuj LoRA dla spójności na skalę produkcyjną
Endpointy trenera LoRA w Wan 2.2 to pełnoprawne funkcje API, a nie narzędzie poboczne. W produkcjach wymagających powracającej tożsamości w setkach generacji (maskotka marki, powracająca postać, sygnaturowy styl) wytrenuj LoRA raz i wywołuj endpoint inferencji LoRA przy każdym generowaniu.
- 03
Otwarte wagi umożliwiają dostrajanie
Konkurenci z zamkniętymi wagami wiążą Cię z zachowaniem modelu dostawcy. Wan 2.2 pod spodem ma otwarte wagi, więc gdy napotkasz ograniczenie, którego model bazowy nie rozwiąże, dostrajanie wchodzi w grę — większość innych komercyjnych API wideo nie oferuje tej ścieżki.
- 04
Połącz Animate z Kling Motion Control
Oba oferują animację sterowaną pozą z różnymi kompromisami. Wan 2.2 Animate ma obsługę LoRA i otwarte wagi; Kling Motion Control lepiej zachowuje tożsamość. Wybierz w zależności od tego, czy ważniejsze jest dostrajanie, czy jakość tożsamości.
Cennik
Cennik API Wan 2.2
Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).
API
Wywołaj API Wan 2.2
Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Porównanie
Wan 2.2 a alternatywy
Kiedy wybrać Wan 2.2 zamiast podobnych modeli w WaveSpeedAI.
Wan 2.2 a Wan 2.7
Wan 2.7 (alibaba/wan-2.7/*) to nowsza architektura Alibaba z referencją na wideo, video-edit, image-edit i tekstem na obraz w jednej rodzinie — szerszy zestaw narzędzi między modalnościami. Wan 2.2 (warianty WaveSpeedAI) oferuje wyspecjalizowane endpointy — Animate (120 s), Speech-to-Video (10 min), Fun-Control (Apache 2.0), trenery LoRA — których 2.7 nie udostępnia.
Wan 2.2 a Seedance 2.0
Seedance 2.0 zapewnia wyjście klasy hollywoodzkiej z natywnym dźwiękiem w każdym wariancie. Wan 2.2 wygrywa zakresem wariantów (ponad 35 endpointów) i trenowaniem LoRA — to właściwy wybór, gdy potrzebujesz konkretnej wyspecjalizowanej możliwości (Animate, Speech-to-Video, Fun-Control), a nie modelu wideo ogólnego przeznaczenia.
Wan 2.2 a Kling 3.0 Motion Control
Oba oferują animację postaci sterowaną pozą. Wan 2.2 Animate tworzy klipy 720p do 120 s i oferuje dostrajanie LoRA. Kling Motion Control jest ograniczony do długości wideo referencyjnego (3–30 s), ale wytrenowany na korpusie wideo Kuaishou dla silniejszych priorytetów ruchu.
FAQ
Wan 2.2 API — najczęściej zadawane pytania
Cennik, licencja, integracja — typowe pytania o uruchamianie Wan 2.2 w WaveSpeedAI.
Czym jest API Wan 2.2?
Wan 2.2 to model generowania wideo od Alibaba, udostępniony jako REST API w WaveSpeedAI. Alibaba Wan 2.2 — zestaw narzędzi wideo open-weight wdrożony w WaveSpeedAI z ponad 35 własnymi wariantami: Animate (120-sekundowa animacja postaci), Video Edit, Speech-to-Video (10-minutowe wideo sterowane dźwiękiem), Fun-Control (licencja Apache 2.0) oraz obraz na wideo i tekst na wideo w wielu rozmiarach modelu (5B, A14B) i rozdzielczościach (480p / 720p). Możesz wywoływać go programowo lub wypróbować w playground, do którego prowadzi link powyżej.
Jak wywołać API Wan 2.2?
Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.
Ile kosztuje API Wan 2.2?
Wan 2.2 zaczyna się od $0.02 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.
Jakie warianty Wan 2.2 są dostępne?
WaveSpeedAI udostępnia 32 aktywnych endpointów Wan 2.2: wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control, i inne. Każdy wariant ma własną stronę playground i cennik.
Czy mogę używać wyników Wan 2.2 komercyjnie?
Prawa do komercyjnego użycia wynikają z licencji modelu Alibaba. Większość modeli Alibaba zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.
Dlaczego korzystać z Wan 2.2 w WaveSpeedAI zamiast bezpośrednio?
Jeden klucz API i jedno konto rozliczeniowe dla Wan 2.2 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API Alibaba lub niższe.
Dostawca
O Alibaba
Zespół stojący za Wan 2.2 i szerszą linią modeli Alibaba w WaveSpeedAI.
Laboratorium Tongyi Alibaby tworzy rodzinę modeli wideo Wan oraz rodzinę modeli LLM Qwen. Wan wyróżnia się wydaniem z otwartymi wagami, szerokim zakresem wariantów (tekst na wideo, obraz na wideo, referencja na wideo, video-edit, video-extend, image-edit, tekst na obraz) oraz stałą mocną stroną w stabilności ruchu i wierności promptom w wielu językach.
Zacznij budować z Wan 2.2 w WaveSpeedAI
Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od Alibaba i wszystkich innych dostawców.