Wan 2.2 API
Wan 2.2 di Alibaba — toolkit video a pesi aperti distribuito su WaveSpeedAI con oltre 35 varianti proprietarie: Animate (animazione di personaggi fino a 120 s), Video Edit, Speech-to-Video (10 minuti guidati dall'audio), Fun-Control (licenza Apache 2.0), più image-to-video e text-to-video in diverse dimensioni del modello (5B, A14B) e risoluzioni (480p / 720p).
Solo varianti ospitate da WaveSpeedAI. Animate produce clip 720p fino a 120 secondi; Speech-to-Video produce clip 480p fino a 10 minuti; Fun-Control usa Control Codes predefiniti con licenza Apache 2.0 per uso commerciale. Gli endpoint di addestramento LoRA eseguono il fine-tuning in pochi minuti.
Panoramica
Informazioni su Wan 2.2 API
Cosa fa Wan 2.2, come si inserisce nella gamma di modelli di Alibaba e perché i team lo scelgono.
Wan 2.2 è un modello di generazione video di Alibaba, disponibile tramite l'API REST di WaveSpeedAI. Wan 2.2 di Alibaba — toolkit video a pesi aperti distribuito su WaveSpeedAI con oltre 35 varianti proprietarie: Animate (animazione di personaggi fino a 120 s), Video Edit, Speech-to-Video (10 minuti guidati dall'audio), Fun-Control (licenza Apache 2.0), più image-to-video e text-to-video in diverse dimensioni del modello (5B, A14B) e risoluzioni (480p / 720p).
Solo varianti ospitate da WaveSpeedAI. Animate produce clip 720p fino a 120 secondi; Speech-to-Video produce clip 480p fino a 10 minuti; Fun-Control usa Control Codes predefiniti con licenza Apache 2.0 per uso commerciale. Gli endpoint di addestramento LoRA eseguono il fine-tuning in pochi minuti.
La famiglia Wan 2.2 su WaveSpeedAI offre 32 endpoint REST che coprono i flussi di lavoro Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. Ogni variante ha il suo prezzo, i suoi parametri e i suoi esempi di output: scegli quella più adatta alla tua modalità di input e ai tuoi vincoli di produzione, oppure richiamane diverse con la stessa chiave API per comporre pipeline in più passaggi.
Usa Wan 2.2 con la stessa chiave API, lo stesso account di fatturazione e gli stessi limiti di frequenza che usi per gli altri oltre 1.000 modelli AI di WaveSpeedAI. Nessuna configurazione separata per fornitore, nessun SDK per provider, nessun limite di frequenza per fornitore: un'unica integrazione copre tutto, dal text-to-image e text-to-video alla sintesi audio, alla generazione 3D, all'upscaling e all'editing.
Endpoint
Tutti gli endpoint API Wan 2.2
32 endpoint Wan 2.2 disponibili ora su WaveSpeedAI: scegli la variante più adatta al tuo flusso di lavoro.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Esempi
Wan 2.2 in azione
Output reali generati dall'API Wan 2.2. Passa il mouse su un video per l'anteprima, clicca per aprire il visualizzatore a schermo intero.
Guida
Come usare l'API Wan 2.2
Quattro passaggi dalla registrazione alla generazione completata. Esempi completi in Python, Node.js e cURL sono nella sezione API qui sotto.
- 01
Ottieni una chiave API
Registrati su WaveSpeedAI e copia la tua chiave API dalla dashboard. I nuovi account includono crediti gratuiti di benvenuto: bastano per usare il playground qualche decina di volte prima che inizi la fatturazione.
- 02
Invia una predizione
Invia con POST il tuo input in formato JSON a https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. L'endpoint restituisce subito un id di predizione: le generazioni sono asincrone, quindi non devi tenere una connessione aperta durante l'inferenza.
- 03
Controlla il completamento
Fai GET su https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Restituisci gli output con completed; interrompi con un errore con failed, cancelled, timeout o deleted; continua il polling per ogni altro stato.
- 04
Leggi l'URL dell'output
Quando lo stato è "completed", leggi l'URL da data.outputs[0]. L'URL punta al tuo contenuto generato sulla CDN di WaveSpeedAI: immagine, video, audio o file 3D a seconda della variante di Wan 2.2 che hai richiamato.
Casi d'uso
Cosa puoi creare con Wan 2.2
I flussi di lavoro più comuni per cui sviluppatori e creator usano l'API Wan 2.2.
Wan 2.2 Animate — animazione di personaggi fino a 120 s
wavespeed-ai/wan-2.2/animate è un «modello unificato di animazione e sostituzione di personaggi che replica movimento ed espressione; genera video 720p fino a 120 s». Dichiarazione a catalogo. Molto più lungo della maggior parte degli strumenti di animazione guidata dalla posa.
Speech-to-Video fino a 10 minuti
wavespeed-ai/wan-2.2/speech-to-video «trasforma immagini e parlato in video ad alta fedeltà con movimento realistico di volto e corpo; supporta clip fino a 10 minuti in 480p». Utile per contenuti parlati di lunga durata.
Video Edit con modifiche guidate dal prompt
wavespeed-ai/wan-2.2/video-edit permette di modificare i video tramite prompt testuali (esempi a catalogo: cambiare abiti o personaggi). Supporta 480p e 720p, fino a 120 s.
Fun-Control con licenza Apache 2.0
wavespeed-ai/wan-2.2/fun-control usa «Control Codes e input multimodali per generare video controllati da preset fino a 120 s a 720p; rilasciato con licenza Apache 2.0 per uso commerciale». La licenza Apache 2.0 è un vero elemento di differenziazione per le pipeline commerciali.
Addestramento LoRA (10× più veloce)
wavespeed-ai/wan-2.2-image-lora-trainer per LoRA di immagini, wavespeed-ai/wan-2.2-i2v-lora-trainer per LoRA I2V. Dichiarazione a catalogo: «addestramento 10 volte più veloce». Supportato l'addestramento di stile, personaggio, oggetto, movimento, azione ed effetti video. Carica un file ZIP per iniziare.
Image-to-Video in più dimensioni (5B / A14B)
Scegli la dimensione del modello: 5B (più piccolo) per velocità/costo, oppure A14B per la qualità piena. i2v standard per 480p; varianti con supporto LoRA; varianti ultra-veloci.
Consigli
Consigli per scrivere i prompt per Wan 2.2
Consigli pratici per ottenere output migliori da Wan 2.2, ricavati dagli schemi che funzionano con i modelli video nelle pipeline di produzione.
- 01
Scegli la variante adatta al tuo compito
Wan 2.2 offre endpoint specializzati anziché un unico modello generico. Animate per il movimento guidato dalla posa, video-edit per modifiche mirate, speech-to-video per contenuti parlati, image-to-video per la generazione generica. Abbina l'endpoint al compito — output nettamente migliori rispetto a chiedere a un modello generico di fare tutto.
- 02
Addestra una LoRA per la coerenza su scala di produzione
Gli endpoint dei trainer LoRA di Wan 2.2 sono funzioni API di prima classe, non uno strumento secondario. Per produzioni che richiedono un'identità ricorrente in centinaia di generazioni (mascotte del brand, personaggio ricorrente, stile distintivo), addestra una LoRA una volta e chiama l'endpoint di inferenza LoRA a ogni generazione.
- 03
I pesi aperti consentono il fine-tuning
I concorrenti a pesi chiusi ti vincolano al comportamento del modello del fornitore. Wan 2.2 alla base è a pesi aperti, quindi quando incontri un limite che il modello base non risolve, il fine-tuning è un'opzione — la maggior parte delle altre API video commerciali non offre questo percorso.
- 04
Combina Animate con Kling Motion Control
Entrambi offrono animazione guidata dalla posa con compromessi diversi. Wan 2.2 Animate ha supporto LoRA e pesi aperti; Kling Motion Control ha una conservazione dell'identità più forte. Scegli in base a cosa conta di più: il fine-tuning o la qualità dell'identità.
Prezzi
Prezzi dell'API Wan 2.2
Il prezzo è per output. L'addebito finale dipende dai parametri impostati nel playground di ciascuna variante (risoluzione, durata, numero di output, riferimenti).
API
Richiama l'API Wan 2.2
Ottieni una chiave API su wavespeed.ai/accesskey, poi invia una predizione tramite REST. Il playground genera esempi pronti da incollare per qualsiasi combinazione di input.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Confronto
Wan 2.2 a confronto con le alternative
Quando scegliere Wan 2.2 rispetto a modelli simili su WaveSpeedAI.
Wan 2.2 vs Wan 2.7
Wan 2.7 (alibaba/wan-2.7/*) è la più recente architettura di Alibaba, con reference-to-video, video-edit, image-edit e text-to-image in un'unica famiglia — un toolkit cross-modale più ampio. Wan 2.2 (varianti WaveSpeedAI) offre endpoint specializzati — Animate (120 s), Speech-to-Video (10 minuti), Fun-Control (Apache 2.0), trainer LoRA — che la 2.7 non espone.
Wan 2.2 vs Seedance 2.0
Seedance 2.0 offre output di livello hollywoodiano con audio nativo in ogni variante. Wan 2.2 vince per ampiezza di varianti (oltre 35 endpoint) e per l'addestramento LoRA — la scelta giusta quando serve una capacità specializzata (Animate, Speech-to-Video, Fun-Control) anziché un modello video generico.
Wan 2.2 vs Kling 3.0 Motion Control
Entrambi offrono animazione di personaggi guidata dalla posa. Wan 2.2 Animate produce clip 720p da 120 s e offre il fine-tuning LoRA. Kling Motion Control è vincolato alla durata del video di riferimento (3-30 s) ma addestrato sul corpus video di Kuaishou per prior di movimento più solidi.
FAQ
Wan 2.2 API — Domande frequenti
Prezzi, licenza, integrazione: le domande più comuni sull'uso di Wan 2.2 su WaveSpeedAI.
Che cos'è l'API Wan 2.2?
Wan 2.2 è un modello di generazione video di Alibaba reso disponibile come API REST su WaveSpeedAI. Wan 2.2 di Alibaba — toolkit video a pesi aperti distribuito su WaveSpeedAI con oltre 35 varianti proprietarie: Animate (animazione di personaggi fino a 120 s), Video Edit, Speech-to-Video (10 minuti guidati dall'audio), Fun-Control (licenza Apache 2.0), più image-to-video e text-to-video in diverse dimensioni del modello (5B, A14B) e risoluzioni (480p / 720p). Puoi richiamarlo da codice o provarlo dal playground collegato qui sopra.
Come richiamo l'API Wan 2.2?
Registrati su WaveSpeedAI, copia la tua chiave API da /accesskey, poi invia con POST a https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video il tuo input in formato JSON. L'endpoint restituisce un id di predizione. Fai polling sull'endpoint dei risultati circa ogni 2 secondi, aumenta l'intervallo per le attività di lunga durata e fermati a qualsiasi stato terminale. Gli esempi in Python / Node.js / cURL orientati alla produzione sono qui sopra.
Quanto costa l'API Wan 2.2?
Wan 2.2 parte da $0.02 per esecuzione. Il costo esatto dipende dai parametri impostati (risoluzione, durata, numero di output, riferimenti). L'anteprima del costo in tempo reale accanto al pulsante Genera nel playground mostra il prezzo esatto per il tuo input attuale.
Quali varianti di Wan 2.2 sono disponibili?
WaveSpeedAI offre 32 endpoint Wan 2.2 attivi: wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control, e altri. Ogni variante ha la sua pagina playground e i suoi prezzi.
Posso usare gli output di Wan 2.2 a fini commerciali?
I diritti di uso commerciale seguono la licenza del modello di Alibaba. La maggior parte dei modelli di Alibaba consente l'uso commerciale degli output; consulta la pagina playground di ciascun modello per il riepilogo della licenza e i Termini di servizio di WaveSpeedAI per le condizioni a livello di piattaforma.
Perché usare Wan 2.2 su WaveSpeedAI invece di rivolgersi direttamente al fornitore?
Una sola chiave API e un solo account di fatturazione per Wan 2.2 E per oltre 1.000 altri modelli AI di altri provider. Nessuna configurazione di SDK per fornitore, nessun limite di frequenza separato, nessun codice di integrazione da riscrivere per ogni fornitore. I prezzi sono in genere in linea o inferiori a quelli dell'API diretta di Alibaba.
Provider
Informazioni su Alibaba
Il team dietro Wan 2.2 e dietro l'intera gamma di modelli di Alibaba su WaveSpeedAI.
Il Tongyi Lab di Alibaba produce la famiglia di modelli video Wan e la famiglia di LLM Qwen. Wan si distingue per il rilascio con pesi aperti, un'ampia copertura di varianti (text-to-video, image-to-video, reference-to-video, video-edit, video-extend, image-edit, text-to-image) e una costante solidità in stabilità del movimento e aderenza al prompt con prompt multilingue.
Inizia a creare con Wan 2.2 su WaveSpeedAI
Crediti gratuiti di benvenuto alla registrazione. Una sola chiave API per oltre 1.000 modelli AI di Alibaba e di ogni altro provider.