Wan 2.2 API
Wan 2.2 от Alibaba — набор видеоинструментов с открытыми весами, развёрнутый в WaveSpeedAI с более чем 35 собственными вариантами: Animate (анимация персонажа до 120 с), Video Edit, Speech-to-Video (до 10 минут по звуку), Fun-Control (лицензия Apache 2.0), а также image-to-video и text-to-video разных размеров моделей (5B, A14B) и разрешений (480p / 720p).
Только варианты, размещённые WaveSpeedAI. Animate создаёт клипы 720p длиной до 120 секунд; Speech-to-Video — клипы 480p длиной до 10 минут; Fun-Control использует готовые Control Codes по лицензии Apache 2.0 для коммерческого использования. Конечные точки обучения LoRA дообучают за минуты.
Обзор
О модели Wan 2.2 API
Что делает Wan 2.2, какое место занимает в линейке моделей Alibaba и почему её выбирают команды.
Wan 2.2 — модель генерации видео от Alibaba, доступная через REST API WaveSpeedAI. Wan 2.2 от Alibaba — набор видеоинструментов с открытыми весами, развёрнутый в WaveSpeedAI с более чем 35 собственными вариантами: Animate (анимация персонажа до 120 с), Video Edit, Speech-to-Video (до 10 минут по звуку), Fun-Control (лицензия Apache 2.0), а также image-to-video и text-to-video разных размеров моделей (5B, A14B) и разрешений (480p / 720p).
Только варианты, размещённые WaveSpeedAI. Animate создаёт клипы 720p длиной до 120 секунд; Speech-to-Video — клипы 480p длиной до 10 минут; Fun-Control использует готовые Control Codes по лицензии Apache 2.0 для коммерческого использования. Конечные точки обучения LoRA дообучают за минуты.
Семейство Wan 2.2 в WaveSpeedAI включает 32 REST-эндпоинта для сценариев: Image-To-Video, Motion-Control, Video-To-Video, Image-To-Image, Digital-Human, Text-To-Image, Training, Text-To-Video. У каждого варианта свои цены, параметры и примеры результатов — выберите тот, что подходит под ваш тип входных данных и требования продакшена, или вызывайте несколько с одним API-ключом и собирайте многошаговые пайплайны.
Запускайте Wan 2.2 с тем же API-ключом, платёжным аккаунтом и лимитами, что и остальные 1000+ ИИ-моделей WaveSpeedAI. Без отдельной регистрации у вендора, без SDK для каждого провайдера, без разных лимитов у каждого поставщика — одна интеграция охватывает всё: от текста в изображение и текста в видео до синтеза аудио, 3D-генерации, апскейлинга и редактирования.
Эндпоинты
Все эндпоинты API Wan 2.2
Сейчас в WaveSpeedAI доступно эндпоинтов Wan 2.2: 32 — выберите вариант под ваш сценарий.
/filters:quality(82)/media/images/20260408111216_2fizlz7x.webp)
Wan 2.2 Image To Video Lora
Wan-2.2/image-to-video-lora enables unlimited image-to-video generation from a single image, producing smooth, cinematic motion with clean detail. Supports custom LoRAs for style and character consistency. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111152_zehbgma1.webp)
Wan 2.2 Image To Video
Wan 2.2 Image-to-Video turns a single image into smooth, cinematic motion with clean detail—ideal for storyboards, mood shots, and product demos. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408111211_p8f6ffxe.webp)
Wan 2.2 Animate
Wan2.2-Animate unified character animation & replacement model replicating movement and expression; generates 720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111241_3bzr5rd1.webp)
Wan 2.2 Video Edit
Wan 2.2 Video Edit lets you modify videos via text prompts (e.g., change clothing or characters). Powered by Wan 2.2, it supports 480p ($0.20/5s) and 720p ($0.40/5s), up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111257_4rmbjsgj.webp)
Wan 2.2 Image To Image
WAN 2.2 (14B) is an image-to-image model for high-resolution photorealistic image editing with exceptional precision and fidelity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111154_gvj4f5sj.webp)
Wan 2.2 Speech To Video
Wan-2.2-S2V turns images and speech into high-fidelity videos with realistic face and body motion; supports up to 10-minute clips in 480p, from $0.15/5s. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111206_p4ked9pu.webp)
Wan 2.2 Text To Image Lora
WAN 2.2 generates super-detailed images from text prompts and supports custom LoRAs for fine-grained style and subject control. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111250_80jkk4zs.webp)
Wan 2.2 Fun Control
Wan2.2-Fun-Control uses Control Codes and multi-modal inputs to generate preset-controlled videos up to 120s at 720p; released under Apache 2.0 for commercial use. Ready-to-use REST API, no coldstarts, affordable.
/filters:quality(82)/media/images/20260408112009_zkynaf2n.webp)
Wan 2.2 Image Lora Trainer
Train custom Wan 2.2 character/style LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408111954_4jny6q8q.webp)
Wan 2.2 I2v Lora Trainer
Train custom Wan 2.2 I2V LoRA models 10x faster. Action training, motion training, video efect training. From concept to model in minutes, not hours. Upload a ZIP file containing videos to start!
/filters:quality(82)/media/images/20260408111226_b3370qq2.webp)
Wan 2.2 Text To Image Realism
WAN 2.2 delivers ultra-realistic text-to-image generation, converting prompts into photoreal images with high fidelity and detail. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111246_kbtz9m3g.webp)
Wan 2.2 I2v 5b 720p Lora
Wan 2.2 i2v-5B-720p is a 5B image-to-video model producing 720p videos with LoRA support for style customization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111210_znuyn6r8.webp)
Wan 2.2 T2v 5b 720p Lora
Wan 2.2 T2V 5B is a 5B text-to-video model with LoRA support that generates 720p videos from text prompts for easy personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111236_0was1j4o.webp)
Wan 2.2 I2v 480p Lora Ultra Fast
Wan 2.2 i2v delivers ultra-fast Image-to-Video at 480p with support for custom LoRAs for tailored styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111252_sejz6k48.webp)
Wan 2.2 I2v 480p Ultra Fast
Wan 2.2 A14B Image-to-Video (i2v-480p) produces ultra-fast 480p videos from single images, enabling unlimited AI video generation with high throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111149_z1lz7r9s.webp)
Wan 2.2 I2v 720p Ultra Fast
Generate unlimited ultra-fast 720p AI videos from images with Wan 2.2 A14B image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111259_8bca6477.webp)
Wan 2.2 T2v 480p Lora Ultra Fast
Ultra-fast Wan 2.2 text-to-video model producing 480p videos with custom LoRA support—generate unlimited AI videos with personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111238_h7qxvir0.webp)
Wan 2.2 I2v 720p Lora Ultra Fast
Wan 2.2 i2v 720P is an ultra-fast Image-to-Video model that generates unlimited AI videos and supports custom LoRAs for personalized outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111248_iyye47z8.webp)
Wan 2.2 T2v 480p Ultra Fast
Wan 2.2 t2v 480p Ultra-Fast generates unlimited AI videos from text prompts at 480p with ultra-fast inference. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111201_lv1td92d.webp)
Wan 2.2 T2v 5b 720p
Wan 2.2 T2V 5B is a 720P text-to-video model that generates unlimited AI videos from simple text prompts, producing consistent high-quality 720p outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111221_xo8hpiqi.webp)
Wan 2.2 I2v 5b 720p
Wan 2.2 I2V 5B converts images into high-quality 720P videos using a 5B image-to-video model for AI video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111214_rct2hj0c.webp)
Wan 2.2 I2v 480p
Wan 2.2 A14B converts images into 480p videos, enabling unlimited AI video generation from single images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111234_cplw518o.webp)
Wan 2.2 I2v 480p Lora
WAN 2.2 A14B Image-to-Video model generates unlimited 480p videos from images and supports custom LoRAs for personalized styles and fine-tuning. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111232_8tgp9v7m.webp)
Wan 2.2 I2v 720p Lora
WAN 2.2 Image-to-Video (i2v) 720p converts images into 720p videos and supports custom LoRAs for style personalization. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111239_qlur3dn5.webp)
Wan 2.2 I2v 720p
WAN 2.2 A14B i2v-720p converts images into smooth 720p videos, enabling unlimited AI video generation with the Wan 2.2 image-to-video model. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111156_b3olejjy.webp)
Wan 2.2 T2v 480p
Wan 2.2 t2v-480p generates unlimited AI videos from text prompts at 480p resolution, ideal for rapid prototyping and content creation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111208_sw0j3xam.webp)
Wan 2.2 T2v 480p Lora
WAN 2.2 T2V 480p with LoRA generates text-to-video at 480p and supports custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111218_00vzkvbl.webp)
Wan 2.2 T2v 720p
Wan 2.2 t2v-720p converts text prompts into native 720P videos, producing high-quality 720P clips from simple prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111230_mtxgxh1x.webp)
Wan 2.2 T2v 720p Lora
Wan 2.2 T2V 720p with custom LoRA support turns text prompts into 720p AI videos and enables unlimited video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111158_csf9651o.webp)
Wan 2.2 T2v 720p Lora Ultra Fast
Ultra-fast Wan 2.2 Text-to-Video generates unlimited 720p AI videos with custom LoRAs for personalized styles. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111244_aqp0x6b0.webp)
Wan 2.2 T2v 720p Ultra Fast
WAN 2.2 T2V 720p Ultra-Fast generates high-quality 720p videos from text prompts with unlimited output and ultra-fast throughput. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786269272686834557_4oOX6gqz.webp)
Wan 2.2 Animate 2
Wan 2.2 Animate 2 is the next-generation Wan character animation model: an end-to-end DiT that makes the character in a reference image perform the motion of a driving video, with no pose extraction, prompt-controlled background, and strong identity preservation; generates 480p/720p videos up to 120s. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Примеры
Wan 2.2 в деле
Реальные результаты, созданные через API Wan 2.2. Наведите курсор на видео для предпросмотра, нажмите, чтобы открыть в полном размере.
Как использовать
Как использовать API Wan 2.2
Четыре шага от регистрации до готовой генерации. Полные примеры на Python, Node.js и cURL — в разделе API ниже.
- 01
Получите API-ключ
Создайте аккаунт WaveSpeedAI и скопируйте API-ключ на панели управления. Новые аккаунты получают бесплатные стартовые кредиты — их хватит, чтобы несколько десятков раз запустить playground до начала списаний.
- 02
Отправьте предсказание
Отправьте входные данные в формате JSON методом POST на https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video. Эндпоинт сразу возвращает id предсказания — генерация асинхронная, поэтому соединение не нужно держать открытым на время инференса.
- 03
Опрашивайте до завершения
Выполняйте GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. При статусе completed забирайте результат; при failed, cancelled, timeout или deleted остановитесь с ошибкой; при любом другом статусе продолжайте опрос.
- 04
Получите URL результата
Когда статус станет "completed", возьмите URL из data.outputs[0]. Он указывает на созданный файл в CDN WaveSpeedAI — изображение, видео, аудио или 3D-файл, в зависимости от вызванного варианта Wan 2.2.
Сценарии применения
Что можно создать с Wan 2.2
Типичные сценарии, для которых разработчики и авторы используют API Wan 2.2.
Wan 2.2 Animate — анимация персонажа до 120 с
wavespeed-ai/wan-2.2/animate — «единая модель анимации и замены персонажа, воспроизводящая движение и мимику; создаёт видео 720p длиной до 120 с». Заявление из каталога. Значительно дольше большинства инструментов анимации по позе.
Speech-to-Video до 10 минут
wavespeed-ai/wan-2.2/speech-to-video «превращает изображения и речь в детализированное видео с реалистичным движением лица и тела; поддерживает клипы до 10 минут в 480p». Полезно для длинного говорящего контента.
Video Edit с изменениями по промпту
wavespeed-ai/wan-2.2/video-edit позволяет менять видео текстовыми промптами (примеры из каталога: смена одежды или персонажей). Поддерживает 480p и 720p, до 120 с.
Fun-Control с лицензией Apache 2.0
wavespeed-ai/wan-2.2/fun-control использует «Control Codes и мультимодальные входные данные для создания видео с готовым управлением длиной до 120 с в 720p; выпущен по лицензии Apache 2.0 для коммерческого использования». Лицензия Apache 2.0 — реальное преимущество для коммерческих конвейеров.
Обучение LoRA (в 10 раз быстрее)
wavespeed-ai/wan-2.2-image-lora-trainer — для LoRA изображений, wavespeed-ai/wan-2.2-i2v-lora-trainer — для LoRA I2V. Заявление из каталога: «обучение в 10 раз быстрее». Поддерживается обучение стилю, персонажу, объекту, движению, действию и видеоэффектам. Для старта загрузите ZIP-файл.
Image-to-Video разных размеров (5B / A14B)
Выберите размер модели: 5B (меньше) — для скорости и цены, или A14B — для полного качества. Стандартный i2v для 480p; варианты с поддержкой LoRA; сверхбыстрые варианты.
Советы
Советы по написанию запросов для Wan 2.2
Практические советы, как получать лучшие результаты от Wan 2.2, — на основе приёмов, которые работают в продакшен-пайплайнах для моделей видео.
- 01
Выбирайте вариант под задачу
Wan 2.2 предлагает специализированные конечные точки, а не одну универсальную модель. Animate — для движения по позе, video-edit — для точечных изменений, speech-to-video — для говорящего контента, image-to-video — для общей генерации. Подбирайте конечную точку под задачу — результат заметно лучше, чем если просить универсальную модель делать всё.
- 02
Обучите LoRA для согласованности в продакшен-масштабе
Конечные точки обучения LoRA в Wan 2.2 — полноценные функции API, а не вспомогательный инструмент. Для проектов, где нужен повторяющийся облик в сотнях генераций (фирменный маскот, постоянный персонаж, узнаваемый стиль), обучите LoRA один раз и вызывайте конечную точку инференса LoRA в каждой генерации.
- 03
Открытые веса позволяют дообучать
Конкуренты с закрытыми весами привязывают вас к поведению модели вендора. В основе Wan 2.2 — открытые веса, так что при ограничении, которое базовая модель не решает, дообучение остаётся возможным — большинство других коммерческих видео API такого пути не предлагают.
- 04
Сочетайте Animate с Kling Motion Control
Оба предлагают анимацию по позе с разными компромиссами. У Wan 2.2 Animate есть поддержка LoRA и открытые веса; у Kling Motion Control — более сильное сохранение облика. Выбирайте в зависимости от того, что важнее — дообучение или качество облика.
Цены
Цены на API Wan 2.2
Оплата — за каждый результат. Итоговая стоимость зависит от параметров, заданных в playground каждого варианта (разрешение, длительность, количество результатов, референсы).
API
Вызов API Wan 2.2
Получите API-ключ на wavespeed.ai/accesskey, затем отправьте предсказание через REST. Playground генерирует готовые к вставке примеры для любой комбинации входных данных.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Сравнение
Wan 2.2 и альтернативы
Когда стоит выбрать Wan 2.2, а не похожие модели в WaveSpeedAI.
Wan 2.2 и Wan 2.7
Wan 2.7 (alibaba/wan-2.7/*) — более новая архитектура Alibaba с reference-to-video, video-edit, редактированием изображений и text-to-image в одном семействе — более широкий кросс-модальный набор. Wan 2.2 (варианты WaveSpeedAI) предлагает специализированные конечные точки — Animate (120 с), Speech-to-Video (10 минут), Fun-Control (Apache 2.0), тренеры LoRA, — которых в 2.7 нет.
Wan 2.2 и Seedance 2.0
Seedance 2.0 даёт результат голливудского уровня с нативным звуком во всех вариантах. Wan 2.2 выигрывает по набору вариантов (более 35 конечных точек) и возможностям обучения LoRA — правильный выбор, когда нужна конкретная специализированная возможность (Animate, Speech-to-Video, Fun-Control), а не универсальная видеомодель.
Wan 2.2 и Kling 3.0 Motion Control
Обе предлагают анимацию персонажа по позе. Wan 2.2 Animate создаёт клипы 720p длиной 120 с и поддерживает дообучение LoRA. Kling Motion Control ограничен длительностью референсного видео (3–30 с), но обучен на видеокорпусе Kuaishou для более сильных априорных знаний о движении.
FAQ
Wan 2.2 API — часто задаваемые вопросы
Цены, лицензия, интеграция — частые вопросы о запуске Wan 2.2 в WaveSpeedAI.
Что такое API Wan 2.2?
Wan 2.2 — модель генерации видео от Alibaba, доступная как REST API в WaveSpeedAI. Wan 2.2 от Alibaba — набор видеоинструментов с открытыми весами, развёрнутый в WaveSpeedAI с более чем 35 собственными вариантами: Animate (анимация персонажа до 120 с), Video Edit, Speech-to-Video (до 10 минут по звуку), Fun-Control (лицензия Apache 2.0), а также image-to-video и text-to-video разных размеров моделей (5B, A14B) и разрешений (480p / 720p). Её можно вызывать программно или попробовать в playground по ссылке выше.
Как вызывать API Wan 2.2?
Создайте аккаунт WaveSpeedAI, скопируйте API-ключ на странице /accesskey и отправьте POST на https://api.wavespeed.ai/api/v3/wavespeed-ai/wan-2.2/image-to-video с входными данными в JSON. Эндпоинт вернёт id предсказания. Опрашивайте эндпоинт результата примерно раз в 2 секунды, для долгих задач увеличивайте интервал и останавливайтесь на любом финальном статусе. Примеры для продакшена на Python / Node.js / cURL — выше.
Сколько стоит API Wan 2.2?
Wan 2.2 стоит от $0.02 за запуск. Точная стоимость зависит от заданных параметров (разрешение, длительность, количество результатов, референсы). Предпросмотр стоимости рядом с кнопкой «Сгенерировать» в playground показывает точную цену для ваших текущих данных.
Какие варианты Wan 2.2 доступны?
В WaveSpeedAI доступно рабочих эндпоинтов Wan 2.2: 32 — wavespeed-ai/wan-2.2/image-to-video-lora, wavespeed-ai/wan-2.2/image-to-video, wavespeed-ai/wan-2.2/animate, wavespeed-ai/wan-2.2/video-edit, wavespeed-ai/wan-2.2/image-to-image, wavespeed-ai/wan-2.2/speech-to-video, wavespeed-ai/wan-2.2/text-to-image-lora, wavespeed-ai/wan-2.2/fun-control, и другие. У каждого варианта своя страница playground и свои цены.
Можно ли использовать результаты Wan 2.2 в коммерческих целях?
Права на коммерческое использование определяются лицензией модели Alibaba. Большинство моделей Alibaba разрешают коммерческое использование результатов; краткое описание лицензии смотрите на странице playground каждой модели, а условия платформы — в Условиях использования WaveSpeedAI.
Зачем использовать Wan 2.2 в WaveSpeedAI, а не напрямую?
Один API-ключ и один платёжный аккаунт для Wan 2.2 И для 1000+ других ИИ-моделей от разных провайдеров. Без настройки SDK для каждого вендора, без отдельных лимитов, без переписывания интеграционного кода под каждого поставщика. Цены, как правило, на уровне прямого API Alibaba или ниже.
Разработчик
О Alibaba
Команда, стоящая за Wan 2.2 и всей линейкой моделей Alibaba в WaveSpeedAI.
Лаборатория Tongyi Lab компании Alibaba выпускает семейство видеомоделей Wan и семейство LLM Qwen. Wan известна открытыми весами, широким набором вариантов (text-to-video, image-to-video, reference-to-video, video-edit, video-extend, image-edit, text-to-image) и стабильно сильными показателями по устойчивости движения и следованию промпту в многоязычных запросах.
Начните создавать с Wan 2.2 в WaveSpeedAI
Бесплатные стартовые кредиты при регистрации. Один API-ключ для 1000+ ИИ-моделей от Alibaba и всех остальных провайдеров.