Qwen Image API
Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다.
기본, 향상된 2512, 2.0-pro 변형의 텍스트-투-이미지입니다. 편집 엔드포인트에는 Edit, Edit-Plus(멀티 이미지, ControlNet), Edit-LoRA, Edit-Multiple-Angles(96포즈 카메라 시스템), Layered(프롬프트 기반 분해)가 있습니다. Qwen Image 2.0 패밀리 변형도 같은 접두사 아래에 포함됩니다.
/filters:quality(82)/examples/e26b4143e025f71d55e3e5704c446d2b/1783682236366122456_NdT2cmvE.webp)
개요
Qwen Image API 소개
Qwen Image의 기능, Alibaba 모델 라인업에서의 위치, 그리고 팀들이 이 모델을 선택하는 이유.
Alibaba의 이미지 생성 및 편집 모델 Qwen Image. WaveSpeedAI REST API로 바로 사용할 수 있습니다. Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다.
기본, 향상된 2512, 2.0-pro 변형의 텍스트-투-이미지입니다. 편집 엔드포인트에는 Edit, Edit-Plus(멀티 이미지, ControlNet), Edit-LoRA, Edit-Multiple-Angles(96포즈 카메라 시스템), Layered(프롬프트 기반 분해)가 있습니다. Qwen Image 2.0 패밀리 변형도 같은 접두사 아래에 포함됩니다.
WaveSpeedAI의 Qwen Image 제품군은 Image-To-Image, Text-To-Image, Training 워크플로를 아우르는 REST 엔드포인트 21개를 제공합니다. 각 변형은 고유한 가격, 파라미터, 예시 출력을 갖고 있으니 입력 방식과 운영 조건에 맞는 것을 고르거나, 같은 API 키로 여러 개를 호출해 다단계 파이프라인을 구성하세요.
Qwen Image 실행에도 WaveSpeedAI의 다른 1,000개 이상의 AI 모델과 같은 API 키, 결제 계정, 요청 한도 체계를 그대로 사용합니다. 별도의 벤더 설정도, 제공사별 SDK도, 벤더별 요청 한도 체계도 필요 없습니다. 하나의 연동으로 텍스트 → 이미지, 텍스트 → 비디오부터 오디오 합성, 3D 생성, 업스케일링, 편집까지 모두 지원합니다.
엔드포인트
Qwen Image API 전체 엔드포인트
Qwen Image 엔드포인트 21개를 지금 WaveSpeedAI에서 사용할 수 있습니다. 워크플로에 맞는 변형을 고르세요.
/filters:quality(82)/media/images/20260408110013_8als1nwx.webp)
Qwen Image 2.0 Edit
Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110922_079iorac.webp)
Qwen Image 2.0 Pro Edit
Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110019_rr2dv7f5.webp)
Qwen Image 2.0 Text To Image
Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110930_uej3wr3b.webp)
Qwen Image 2.0 Pro Text To Image
Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110201_c4uo1ban.webp)
Qwen Image Edit 2509 Multiple Angles
Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105730_1fu19xjx.webp)
Qwen Image Max Edit
Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105738_sf8u0u8s.webp)
Qwen Image Max Text To Image
Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110235_id9bp4jx.webp)
Qwen Image Edit Multiple Angles
Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111145_9y1tzzdn.webp)
Qwen Image 2512 Lora Trainer
Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110225_tzvu0c8q.webp)
Qwen Image Text To Image 2512 Lora
Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110216_pnfbnar4.webp)
Qwen Image Text To Image 2512
Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110130_3mxvct8p.webp)
Qwen Image Edit 2511 Lora
Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110155_wmxhc3xt.webp)
Qwen Image Edit 2511
Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110230_htadxp5h.webp)
Qwen Image Layered
Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.
/filters:quality(82)/media/images/20260408110212_z5lpi1m1.webp)
Qwen Image Edit Plus Lora
Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110146_inh26a0l.webp)
Qwen Image Edit Plus
Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110141_4lrnn2jl.webp)
Qwen Image Edit Lora
Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110150_zif3ayyb.webp)
Qwen Image Edit
Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111422_uw2jz93m.webp)
Qwen Image Lora Trainer
Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408110137_50swwx4z.webp)
Qwen Image Text To Image Lora
Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110208_kl4q8jw4.webp)
Qwen Image Text To Image
Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
예시
Qwen Image 활용 예시
Qwen Image API로 생성한 실제 출력물입니다. 비디오 위에 마우스를 올리면 미리 보고, 클릭하면 전체 크기 뷰어가 열립니다.
사용 방법
Qwen Image API 사용 방법
가입부터 결과물 생성까지 네 단계입니다. Python, Node.js, cURL 전체 예시는 아래 API 섹션에 있습니다.
- 01
API 키 받기
WaveSpeedAI 계정을 만들고 대시보드에서 API 키를 복사하세요. 신규 계정에는 무료 스타터 크레딧이 제공되어, 요금이 청구되기 전에 Playground를 수십 번 실행해 볼 수 있습니다.
- 02
Prediction 제출
입력을 JSON으로 https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image에 POST하세요. 엔드포인트가 prediction id를 즉시 반환합니다. 생성은 비동기로 처리되므로 추론 중에 연결을 계속 열어 둘 필요가 없습니다.
- 03
완료될 때까지 폴링
https://api.wavespeed.ai/api/v3/predictions/{request_id}/result로 GET 요청을 보내세요. completed이면 outputs를 반환하고, failed, cancelled, timeout, deleted이면 오류로 종료하며, 그 밖의 모든 status에서는 폴링을 계속합니다.
- 04
출력 URL 읽기
status가 "completed"가 되면 data.outputs[0]에서 URL을 읽으세요. 이 URL은 WaveSpeedAI CDN에 있는 생성된 미디어를 가리키며, 호출한 Qwen Image 변형에 따라 이미지, 비디오, 오디오 또는 3D 파일입니다.
활용 사례
Qwen Image 활용 사례
개발자와 크리에이터가 Qwen Image API를 사용하는 대표적인 워크플로입니다.
20B MMDiT 텍스트-투-이미지
wavespeed-ai/qwen-image/text-to-image는 텍스트 프롬프트로 이미지를 생성하는 20B MMDiT 차세대 텍스트-투-이미지 모델로, Qwen Image 패밀리의 기본 생성 엔드포인트입니다.
뛰어난 텍스트 렌더링의 향상된 2512
wavespeed-ai/qwen-image/text-to-image-2512는 카탈로그에 따르면 향상된 프롬프트 이해, 뛰어난 텍스트 렌더링, 다양한 화면 비율 지원을 갖춘 Qwen의 최신 텍스트-투-이미지 모델입니다.
Edit-Plus로 하는 멀티 이미지 편집
wavespeed-ai/qwen-image/edit-plus는 멀티 이미지 편집, 단일 이미지 일관성, 네이티브 ControlNet 지원을 갖춘 20B MMDiT 편집기입니다. 여러 소스 이미지를 참조하는 복잡한 편집에 유용합니다.
96포즈 카메라 앵글 제어
wavespeed-ai/qwen-image/edit-multiple-angles는 96포즈 카메라 시스템으로 이미지 한 장에서 특정 카메라 앵글을 생성합니다. 수평 회전, 수직 기울기, 줌을 제어해 정면, 측면, 후면 뷰 등을 만들 수 있습니다.
레이어 합성 분해
wavespeed-ai/qwen-image/layered는 프롬프트 기반 합성을 위한 통합 이미지 레이어 분해 모델입니다. 점, 박스, 대략적인 마스크를 제공해 피사체를 분리하고 이미지 한 장을 레이어로 나눕니다.
LoRA 커스터마이징
LoRA를 지원하는 변형(text-to-image-2512-lora, edit-lora, edit-plus-lora)으로 빠른 커스터마이징과 정교한 생성이 가능합니다. 스타일, 캐릭터, 브랜드 일관성을 위해 LoRA 체크포인트를 학습하거나 적용하세요.
팁
Qwen Image 프롬프트 작성 팁
Qwen Image에서 더 나은 결과를 얻기 위한 실용적인 조언입니다. 운영 파이프라인에서 이미지 모델 전반에 통하는 패턴을 바탕으로 했습니다.
- 01
최신 텍스트 렌더링에는 2512를 사용하세요
text-to-image-2512는 뛰어난 텍스트 렌더링과 프롬프트 이해를 갖춘 향상된 변형입니다. 타이포그래피가 중요할 때는 기본 text-to-image 대신 선택하세요.
- 02
제품 뷰에는 Edit-Multiple-Angles
edit-multiple-angles는 제품 사진 한 장에서 정면, 측면, 후면 및 사용자 지정 카메라 앵글을 생성합니다. 멀티 카메라 촬영 없이 이커머스 카탈로그를 만들 때 유용합니다.
- 03
멀티 이미지 레퍼런스에는 Edit-Plus
편집이 여러 소스 이미지에 의존한다면 단일 이미지 편집 대신 네이티브 ControlNet을 지원하는 edit-plus를 사용하세요.
- 04
합성 워크플로에는 Layered
layered로 이미지를 프롬프트 기반 레이어로 분해하세요. 점, 박스, 대략적인 마스크로 피사체를 분리해 후속 합성에 사용할 수 있습니다.
- 05
브랜드 일관성을 위한 LoRA 변형
생성 전반에서 스타일, 캐릭터, 브랜드 정체성을 유지하려면 text-to-image-2512-lora 또는 edit-plus-lora로 학습된 LoRA 체크포인트를 적용하세요.
- 06
중국어/영어 이중 언어 편집
Edit와 Edit-LoRA는 스타일을 유지하는 중국어/영어 이중 언어 이미지-투-이미지 편집을 지원합니다. 현지화 워크플로에 유용합니다.
가격
Qwen Image API 가격
가격은 출력당 책정됩니다. 최종 요금은 각 변형의 Playground에서 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다.
API
Qwen Image API 호출하기
wavespeed.ai/accesskey에서 API 키를 발급받은 뒤 REST로 prediction을 제출하세요. Playground에서 입력 조합별로 바로 붙여넣을 수 있는 샘플이 생성됩니다.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)비교
Qwen Image vs 대안
비슷한 WaveSpeedAI 모델과 비교한 Qwen Image의 선택 기준.
Qwen Image vs Seedream 4.5
Seedream 4.5는 타이포그래피를 강조하고 멀티 이미지 정체성 고정을 위한 Sequential 변형을 제공합니다. Qwen Image는 Edit-Plus, 멀티 앵글, 레이어 합성, 중국어/영어 이중 언어 편집까지 더 넓은 편집 범위를 다룹니다.
Qwen Image vs GPT Image 2
GPT Image 2는 명시적인 품질 등급과 레퍼런스 이미지 편집 워크플로를 갖추고 있습니다. Qwen Image는 네이티브 ControlNet 지원, 96포즈 카메라 앵글, 레이어 분해를 제공하며, 편집의 기본 요소가 다르고 호출당 비용은 더 낮습니다.
Qwen Image vs Nano Banana 2
Nano Banana 2는 다중 캐릭터 일관성(최대 5명)과 웹 검색 기반 생성을 제공합니다. Qwen Image는 멀티 이미지 Edit-Plus, 카메라 앵글 생성, 프롬프트 기반 레이어 분해 같은 편집의 깊이에서 앞섭니다.
FAQ
Qwen Image API — 자주 묻는 질문
가격, 라이선스, 연동 — WaveSpeedAI에서 Qwen Image 실행에 관한 자주 묻는 질문.
Qwen Image API란 무엇인가요?
Qwen Image — WaveSpeedAI에서 REST API로 제공되는 Alibaba의 이미지 생성 모델입니다. Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다. 프로그래밍 방식으로 호출하거나 위에 링크된 Playground에서 체험해 볼 수 있습니다.
Qwen Image API는 어떻게 호출하나요?
WaveSpeedAI 계정을 만들고 /accesskey에서 API 키를 복사한 뒤, 입력을 JSON으로 https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image에 POST하세요. 엔드포인트가 prediction id를 반환합니다. 결과 엔드포인트 폴링은 약 2초마다 시작하고, 오래 걸리는 작업은 간격을 늘리며, 종료 status가 나오면 중단하세요. 운영 환경용 Python / Node.js / cURL 예시는 위에 있습니다.
Qwen Image API 요금은 얼마인가요?
Qwen Image의 가격은 회당 $0.02부터입니다. 정확한 비용은 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다. Playground의 생성 버튼 옆 실시간 비용 미리보기에서 현재 입력 기준의 정확한 가격을 확인할 수 있습니다.
Qwen Image에는 어떤 변형이 있나요?
WaveSpeedAI에는 라이브 Qwen Image 엔드포인트가 21개 있습니다: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles 외 다수. 각 변형에는 고유한 Playground 페이지와 가격이 있습니다.
Qwen Image 출력물을 상업적으로 사용할 수 있나요?
상업적 사용 권한은 Alibaba 모델 라이선스를 따릅니다. 대부분의 Alibaba 모델은 출력물의 상업적 사용을 허용합니다. 구체적인 라이선스 요약은 각 모델의 Playground 페이지를, 플랫폼 수준의 조건은 WaveSpeedAI 이용약관을 참고하세요.
직접 연동하지 않고 WaveSpeedAI에서 Qwen Image 모델을 사용하는 이유는 무엇인가요?
API 키 하나와 결제 계정 하나로 Qwen Image 모델과 다른 제공사의 1,000개 이상의 AI 모델을 모두 사용합니다. 벤더별 SDK 설정도, 별도의 요청 한도 체계도, 벤더마다 연동 코드를 다시 쓸 일도 없습니다. 가격은 대체로 Alibaba의 직접 API와 같거나 더 저렴합니다.
제공사
Alibaba 소개
WaveSpeedAI의 Qwen Image 및 Alibaba 전체 모델 라인업을 만든 팀.
Alibaba의 Tongyi Lab은 Wan 비디오 모델 패밀리와 Qwen LLM 패밀리를 만듭니다. Wan은 오픈 웨이트로 공개되었고, 폭넓은 변형(텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오, video-edit, video-extend, image-edit, 텍스트-투-이미지)을 갖추었으며, 다국어 프롬프트 전반에서 모션 안정성과 프롬프트 반영이 꾸준히 강한 점이 특징입니다.
WaveSpeedAI에서 Qwen Image 시작하기
가입 시 무료 스타터 크레딧 제공. Alibaba 및 다른 모든 제공사의 1,000개 이상 AI 모델을 API 키 하나로.
/filters:quality(82)/examples/ab6c113bc342972e2bf6fa3a3dd02d44/1783682238198695915_4tkuDMV6.webp)
/filters:quality(82)/examples/ae55efa5dc15feeab655c08c99c0fb67/1783682240218864185_xajsBKir.webp)
/filters:quality(82)/examples/2aae35cf0e4f367122dc3f8306577ba6/1783682242738489413_BobmvEaj.webp)
/filters:quality(82)/examples/fb556f2b9aa99c70a63a0a144d14bfe1/1783682244605044938_9FNX6enx.webp)