Nano Banana 2.1 출시 — Google 최신 모델 | 지금 체험 →
Alibaba이미지 API회당 $0.02부터

Qwen Image API

Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다.

기본, 향상된 2512, 2.0-pro 변형의 텍스트-투-이미지입니다. 편집 엔드포인트에는 Edit, Edit-Plus(멀티 이미지, ControlNet), Edit-LoRA, Edit-Multiple-Angles(96포즈 카메라 시스템), Layered(프롬프트 기반 분해)가 있습니다. Qwen Image 2.0 패밀리 변형도 같은 접두사 아래에 포함됩니다.

Qwen Image 샘플 출력

개요

Qwen Image API 소개

Qwen Image의 기능, Alibaba 모델 라인업에서의 위치, 그리고 팀들이 이 모델을 선택하는 이유.

Alibaba의 이미지 생성 및 편집 모델 Qwen Image. WaveSpeedAI REST API로 바로 사용할 수 있습니다. Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다.

기본, 향상된 2512, 2.0-pro 변형의 텍스트-투-이미지입니다. 편집 엔드포인트에는 Edit, Edit-Plus(멀티 이미지, ControlNet), Edit-LoRA, Edit-Multiple-Angles(96포즈 카메라 시스템), Layered(프롬프트 기반 분해)가 있습니다. Qwen Image 2.0 패밀리 변형도 같은 접두사 아래에 포함됩니다.

WaveSpeedAI의 Qwen Image 제품군은 Image-To-Image, Text-To-Image, Training 워크플로를 아우르는 REST 엔드포인트 21개를 제공합니다. 각 변형은 고유한 가격, 파라미터, 예시 출력을 갖고 있으니 입력 방식과 운영 조건에 맞는 것을 고르거나, 같은 API 키로 여러 개를 호출해 다단계 파이프라인을 구성하세요.

Qwen Image 실행에도 WaveSpeedAI의 다른 1,000개 이상의 AI 모델과 같은 API 키, 결제 계정, 요청 한도 체계를 그대로 사용합니다. 별도의 벤더 설정도, 제공사별 SDK도, 벤더별 요청 한도 체계도 필요 없습니다. 하나의 연동으로 텍스트 → 이미지, 텍스트 → 비디오부터 오디오 합성, 3D 생성, 업스케일링, 편집까지 모두 지원합니다.

엔드포인트

Qwen Image API 전체 엔드포인트

Qwen Image 엔드포인트 21개를 지금 WaveSpeedAI에서 사용할 수 있습니다. 워크플로에 맞는 변형을 고르세요.

image-to-imageQwen Image 2.0 Edit — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.03부터
image-to-imageQwen Image 2.0 Pro Edit — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.07부터
text-to-imageQwen Image 2.0 Text To Image — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.03부터
text-to-imageQwen Image 2.0 Pro Text To Image — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.07부터
image-to-imageQwen Image Edit 2509 Multiple Angles — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.025부터
image-to-imageQwen Image Max Edit — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.07부터
text-to-imageQwen Image Max Text To Image — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.07부터
image-to-imageQwen Image Edit Multiple Angles — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.025부터
trainingQwen Image 2512 Lora Trainer — Alibaba의 Qwen Image training 미리보기

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

$1.00부터
text-to-imageQwen Image Text To Image 2512 Lora — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

$0.025부터
text-to-imageQwen Image Text To Image 2512 — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

$0.02부터
image-to-imageQwen Image Edit 2511 Lora — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

$0.025부터
image-to-imageQwen Image Edit 2511 — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

$0.02부터
image-to-imageQwen Image Layered — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

$0.025부터
image-to-imageQwen Image Edit Plus Lora — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.025부터
image-to-imageQwen Image Edit Plus — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.02부터
image-to-imageQwen Image Edit Lora — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

$0.025부터
image-to-imageQwen Image Edit — Alibaba의 Qwen Image image-to-image 미리보기

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.02부터
trainingQwen Image Lora Trainer — Alibaba의 Qwen Image training 미리보기

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

$1.00부터
text-to-imageQwen Image Text To Image Lora — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.025부터
text-to-imageQwen Image Text To Image — Alibaba의 Qwen Image text-to-image 미리보기

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.02부터

예시

Qwen Image 활용 예시

Qwen Image API로 생성한 실제 출력물입니다. 비디오 위에 마우스를 올리면 미리 보고, 클릭하면 전체 크기 뷰어가 열립니다.

사용 방법

Qwen Image API 사용 방법

가입부터 결과물 생성까지 네 단계입니다. Python, Node.js, cURL 전체 예시는 아래 API 섹션에 있습니다.

  1. 01

    API 키 받기

    WaveSpeedAI 계정을 만들고 대시보드에서 API 키를 복사하세요. 신규 계정에는 무료 스타터 크레딧이 제공되어, 요금이 청구되기 전에 Playground를 수십 번 실행해 볼 수 있습니다.

  2. 02

    Prediction 제출

    입력을 JSON으로 https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image에 POST하세요. 엔드포인트가 prediction id를 즉시 반환합니다. 생성은 비동기로 처리되므로 추론 중에 연결을 계속 열어 둘 필요가 없습니다.

  3. 03

    완료될 때까지 폴링

    https://api.wavespeed.ai/api/v3/predictions/{request_id}/result로 GET 요청을 보내세요. completed이면 outputs를 반환하고, failed, cancelled, timeout, deleted이면 오류로 종료하며, 그 밖의 모든 status에서는 폴링을 계속합니다.

  4. 04

    출력 URL 읽기

    status가 "completed"가 되면 data.outputs[0]에서 URL을 읽으세요. 이 URL은 WaveSpeedAI CDN에 있는 생성된 미디어를 가리키며, 호출한 Qwen Image 변형에 따라 이미지, 비디오, 오디오 또는 3D 파일입니다.

활용 사례

Qwen Image 활용 사례

개발자와 크리에이터가 Qwen Image API를 사용하는 대표적인 워크플로입니다.

01

20B MMDiT 텍스트-투-이미지

wavespeed-ai/qwen-image/text-to-image는 텍스트 프롬프트로 이미지를 생성하는 20B MMDiT 차세대 텍스트-투-이미지 모델로, Qwen Image 패밀리의 기본 생성 엔드포인트입니다.

text-to-image20bmmdit
02

뛰어난 텍스트 렌더링의 향상된 2512

wavespeed-ai/qwen-image/text-to-image-2512는 카탈로그에 따르면 향상된 프롬프트 이해, 뛰어난 텍스트 렌더링, 다양한 화면 비율 지원을 갖춘 Qwen의 최신 텍스트-투-이미지 모델입니다.

2512typographyaspect-ratio
03

Edit-Plus로 하는 멀티 이미지 편집

wavespeed-ai/qwen-image/edit-plus는 멀티 이미지 편집, 단일 이미지 일관성, 네이티브 ControlNet 지원을 갖춘 20B MMDiT 편집기입니다. 여러 소스 이미지를 참조하는 복잡한 편집에 유용합니다.

edit-plusmulti-imagecontrolnet
04

96포즈 카메라 앵글 제어

wavespeed-ai/qwen-image/edit-multiple-angles는 96포즈 카메라 시스템으로 이미지 한 장에서 특정 카메라 앵글을 생성합니다. 수평 회전, 수직 기울기, 줌을 제어해 정면, 측면, 후면 뷰 등을 만들 수 있습니다.

camera-angles96-pose3d-views
05

레이어 합성 분해

wavespeed-ai/qwen-image/layered는 프롬프트 기반 합성을 위한 통합 이미지 레이어 분해 모델입니다. 점, 박스, 대략적인 마스크를 제공해 피사체를 분리하고 이미지 한 장을 레이어로 나눕니다.

layeredcompositingdecomposition
06

LoRA 커스터마이징

LoRA를 지원하는 변형(text-to-image-2512-lora, edit-lora, edit-plus-lora)으로 빠른 커스터마이징과 정교한 생성이 가능합니다. 스타일, 캐릭터, 브랜드 일관성을 위해 LoRA 체크포인트를 학습하거나 적용하세요.

loracustomizationconsistency

팁

Qwen Image 프롬프트 작성 팁

Qwen Image에서 더 나은 결과를 얻기 위한 실용적인 조언입니다. 운영 파이프라인에서 이미지 모델 전반에 통하는 패턴을 바탕으로 했습니다.

  1. 01

    최신 텍스트 렌더링에는 2512를 사용하세요

    text-to-image-2512는 뛰어난 텍스트 렌더링과 프롬프트 이해를 갖춘 향상된 변형입니다. 타이포그래피가 중요할 때는 기본 text-to-image 대신 선택하세요.

  2. 02

    제품 뷰에는 Edit-Multiple-Angles

    edit-multiple-angles는 제품 사진 한 장에서 정면, 측면, 후면 및 사용자 지정 카메라 앵글을 생성합니다. 멀티 카메라 촬영 없이 이커머스 카탈로그를 만들 때 유용합니다.

  3. 03

    멀티 이미지 레퍼런스에는 Edit-Plus

    편집이 여러 소스 이미지에 의존한다면 단일 이미지 편집 대신 네이티브 ControlNet을 지원하는 edit-plus를 사용하세요.

  4. 04

    합성 워크플로에는 Layered

    layered로 이미지를 프롬프트 기반 레이어로 분해하세요. 점, 박스, 대략적인 마스크로 피사체를 분리해 후속 합성에 사용할 수 있습니다.

  5. 05

    브랜드 일관성을 위한 LoRA 변형

    생성 전반에서 스타일, 캐릭터, 브랜드 정체성을 유지하려면 text-to-image-2512-lora 또는 edit-plus-lora로 학습된 LoRA 체크포인트를 적용하세요.

  6. 06

    중국어/영어 이중 언어 편집

    Edit와 Edit-LoRA는 스타일을 유지하는 중국어/영어 이중 언어 이미지-투-이미지 편집을 지원합니다. 현지화 워크플로에 유용합니다.

가격

Qwen Image API 가격

가격은 출력당 책정됩니다. 최종 요금은 각 변형의 Playground에서 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다.

API

Qwen Image API 호출하기

wavespeed.ai/accesskey에서 API 키를 발급받은 뒤 REST로 prediction을 제출하세요. Playground에서 입력 조합별로 바로 붙여넣을 수 있는 샘플이 생성됩니다.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

비교

Qwen Image vs 대안

비슷한 WaveSpeedAI 모델과 비교한 Qwen Image의 선택 기준.

Qwen Image vs Seedream 4.5

Seedream 4.5는 타이포그래피를 강조하고 멀티 이미지 정체성 고정을 위한 Sequential 변형을 제공합니다. Qwen Image는 Edit-Plus, 멀티 앵글, 레이어 합성, 중국어/영어 이중 언어 편집까지 더 넓은 편집 범위를 다룹니다.

Qwen Image vs GPT Image 2

GPT Image 2는 명시적인 품질 등급과 레퍼런스 이미지 편집 워크플로를 갖추고 있습니다. Qwen Image는 네이티브 ControlNet 지원, 96포즈 카메라 앵글, 레이어 분해를 제공하며, 편집의 기본 요소가 다르고 호출당 비용은 더 낮습니다.

Qwen Image vs Nano Banana 2

Nano Banana 2는 다중 캐릭터 일관성(최대 5명)과 웹 검색 기반 생성을 제공합니다. Qwen Image는 멀티 이미지 Edit-Plus, 카메라 앵글 생성, 프롬프트 기반 레이어 분해 같은 편집의 깊이에서 앞섭니다.

FAQ

Qwen Image API — 자주 묻는 질문

가격, 라이선스, 연동 — WaveSpeedAI에서 Qwen Image 실행에 관한 자주 묻는 질문.

Qwen Image API란 무엇인가요?

Qwen Image — WaveSpeedAI에서 REST API로 제공되는 Alibaba의 이미지 생성 모델입니다. Alibaba Qwen-Image — 중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다. 프로그래밍 방식으로 호출하거나 위에 링크된 Playground에서 체험해 볼 수 있습니다.

Qwen Image API는 어떻게 호출하나요?

WaveSpeedAI 계정을 만들고 /accesskey에서 API 키를 복사한 뒤, 입력을 JSON으로 https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image에 POST하세요. 엔드포인트가 prediction id를 반환합니다. 결과 엔드포인트 폴링은 약 2초마다 시작하고, 오래 걸리는 작업은 간격을 늘리며, 종료 status가 나오면 중단하세요. 운영 환경용 Python / Node.js / cURL 예시는 위에 있습니다.

Qwen Image API 요금은 얼마인가요?

Qwen Image의 가격은 회당 $0.02부터입니다. 정확한 비용은 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다. Playground의 생성 버튼 옆 실시간 비용 미리보기에서 현재 입력 기준의 정확한 가격을 확인할 수 있습니다.

Qwen Image에는 어떤 변형이 있나요?

WaveSpeedAI에는 라이브 Qwen Image 엔드포인트가 21개 있습니다: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles 외 다수. 각 변형에는 고유한 Playground 페이지와 가격이 있습니다.

Qwen Image 출력물을 상업적으로 사용할 수 있나요?

상업적 사용 권한은 Alibaba 모델 라이선스를 따릅니다. 대부분의 Alibaba 모델은 출력물의 상업적 사용을 허용합니다. 구체적인 라이선스 요약은 각 모델의 Playground 페이지를, 플랫폼 수준의 조건은 WaveSpeedAI 이용약관을 참고하세요.

직접 연동하지 않고 WaveSpeedAI에서 Qwen Image 모델을 사용하는 이유는 무엇인가요?

API 키 하나와 결제 계정 하나로 Qwen Image 모델과 다른 제공사의 1,000개 이상의 AI 모델을 모두 사용합니다. 벤더별 SDK 설정도, 별도의 요청 한도 체계도, 벤더마다 연동 코드를 다시 쓸 일도 없습니다. 가격은 대체로 Alibaba의 직접 API와 같거나 더 저렴합니다.

제공사

Alibaba 소개

WaveSpeedAI의 Qwen Image 및 Alibaba 전체 모델 라인업을 만든 팀.

Alibaba의 Tongyi Lab은 Wan 비디오 모델 패밀리와 Qwen LLM 패밀리를 만듭니다. Wan은 오픈 웨이트로 공개되었고, 폭넓은 변형(텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오, video-edit, video-extend, image-edit, 텍스트-투-이미지)을 갖추었으며, 다국어 프롬프트 전반에서 모션 안정성과 프롬프트 반영이 꾸준히 강한 점이 특징입니다.

WaveSpeedAI에서 Qwen Image 시작하기

가입 시 무료 스타터 크레딧 제공. Alibaba 및 다른 모든 제공사의 1,000개 이상 AI 모델을 API 키 하나로.