Nano Banana 2.1 HADIR — Terbaru dari Google | Coba sekarang →
AlibabaAPI gambarMulai dari $0.02/run

Qwen Image API

Alibaba Qwen-Image — perangkat teks-ke-gambar dan penyuntingan generasi berikutnya berbasis 20B MMDiT dengan dukungan dwibahasa Mandarin/Inggris, penyuntingan multi-gambar, kustomisasi LoRA, compositing berlapis, dan sistem sudut kamera 96 pose.

Teks-ke-gambar pada varian dasar, 2512 yang ditingkatkan, dan 2.0-pro. Endpoint edit mencakup Edit, Edit-Plus (multi-gambar, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistem kamera 96 pose), dan Layered (dekomposisi berbasis prompt). Varian keluarga Qwen Image 2.0 disertakan di bawah prefiks yang sama.

Contoh output Qwen Image

Ringkasan

Tentang Qwen Image API

Apa yang dilakukan Qwen Image, posisinya dalam jajaran model Alibaba, dan mengapa banyak tim memilihnya.

Qwen Image adalah model pembuatan dan pengeditan gambar dari Alibaba, tersedia melalui REST API WaveSpeedAI. Alibaba Qwen-Image — perangkat teks-ke-gambar dan penyuntingan generasi berikutnya berbasis 20B MMDiT dengan dukungan dwibahasa Mandarin/Inggris, penyuntingan multi-gambar, kustomisasi LoRA, compositing berlapis, dan sistem sudut kamera 96 pose.

Teks-ke-gambar pada varian dasar, 2512 yang ditingkatkan, dan 2.0-pro. Endpoint edit mencakup Edit, Edit-Plus (multi-gambar, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistem kamera 96 pose), dan Layered (dekomposisi berbasis prompt). Varian keluarga Qwen Image 2.0 disertakan di bawah prefiks yang sama.

Keluarga Qwen Image di WaveSpeedAI menyediakan 21 endpoint REST yang mencakup alur kerja Image-To-Image, Text-To-Image, Training. Setiap varian memiliki harga, parameter, dan contoh output sendiri — pilih yang sesuai dengan modalitas input dan kebutuhan produksi Anda, atau panggil beberapa sekaligus dengan satu API key untuk menyusun pipeline multi-langkah.

Jalankan Qwen Image dengan API key, akun penagihan, dan batas laju yang sama dengan yang Anda pakai untuk 1.000+ model AI lainnya di WaveSpeedAI. Tanpa penyiapan vendor terpisah, tanpa SDK per penyedia, tanpa batas laju per vendor — satu integrasi mencakup semuanya, dari text-to-image dan text-to-video hingga sintesis audio, pembuatan 3D, upscaling, dan pengeditan.

Endpoint

Semua endpoint API Qwen Image

21 endpoint Qwen Image tersedia sekarang di WaveSpeedAI — pilih varian yang sesuai dengan alur kerja Anda.

image-to-imageQwen Image 2.0 Edit — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.03
image-to-imageQwen Image 2.0 Pro Edit — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.07
text-to-imageQwen Image 2.0 Text To Image — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.03
text-to-imageQwen Image 2.0 Pro Text To Image — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.07
image-to-imageQwen Image Edit 2509 Multiple Angles — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.025
image-to-imageQwen Image Max Edit — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.07
text-to-imageQwen Image Max Text To Image — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.07
image-to-imageQwen Image Edit Multiple Angles — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.025
trainingQwen Image 2512 Lora Trainer — pratinjau training Qwen Image dari Alibaba

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

mulai $1.00
text-to-imageQwen Image Text To Image 2512 Lora — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

mulai $0.025
text-to-imageQwen Image Text To Image 2512 — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

mulai $0.02
image-to-imageQwen Image Edit 2511 Lora — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

mulai $0.025
image-to-imageQwen Image Edit 2511 — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

mulai $0.02
image-to-imageQwen Image Layered — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

mulai $0.025
image-to-imageQwen Image Edit Plus Lora — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.025
image-to-imageQwen Image Edit Plus — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.02
image-to-imageQwen Image Edit Lora — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

mulai $0.025
image-to-imageQwen Image Edit — pratinjau image-to-image Qwen Image dari Alibaba

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.02
trainingQwen Image Lora Trainer — pratinjau training Qwen Image dari Alibaba

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

mulai $1.00
text-to-imageQwen Image Text To Image Lora — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.025
text-to-imageQwen Image Text To Image — pratinjau text-to-image Qwen Image dari Alibaba

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

mulai $0.02

Contoh

Lihat Qwen Image beraksi

Output nyata yang dihasilkan oleh API Qwen Image. Arahkan kursor ke video mana pun untuk pratinjau, klik untuk membuka penampil ukuran penuh.

Cara pakai

Cara menggunakan API Qwen Image

Empat langkah dari pendaftaran hingga hasil jadi. Contoh lengkap Python, Node.js, dan cURL ada di bagian API di bawah.

  1. 01

    Dapatkan API key

    Daftar akun WaveSpeedAI dan salin API key Anda dari dasbor. Akun baru mendapat kredit awal gratis — cukup untuk menjalankan playground beberapa puluh kali sebelum penagihan dimulai.

  2. 02

    Kirim prediksi

    POST input Anda sebagai JSON ke https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. Endpoint langsung mengembalikan id prediksi — proses generasi bersifat asinkron sehingga Anda tidak perlu menahan koneksi terbuka selama inferensi.

  3. 03

    Polling hingga selesai

    GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Ambil output saat completed; hentikan dengan error saat failed, cancelled, timeout, atau deleted; lanjutkan polling untuk status lainnya.

  4. 04

    Baca URL output

    Setelah status "completed", baca URL dari data.outputs[0]. URL tersebut mengarah ke media hasil generasi Anda di CDN WaveSpeedAI — file gambar, video, audio, atau 3D tergantung varian Qwen Image yang Anda panggil.

Kasus penggunaan

Apa yang bisa Anda bangun dengan Qwen Image

Alur kerja umum yang dipakai pengembang dan kreator dengan API Qwen Image.

01

Teks-ke-gambar 20B MMDiT

wavespeed-ai/qwen-image/text-to-image adalah model teks-ke-gambar generasi berikutnya 20B MMDiT yang menghasilkan gambar dari prompt teks — endpoint pembuatan dasar dalam keluarga Qwen Image.

text-to-image20bmmdit
02

2512 yang ditingkatkan dengan render teks unggul

wavespeed-ai/qwen-image/text-to-image-2512 adalah model teks-ke-gambar terbaru Qwen dengan pemahaman prompt yang ditingkatkan, render teks unggul, dan dukungan beragam rasio aspek menurut katalog.

2512typographyaspect-ratio
03

Penyuntingan multi-gambar dengan Edit-Plus

wavespeed-ai/qwen-image/edit-plus adalah editor 20B MMDiT dengan penyuntingan multi-gambar, konsistensi satu gambar, dan dukungan ControlNet native — berguna untuk edit kompleks yang merujuk beberapa gambar sumber.

edit-plusmulti-imagecontrolnet
04

Kontrol sudut kamera 96 pose

wavespeed-ai/qwen-image/edit-multiple-angles menghasilkan sudut kamera tertentu dari satu gambar menggunakan sistem kamera 96 pose — kendalikan rotasi horizontal, kemiringan vertikal, dan zoom untuk tampak depan, samping, belakang, dan lainnya.

camera-angles96-pose3d-views
05

Dekomposisi compositing berlapis

wavespeed-ai/qwen-image/layered adalah model dekomposisi layer gambar terpadu untuk compositing berbasis prompt — berikan titik, kotak, atau masker kasar untuk mengisolasi subjek dan memisahkan satu gambar menjadi beberapa layer.

layeredcompositingdecomposition
06

Kustomisasi LoRA

Varian yang mendukung LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) memungkinkan kustomisasi cepat dan pembuatan yang disempurnakan — latih atau terapkan checkpoint LoRA untuk konsistensi gaya, karakter, atau merek.

loracustomizationconsistency

Tips

Tips menulis prompt untuk Qwen Image

Saran praktis untuk mendapatkan output yang lebih baik dari Qwen Image — diambil dari pola yang berhasil pada model gambar di pipeline produksi.

  1. 01

    Gunakan 2512 untuk render teks terbaru

    text-to-image-2512 adalah varian yang ditingkatkan dengan render teks dan pemahaman prompt yang unggul — pilih dibanding text-to-image dasar saat tipografi penting.

  2. 02

    Edit-Multiple-Angles untuk tampilan produk

    edit-multiple-angles menghasilkan sudut kamera depan, samping, belakang, dan kustom dari satu foto produk — berguna untuk katalog e-commerce tanpa pemotretan multi-kamera.

  3. 03

    Edit-Plus untuk referensi multi-gambar

    Saat sebuah edit bergantung pada beberapa gambar sumber, gunakan edit-plus dengan dukungan ControlNet native alih-alih edit satu gambar.

  4. 04

    Layered untuk alur kerja compositing

    Gunakan layered untuk mendekomposisi gambar menjadi layer berbasis prompt — isolasi subjek dengan titik, kotak, atau masker kasar untuk compositing selanjutnya.

  5. 05

    Varian LoRA untuk konsistensi merek

    Terapkan checkpoint LoRA terlatih lewat text-to-image-2512-lora atau edit-plus-lora untuk gaya, karakter, atau identitas merek yang berulang di seluruh pembuatan.

  6. 06

    Penyuntingan dwibahasa Mandarin/Inggris

    Edit dan Edit-LoRA mendukung penyuntingan gambar-ke-gambar dwibahasa Mandarin/Inggris dengan pelestarian gaya — berguna untuk alur kerja lokalisasi.

Harga

Harga API Qwen Image

Harga dihitung per output. Biaya akhir menyesuaikan parameter yang Anda atur di playground setiap varian (resolusi, durasi, jumlah output, referensi).

API

Panggil API Qwen Image

Daftar untuk mendapatkan API key di wavespeed.ai/accesskey, lalu kirim prediksi melalui REST. Playground menghasilkan contoh siap tempel untuk kombinasi input apa pun.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Perbandingan

Qwen Image vs alternatif

Kapan memilih Qwen Image dibanding model serupa di WaveSpeedAI.

Qwen Image vs Seedream 4.5

Seedream 4.5 menekankan tipografi dan menyediakan varian Sequential untuk penguncian identitas multi-gambar. Qwen Image mencakup cakupan penyuntingan yang lebih luas — Edit-Plus, multiple-angles, compositing berlapis, dan penyuntingan dwibahasa Mandarin/Inggris.

Qwen Image vs GPT Image 2

GPT Image 2 memiliki tingkat kualitas eksplisit dan alur kerja edit gambar referensi. Qwen Image menyediakan dukungan ControlNet native, sudut kamera 96 pose, dan dekomposisi berlapis — primitif penyuntingan berbeda dengan biaya per panggilan lebih rendah.

Qwen Image vs Nano Banana 2

Nano Banana 2 menyediakan konsistensi multi-karakter (hingga 5) dan grounding pencarian web. Qwen Image unggul dalam kedalaman penyuntingan — Edit-Plus multi-gambar, pembuatan sudut kamera, dan dekomposisi layer berbasis prompt.

FAQ

Qwen Image API — Pertanyaan yang sering diajukan

Harga, lisensi, integrasi — pertanyaan umum tentang menjalankan Qwen Image di WaveSpeedAI.

Apa itu API Qwen Image?

Qwen Image adalah model pembuatan gambar dari Alibaba yang tersedia sebagai REST API di WaveSpeedAI. Alibaba Qwen-Image — perangkat teks-ke-gambar dan penyuntingan generasi berikutnya berbasis 20B MMDiT dengan dukungan dwibahasa Mandarin/Inggris, penyuntingan multi-gambar, kustomisasi LoRA, compositing berlapis, dan sistem sudut kamera 96 pose. Anda dapat memanggilnya secara terprogram atau mencobanya dari playground yang ditautkan di atas.

Bagaimana cara memanggil API Qwen Image?

Daftar akun WaveSpeedAI, salin API key Anda dari /accesskey, lalu POST ke https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image dengan input Anda sebagai JSON. Endpoint mengembalikan id prediksi. Lakukan polling pada endpoint hasil dengan interval sekitar 2 detik, perpanjang interval untuk tugas yang berjalan lama, dan berhenti pada status akhir apa pun. Contoh Python / Node.js / cURL untuk produksi ada di atas.

Berapa biaya API Qwen Image?

Qwen Image mulai dari $0.02 per run. Biaya pastinya menyesuaikan parameter yang Anda atur (resolusi, durasi, jumlah output, referensi). Pratinjau biaya langsung di samping tombol Generate di playground menampilkan harga pasti untuk input Anda saat ini.

Varian Qwen Image apa saja yang tersedia?

WaveSpeedAI menyediakan 21 endpoint Qwen Image aktif: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, dan lainnya. Setiap varian memiliki halaman playground dan harga sendiri.

Bisakah output Qwen Image dipakai secara komersial?

Hak penggunaan komersial mengikuti lisensi model Alibaba. Sebagian besar model Alibaba mengizinkan penggunaan output secara komersial; lihat halaman playground tiap model untuk ringkasan lisensinya, dan Ketentuan Layanan WaveSpeedAI untuk ketentuan tingkat platform.

Mengapa memakai Qwen Image di WaveSpeedAI dan bukan langsung?

Satu API key + satu akun penagihan untuk Qwen Image DAN 1.000+ model AI lain dari penyedia lain. Tanpa penyiapan SDK per vendor, tanpa batas laju terpisah, tanpa menulis ulang kode integrasi untuk tiap vendor. Harganya umumnya setara atau di bawah API langsung dari Alibaba.

Penyedia

Tentang Alibaba

Tim di balik Qwen Image dan jajaran model Alibaba lainnya di WaveSpeedAI.

Tongyi Lab milik Alibaba menghasilkan keluarga model video Wan dan keluarga LLM Qwen. Wan menonjol karena dirilis dengan open weights, cakupan varian yang luas (teks-ke-video, gambar-ke-video, referensi-ke-video, video-edit, video-extend, image-edit, teks-ke-gambar), dan kekuatan yang konsisten pada stabilitas gerakan dan kepatuhan prompt di berbagai prompt multibahasa.

Mulai membangun dengan Qwen Image di WaveSpeedAI

Kredit awal gratis saat mendaftar. Satu API key untuk 1.000+ model AI dari Alibaba dan semua penyedia lainnya.