Qwen Image API
Alibaba Qwen-Image — toolkit di nuova generazione 20B MMDiT per text-to-image ed editing, con supporto bilingue cinese/inglese, editing multi-immagine, personalizzazione LoRA, compositing a livelli e un sistema di angoli di camera a 96 pose.
Text-to-image nelle varianti base, 2512 migliorata e 2.0-pro. Gli endpoint di editing includono Edit, Edit-Plus (multi-immagine, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema di camera a 96 pose) e Layered (scomposizione guidata da prompt). Le varianti della famiglia Qwen Image 2.0 sono incluse sotto lo stesso prefisso.
/filters:quality(82)/examples/e26b4143e025f71d55e3e5704c446d2b/1783682236366122456_NdT2cmvE.webp)
Panoramica
Informazioni su Qwen Image API
Cosa fa Qwen Image, come si inserisce nella gamma di modelli di Alibaba e perché i team lo scelgono.
Qwen Image è un modello di generazione e modifica di immagini di Alibaba, disponibile tramite l'API REST di WaveSpeedAI. Alibaba Qwen-Image — toolkit di nuova generazione 20B MMDiT per text-to-image ed editing, con supporto bilingue cinese/inglese, editing multi-immagine, personalizzazione LoRA, compositing a livelli e un sistema di angoli di camera a 96 pose.
Text-to-image nelle varianti base, 2512 migliorata e 2.0-pro. Gli endpoint di editing includono Edit, Edit-Plus (multi-immagine, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema di camera a 96 pose) e Layered (scomposizione guidata da prompt). Le varianti della famiglia Qwen Image 2.0 sono incluse sotto lo stesso prefisso.
La famiglia Qwen Image su WaveSpeedAI offre 21 endpoint REST che coprono i flussi di lavoro Image-To-Image, Text-To-Image, Training. Ogni variante ha il suo prezzo, i suoi parametri e i suoi esempi di output: scegli quella più adatta alla tua modalità di input e ai tuoi vincoli di produzione, oppure richiamane diverse con la stessa chiave API per comporre pipeline in più passaggi.
Usa Qwen Image con la stessa chiave API, lo stesso account di fatturazione e gli stessi limiti di frequenza che usi per gli altri oltre 1.000 modelli AI di WaveSpeedAI. Nessuna configurazione separata per fornitore, nessun SDK per provider, nessun limite di frequenza per fornitore: un'unica integrazione copre tutto, dal text-to-image e text-to-video alla sintesi audio, alla generazione 3D, all'upscaling e all'editing.
Endpoint
Tutti gli endpoint API Qwen Image
21 endpoint Qwen Image disponibili ora su WaveSpeedAI: scegli la variante più adatta al tuo flusso di lavoro.
/filters:quality(82)/media/images/20260408110013_8als1nwx.webp)
Qwen Image 2.0 Edit
Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110922_079iorac.webp)
Qwen Image 2.0 Pro Edit
Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110019_rr2dv7f5.webp)
Qwen Image 2.0 Text To Image
Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110930_uej3wr3b.webp)
Qwen Image 2.0 Pro Text To Image
Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110201_c4uo1ban.webp)
Qwen Image Edit 2509 Multiple Angles
Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105730_1fu19xjx.webp)
Qwen Image Max Edit
Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105738_sf8u0u8s.webp)
Qwen Image Max Text To Image
Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110235_id9bp4jx.webp)
Qwen Image Edit Multiple Angles
Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111145_9y1tzzdn.webp)
Qwen Image 2512 Lora Trainer
Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110225_tzvu0c8q.webp)
Qwen Image Text To Image 2512 Lora
Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110216_pnfbnar4.webp)
Qwen Image Text To Image 2512
Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110130_3mxvct8p.webp)
Qwen Image Edit 2511 Lora
Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110155_wmxhc3xt.webp)
Qwen Image Edit 2511
Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110230_htadxp5h.webp)
Qwen Image Layered
Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.
/filters:quality(82)/media/images/20260408110212_z5lpi1m1.webp)
Qwen Image Edit Plus Lora
Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110146_inh26a0l.webp)
Qwen Image Edit Plus
Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110141_4lrnn2jl.webp)
Qwen Image Edit Lora
Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110150_zif3ayyb.webp)
Qwen Image Edit
Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111422_uw2jz93m.webp)
Qwen Image Lora Trainer
Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408110137_50swwx4z.webp)
Qwen Image Text To Image Lora
Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110208_kl4q8jw4.webp)
Qwen Image Text To Image
Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Esempi
Qwen Image in azione
Output reali generati dall'API Qwen Image. Passa il mouse su un video per l'anteprima, clicca per aprire il visualizzatore a schermo intero.
Guida
Come usare l'API Qwen Image
Quattro passaggi dalla registrazione alla generazione completata. Esempi completi in Python, Node.js e cURL sono nella sezione API qui sotto.
- 01
Ottieni una chiave API
Registrati su WaveSpeedAI e copia la tua chiave API dalla dashboard. I nuovi account includono crediti gratuiti di benvenuto: bastano per usare il playground qualche decina di volte prima che inizi la fatturazione.
- 02
Invia una predizione
Invia con POST il tuo input in formato JSON a https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. L'endpoint restituisce subito un id di predizione: le generazioni sono asincrone, quindi non devi tenere una connessione aperta durante l'inferenza.
- 03
Controlla il completamento
Fai GET su https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Restituisci gli output con completed; interrompi con un errore con failed, cancelled, timeout o deleted; continua il polling per ogni altro stato.
- 04
Leggi l'URL dell'output
Quando lo stato è "completed", leggi l'URL da data.outputs[0]. L'URL punta al tuo contenuto generato sulla CDN di WaveSpeedAI: immagine, video, audio o file 3D a seconda della variante di Qwen Image che hai richiamato.
Casi d'uso
Cosa puoi creare con Qwen Image
I flussi di lavoro più comuni per cui sviluppatori e creator usano l'API Qwen Image.
Text-to-image 20B MMDiT
wavespeed-ai/qwen-image/text-to-image è un modello text-to-image di nuova generazione 20B MMDiT che genera immagini da prompt testuali — l'endpoint di generazione di base della famiglia Qwen Image.
2512 migliorato con resa del testo superiore
wavespeed-ai/qwen-image/text-to-image-2512 è l'ultimo modello text-to-image di Qwen, con comprensione del prompt migliorata, resa del testo superiore e supporto a proporzioni versatili, secondo il catalogo.
Editing multi-immagine con Edit-Plus
wavespeed-ai/qwen-image/edit-plus è un editor 20B MMDiT con editing multi-immagine, coerenza su singola immagine e supporto ControlNet nativo — utile per modifiche complesse che fanno riferimento a più immagini sorgente.
Controllo degli angoli di camera a 96 pose
wavespeed-ai/qwen-image/edit-multiple-angles genera angoli di camera specifici da una sola immagine usando un sistema di camera a 96 pose — controlla rotazione orizzontale, inclinazione verticale e zoom per viste frontali, laterali, posteriori e altro.
Scomposizione per compositing a livelli
wavespeed-ai/qwen-image/layered è un modello unificato di scomposizione in livelli per il compositing guidato da prompt — fornisci punti, riquadri o maschere approssimative per isolare i soggetti e dividere una singola immagine in livelli.
Personalizzazione LoRA
Le varianti con supporto LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) consentono personalizzazione rapida e generazione raffinata — addestra o applica checkpoint LoRA per coerenza di stile, personaggio o brand.
Consigli
Consigli per scrivere i prompt per Qwen Image
Consigli pratici per ottenere output migliori da Qwen Image, ricavati dagli schemi che funzionano con i modelli immagini nelle pipeline di produzione.
- 01
Usa 2512 per la resa del testo più recente
text-to-image-2512 è la variante migliorata con resa del testo e comprensione del prompt superiori — sceglila al posto del text-to-image di base quando conta la tipografia.
- 02
Edit-Multiple-Angles per le viste del prodotto
edit-multiple-angles genera angoli di camera frontali, laterali, posteriori e personalizzati da una sola foto di prodotto — utile per cataloghi e-commerce senza uno shooting multi-camera.
- 03
Edit-Plus per i riferimenti multi-immagine
Quando una modifica dipende da più immagini sorgente, usa edit-plus con supporto ControlNet nativo anziché l'edit a immagine singola.
- 04
Layered per i workflow di compositing
Usa layered per scomporre un'immagine in livelli guidati da prompt — isola i soggetti con punti, riquadri o maschere approssimative per il compositing a valle.
- 05
Varianti LoRA per la coerenza del brand
Applica checkpoint LoRA addestrati tramite text-to-image-2512-lora o edit-plus-lora per uno stile, un personaggio o un'identità di brand ricorrenti tra le generazioni.
- 06
Editing bilingue cinese/inglese
Edit ed Edit-LoRA supportano l'editing image-to-image bilingue cinese/inglese con conservazione dello stile — utile per i workflow di localizzazione.
Prezzi
Prezzi dell'API Qwen Image
Il prezzo è per output. L'addebito finale dipende dai parametri impostati nel playground di ciascuna variante (risoluzione, durata, numero di output, riferimenti).
API
Richiama l'API Qwen Image
Ottieni una chiave API su wavespeed.ai/accesskey, poi invia una predizione tramite REST. Il playground genera esempi pronti da incollare per qualsiasi combinazione di input.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Confronto
Qwen Image a confronto con le alternative
Quando scegliere Qwen Image rispetto a modelli simili su WaveSpeedAI.
Qwen Image vs Seedream 4.5
Seedream 4.5 punta sulla tipografia e offre varianti Sequential per il blocco dell'identità su più immagini. Qwen Image copre una gamma di editing più ampia — Edit-Plus, angoli multipli, compositing a livelli ed editing bilingue cinese/inglese.
Qwen Image vs GPT Image 2
GPT Image 2 ha livelli di qualità espliciti e un workflow di edit con immagini di riferimento. Qwen Image offre supporto ControlNet nativo, angoli di camera a 96 pose e scomposizione a livelli — primitive di editing diverse a un costo per chiamata inferiore.
Qwen Image vs Nano Banana 2
Nano Banana 2 offre coerenza multi-personaggio (fino a 5) e ancoraggio alla ricerca web. Qwen Image vince per profondità di editing — Edit-Plus multi-immagine, generazione di angoli di camera e scomposizione in livelli guidata da prompt.
FAQ
Qwen Image API — Domande frequenti
Prezzi, licenza, integrazione: le domande più comuni sull'uso di Qwen Image su WaveSpeedAI.
Che cos'è l'API Qwen Image?
Qwen Image è un modello di generazione di immagini di Alibaba reso disponibile come API REST su WaveSpeedAI. Alibaba Qwen-Image — toolkit di nuova generazione 20B MMDiT per text-to-image ed editing, con supporto bilingue cinese/inglese, editing multi-immagine, personalizzazione LoRA, compositing a livelli e un sistema di angoli di camera a 96 pose. Puoi richiamarlo da codice o provarlo dal playground collegato qui sopra.
Come richiamo l'API Qwen Image?
Registrati su WaveSpeedAI, copia la tua chiave API da /accesskey, poi invia con POST a https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image il tuo input in formato JSON. L'endpoint restituisce un id di predizione. Fai polling sull'endpoint dei risultati circa ogni 2 secondi, aumenta l'intervallo per le attività di lunga durata e fermati a qualsiasi stato terminale. Gli esempi in Python / Node.js / cURL orientati alla produzione sono qui sopra.
Quanto costa l'API Qwen Image?
Qwen Image parte da $0.02 per esecuzione. Il costo esatto dipende dai parametri impostati (risoluzione, durata, numero di output, riferimenti). L'anteprima del costo in tempo reale accanto al pulsante Genera nel playground mostra il prezzo esatto per il tuo input attuale.
Quali varianti di Qwen Image sono disponibili?
WaveSpeedAI offre 21 endpoint Qwen Image attivi: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, e altri. Ogni variante ha la sua pagina playground e i suoi prezzi.
Posso usare gli output di Qwen Image a fini commerciali?
I diritti di uso commerciale seguono la licenza del modello di Alibaba. La maggior parte dei modelli di Alibaba consente l'uso commerciale degli output; consulta la pagina playground di ciascun modello per il riepilogo della licenza e i Termini di servizio di WaveSpeedAI per le condizioni a livello di piattaforma.
Perché usare Qwen Image su WaveSpeedAI invece di rivolgersi direttamente al fornitore?
Una sola chiave API e un solo account di fatturazione per Qwen Image E per oltre 1.000 altri modelli AI di altri provider. Nessuna configurazione di SDK per fornitore, nessun limite di frequenza separato, nessun codice di integrazione da riscrivere per ogni fornitore. I prezzi sono in genere in linea o inferiori a quelli dell'API diretta di Alibaba.
Provider
Informazioni su Alibaba
Il team dietro Qwen Image e dietro l'intera gamma di modelli di Alibaba su WaveSpeedAI.
Il Tongyi Lab di Alibaba produce la famiglia di modelli video Wan e la famiglia di LLM Qwen. Wan si distingue per il rilascio con pesi aperti, un'ampia copertura di varianti (text-to-video, image-to-video, reference-to-video, video-edit, video-extend, image-edit, text-to-image) e una costante solidità in stabilità del movimento e aderenza al prompt con prompt multilingue.
Inizia a creare con Qwen Image su WaveSpeedAI
Crediti gratuiti di benvenuto alla registrazione. Una sola chiave API per oltre 1.000 modelli AI di Alibaba e di ogni altro provider.
/filters:quality(82)/examples/ab6c113bc342972e2bf6fa3a3dd02d44/1783682238198695915_4tkuDMV6.webp)
/filters:quality(82)/examples/ae55efa5dc15feeab655c08c99c0fb67/1783682240218864185_xajsBKir.webp)
/filters:quality(82)/examples/2aae35cf0e4f367122dc3f8306577ba6/1783682242738489413_BobmvEaj.webp)
/filters:quality(82)/examples/fb556f2b9aa99c70a63a0a144d14bfe1/1783682244605044938_9FNX6enx.webp)