Nano Banana 2.1 EN LIGNE — Le dernier de Google | Essayer →
AlibabaAPI imageÀ partir de $0.02/exécution

Qwen Image API

Alibaba Qwen-Image — boîte à outils de texte vers image et d'édition de nouvelle génération MMDiT 20B, avec prise en charge bilingue chinois/anglais, édition multi-images, personnalisation LoRA, composition par calques et un système d'angles de caméra à 96 poses.

Texte vers image avec les variantes de base, 2512 amélioré et 2.0-pro. Les endpoints d'édition comprennent Edit, Edit-Plus (multi-images, ControlNet), Edit-LoRA, Edit-Multiple-Angles (système de caméra à 96 poses) et Layered (décomposition guidée par prompt). Les variantes de la famille Qwen Image 2.0 sont incluses sous le même préfixe.

Exemple de résultat de Qwen Image

Présentation

À propos de Qwen Image API

Ce que fait Qwen Image, sa place dans la gamme de modèles Alibaba, et pourquoi les équipes l’adoptent.

Qwen Image est un modèle de génération et édition d’images proposé par Alibaba, disponible via l’API REST de WaveSpeedAI. Alibaba Qwen-Image — boîte à outils de texte vers image et d'édition de nouvelle génération MMDiT 20B, avec prise en charge bilingue chinois/anglais, édition multi-images, personnalisation LoRA, composition par calques et un système d'angles de caméra à 96 poses.

Texte vers image avec les variantes de base, 2512 amélioré et 2.0-pro. Les endpoints d'édition comprennent Edit, Edit-Plus (multi-images, ControlNet), Edit-LoRA, Edit-Multiple-Angles (système de caméra à 96 poses) et Layered (décomposition guidée par prompt). Les variantes de la famille Qwen Image 2.0 sont incluses sous le même préfixe.

La famille Qwen Image sur WaveSpeedAI propose 21 points d’accès REST couvrant les workflows Image-To-Image, Text-To-Image, Training. Chaque variante a ses propres tarifs, paramètres et exemples de résultats — choisissez celle qui correspond à votre type d’entrée et à vos contraintes de production, ou appelez-en plusieurs avec la même clé API pour composer des pipelines en plusieurs étapes.

Exécutez Qwen Image avec la même clé API, le même compte de facturation et les mêmes limites de débit que pour les plus de 1 000 autres modèles IA de WaveSpeedAI. Pas de configuration fournisseur distincte, pas de SDK par fournisseur, pas de limites de débit par fournisseur — une seule intégration couvre tout, du texte vers image et du texte vers vidéo à la synthèse audio, la génération 3D, l’agrandissement et l’édition.

Points d’accès

Tous les points d’accès de l’API Qwen Image

21 points d’accès Qwen Image disponibles dès maintenant sur WaveSpeedAI — choisissez la variante qui correspond à votre workflow.

image-to-imageQwen Image 2.0 Edit — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.03
image-to-imageQwen Image 2.0 Pro Edit — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.07
text-to-imageQwen Image 2.0 Text To Image — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.03
text-to-imageQwen Image 2.0 Pro Text To Image — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.07
image-to-imageQwen Image Edit 2509 Multiple Angles — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.025
image-to-imageQwen Image Max Edit — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.07
text-to-imageQwen Image Max Text To Image — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.07
image-to-imageQwen Image Edit Multiple Angles — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.025
trainingQwen Image 2512 Lora Trainer — aperçu training de Qwen Image par Alibaba

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

à partir de $1.00
text-to-imageQwen Image Text To Image 2512 Lora — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

à partir de $0.025
text-to-imageQwen Image Text To Image 2512 — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

à partir de $0.02
image-to-imageQwen Image Edit 2511 Lora — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

à partir de $0.025
image-to-imageQwen Image Edit 2511 — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

à partir de $0.02
image-to-imageQwen Image Layered — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

à partir de $0.025
image-to-imageQwen Image Edit Plus Lora — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.025
image-to-imageQwen Image Edit Plus — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.02
image-to-imageQwen Image Edit Lora — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

à partir de $0.025
image-to-imageQwen Image Edit — aperçu image-to-image de Qwen Image par Alibaba

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.02
trainingQwen Image Lora Trainer — aperçu training de Qwen Image par Alibaba

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

à partir de $1.00
text-to-imageQwen Image Text To Image Lora — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.025
text-to-imageQwen Image Text To Image — aperçu text-to-image de Qwen Image par Alibaba

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

à partir de $0.02

Exemples

Qwen Image en action

De vrais résultats générés par l’API Qwen Image. Survolez une vidéo pour la prévisualiser, cliquez pour ouvrir la visionneuse en taille réelle.

Mode d’emploi

Comment utiliser l’API Qwen Image

Quatre étapes de l’inscription à une génération terminée. Des exemples complets en Python, Node.js et cURL se trouvent dans la section API ci-dessous.

  1. 01

    Obtenez une clé API

    Créez un compte WaveSpeedAI et copiez votre clé API depuis le tableau de bord. Les nouveaux comptes reçoivent des crédits de démarrage gratuits — de quoi utiliser le playground quelques dizaines de fois avant le début de la facturation.

  2. 02

    Soumettez une prédiction

    Envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. Le point d’accès renvoie immédiatement un identifiant de prédiction — les générations sont asynchrones, vous ne gardez donc pas de connexion ouverte pendant l’inférence.

  3. 03

    Interrogez jusqu’à la fin

    GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retournez les outputs sur completed ; arrêtez avec une erreur sur failed, cancelled, timeout ou deleted ; continuez d’interroger pour tout autre statut.

  4. 04

    Lisez l’URL du résultat

    Une fois le statut "completed", lisez l’URL dans data.outputs[0]. Elle pointe vers votre média généré sur le CDN de WaveSpeedAI — fichier image, vidéo, audio ou 3D selon la variante Qwen Image appelée.

Cas d’usage

Ce que vous pouvez créer avec Qwen Image

Les workflows courants pour lesquels développeurs et créateurs utilisent l’API Qwen Image.

01

Texte vers image MMDiT 20B

wavespeed-ai/qwen-image/text-to-image est un modèle de texte vers image de nouvelle génération MMDiT 20B qui génère des images à partir de prompts textuels — l'endpoint de génération de base de la famille Qwen Image.

text-to-image20bmmdit
02

2512 amélioré avec un rendu de texte supérieur

wavespeed-ai/qwen-image/text-to-image-2512 est le dernier modèle de texte vers image de Qwen, avec une compréhension améliorée des prompts, un rendu de texte supérieur et la prise en charge de formats d'image variés selon le catalogue.

2512typographyaspect-ratio
03

Édition multi-images avec Edit-Plus

wavespeed-ai/qwen-image/edit-plus est un éditeur MMDiT 20B avec édition multi-images, cohérence en image unique et prise en charge native de ControlNet — utile pour les éditions complexes qui s'appuient sur plusieurs images sources.

edit-plusmulti-imagecontrolnet
04

Contrôle de l'angle de caméra à 96 poses

wavespeed-ai/qwen-image/edit-multiple-angles génère des angles de caméra précis à partir d'une seule image grâce à un système de caméra à 96 poses — contrôlez la rotation horizontale, l'inclinaison verticale et le zoom pour obtenir des vues de face, de côté, de dos et plus.

camera-angles96-pose3d-views
05

Décomposition en calques pour la composition

wavespeed-ai/qwen-image/layered est un modèle unifié de décomposition en calques pour la composition guidée par prompt — fournissez des points, des boîtes ou des masques approximatifs pour isoler des sujets et séparer une seule image en calques.

layeredcompositingdecomposition
06

Personnalisation LoRA

Les variantes compatibles LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) permettent une personnalisation rapide et une génération affinée — entraînez ou appliquez des checkpoints LoRA pour la cohérence de style, de personnage ou de marque.

loracustomizationconsistency

Conseils

Conseils pour rédiger vos prompts avec Qwen Image

Des conseils pratiques pour obtenir de meilleurs résultats avec Qwen Image — tirés des pratiques qui fonctionnent sur les modèles image dans les pipelines de production.

  1. 01

    Utilisez 2512 pour le rendu de texte le plus récent

    text-to-image-2512 est la variante améliorée avec un rendu de texte et une compréhension des prompts supérieurs — à préférer au text-to-image de base lorsque la typographie compte.

  2. 02

    Edit-Multiple-Angles pour les vues de produits

    edit-multiple-angles génère des angles de face, de côté, de dos et de caméra personnalisés à partir d'une seule photo de produit — utile pour les catalogues e-commerce sans prise de vue multi-caméras.

  3. 03

    Edit-Plus pour les références multi-images

    Lorsqu'une édition dépend de plusieurs images sources, utilisez edit-plus avec la prise en charge native de ControlNet plutôt que l'édition à image unique.

  4. 04

    Layered pour les workflows de composition

    Utilisez layered pour décomposer une image en calques guidés par prompt — isolez des sujets avec des points, des boîtes ou des masques approximatifs pour une composition en aval.

  5. 05

    Variantes LoRA pour la cohérence de marque

    Appliquez des checkpoints LoRA entraînés via text-to-image-2512-lora ou edit-plus-lora pour un style, un personnage ou une identité de marque récurrents d'une génération à l'autre.

  6. 06

    Édition bilingue chinois/anglais

    Edit et Edit-LoRA prennent en charge l'édition image vers image bilingue chinois/anglais avec préservation du style — utile pour les workflows de localisation.

Tarifs

Tarifs de l’API Qwen Image

La tarification se fait par résultat. Le montant final dépend des paramètres définis dans le playground de chaque variante (résolution, durée, nombre de résultats, références).

API

Appelez l’API Qwen Image

Obtenez une clé API sur wavespeed.ai/accesskey, puis soumettez une prédiction via REST. Le playground génère des exemples prêts à copier pour toute combinaison d’entrées.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Comparer

Qwen Image face aux alternatives

Quand choisir Qwen Image plutôt que des modèles similaires sur WaveSpeedAI.

Qwen Image vs Seedream 4.5

Seedream 4.5 met l'accent sur la typographie et propose des variantes Sequential pour le verrouillage d'identité multi-images. Qwen Image couvre une surface d'édition plus large — Edit-Plus, angles multiples, composition par calques et édition bilingue chinois/anglais.

Qwen Image vs GPT Image 2

GPT Image 2 propose des niveaux de qualité explicites et un workflow d'édition par image de référence. Qwen Image offre la prise en charge native de ControlNet, des angles de caméra à 96 poses et la décomposition en calques — d'autres primitives d'édition, à un coût par appel plus bas.

Qwen Image vs Nano Banana 2

Nano Banana 2 offre la cohérence multi-personnages (jusqu'à 5) et l'ancrage par recherche web. Qwen Image l'emporte sur la profondeur d'édition — Edit-Plus multi-images, génération d'angles de caméra et décomposition en calques guidée par prompt.

FAQ

Qwen Image API — Questions fréquentes

Tarifs, licence, intégration — les questions courantes sur l’utilisation de Qwen Image sur WaveSpeedAI.

Qu’est-ce que l’API Qwen Image ?

Qwen Image est un modèle Alibaba de génération d’images exposé sous forme d’API REST sur WaveSpeedAI. Alibaba Qwen-Image — boîte à outils de texte vers image et d'édition de nouvelle génération MMDiT 20B, avec prise en charge bilingue chinois/anglais, édition multi-images, personnalisation LoRA, composition par calques et un système d'angles de caméra à 96 poses. Vous pouvez l’appeler par programmation ou l’essayer depuis le playground indiqué ci-dessus.

Comment appeler l’API Qwen Image ?

Créez un compte WaveSpeedAI, copiez votre clé API depuis /accesskey, puis envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. Le point d’accès renvoie un identifiant de prédiction. Interrogez le point d’accès de résultat environ toutes les 2 secondes, augmentez l’intervalle pour les tâches longues et arrêtez-vous à tout statut final. Des exemples Python / Node.js / cURL orientés production figurent ci-dessus.

Combien coûte l’API Qwen Image ?

Qwen Image démarre à $0.02 par exécution. Le coût exact dépend des paramètres définis (résolution, durée, nombre de résultats, références). L’estimation en direct à côté du bouton Générer dans le playground affiche le prix exact pour votre saisie actuelle.

Quelles variantes de Qwen Image sont disponibles ?

WaveSpeedAI héberge 21 points d’accès Qwen Image actifs : wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, et d’autres. Chaque variante a sa propre page playground et ses propres tarifs.

Puis-je utiliser commercialement les résultats de Qwen Image ?

Les droits d’usage commercial suivent la licence du modèle Alibaba. La plupart des modèles Alibaba autorisent l’usage commercial des résultats ; consultez la page playground de chaque modèle pour le résumé de sa licence, et les Conditions d’utilisation de WaveSpeedAI pour les conditions au niveau de la plateforme.

Pourquoi utiliser Qwen Image sur WaveSpeedAI plutôt qu’en direct ?

Une seule clé API et un seul compte de facturation pour Qwen Image ET plus de 1 000 autres modèles IA d’autres fournisseurs. Pas de configuration de SDK par fournisseur, pas de limites de débit distinctes, pas de code d’intégration à réécrire pour chaque fournisseur. Les tarifs sont généralement au niveau de l’API directe de Alibaba, ou en dessous.

Fournisseur

À propos de Alibaba

L’équipe derrière Qwen Image et la gamme plus large de modèles Alibaba sur WaveSpeedAI.

Le laboratoire Tongyi d'Alibaba produit la famille de modèles vidéo Wan et la famille de LLM Qwen. Wan se distingue par sa publication en open weights, sa large couverture de variantes (texte vers vidéo, image vers vidéo, référence vers vidéo, video-edit, video-extend, image-edit, texte vers image) et sa solidité constante en stabilité du mouvement et en respect du prompt, y compris avec des prompts multilingues.

Commencez à créer avec Qwen Image sur WaveSpeedAI

Crédits de démarrage gratuits à l’inscription. Une seule clé API pour plus de 1 000 modèles IA de Alibaba et de tous les autres fournisseurs.