Nano Banana 2.1 DISPONÍVEL — O mais novo do Google | Experimente →
AlibabaAPI de imagemA partir de $0.02/execução

Qwen Image API

Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses.

Texto para imagem nas variantes base, 2512 aprimorada e 2.0-pro. Os endpoints de edição incluem Edit, Edit-Plus (várias imagens, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema de câmera com 96 poses) e Layered (decomposição guiada por prompt). Variantes da família Qwen Image 2.0 incluídas sob o mesmo prefixo.

Exemplo de resultado do Qwen Image

Visão geral

Sobre o Qwen Image API

O que o Qwen Image faz, como ele se encaixa na linha de modelos da Alibaba e por que as equipes o escolhem.

Qwen Image é um modelo de geração e edição de imagens da Alibaba, disponível pela API REST da WaveSpeedAI. Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses.

Texto para imagem nas variantes base, 2512 aprimorada e 2.0-pro. Os endpoints de edição incluem Edit, Edit-Plus (várias imagens, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema de câmera com 96 poses) e Layered (decomposição guiada por prompt). Variantes da família Qwen Image 2.0 incluídas sob o mesmo prefixo.

A família Qwen Image na WaveSpeedAI traz 21 endpoints REST cobrindo os fluxos de Image-To-Image, Text-To-Image, Training. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.

Execute o Qwen Image com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.

Endpoints

Todos os endpoints da API de Qwen Image

21 endpoints de Qwen Image disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.

image-to-imageQwen Image 2.0 Edit — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.03
image-to-imageQwen Image 2.0 Pro Edit — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.07
text-to-imageQwen Image 2.0 Text To Image — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.03
text-to-imageQwen Image 2.0 Pro Text To Image — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.07
image-to-imageQwen Image Edit 2509 Multiple Angles — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.025
image-to-imageQwen Image Max Edit — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.07
text-to-imageQwen Image Max Text To Image — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.07
image-to-imageQwen Image Edit Multiple Angles — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.025
trainingQwen Image 2512 Lora Trainer — prévia de training de Qwen Image da Alibaba

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

a partir de $1.00
text-to-imageQwen Image Text To Image 2512 Lora — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

a partir de $0.025
text-to-imageQwen Image Text To Image 2512 — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

a partir de $0.02
image-to-imageQwen Image Edit 2511 Lora — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

a partir de $0.025
image-to-imageQwen Image Edit 2511 — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

a partir de $0.02
image-to-imageQwen Image Layered — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

a partir de $0.025
image-to-imageQwen Image Edit Plus Lora — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.025
image-to-imageQwen Image Edit Plus — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.02
image-to-imageQwen Image Edit Lora — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

a partir de $0.025
image-to-imageQwen Image Edit — prévia de image-to-image de Qwen Image da Alibaba

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.02
trainingQwen Image Lora Trainer — prévia de training de Qwen Image da Alibaba

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

a partir de $1.00
text-to-imageQwen Image Text To Image Lora — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.025
text-to-imageQwen Image Text To Image — prévia de text-to-image de Qwen Image da Alibaba

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

a partir de $0.02

Exemplos

Veja o Qwen Image em ação

Resultados reais gerados pela API do Qwen Image. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.

Como usar

Como usar a API do Qwen Image

Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.

  1. 01

    Obtenha uma chave de API

    Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.

  2. 02

    Envie uma predição

    Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.

  3. 03

    Consulte até concluir

    Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.

  4. 04

    Leia a URL do resultado

    Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do Qwen Image que você chamou.

Casos de uso

O que você pode criar com o Qwen Image

Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do Qwen Image.

01

Texto para imagem com MMDiT de 20B

wavespeed-ai/qwen-image/text-to-image é um modelo de texto para imagem de nova geração com MMDiT de 20B que gera imagens a partir de prompts de texto — o endpoint de geração base da família Qwen Image.

text-to-image20bmmdit
02

2512 aprimorado, com renderização de texto superior

wavespeed-ai/qwen-image/text-to-image-2512 é o modelo de texto para imagem mais recente da Qwen, com compreensão de prompts aprimorada, renderização de texto superior e suporte versátil a proporções de tela, segundo o catálogo.

2512typographyaspect-ratio
03

Edição de várias imagens com o Edit-Plus

wavespeed-ai/qwen-image/edit-plus é um editor MMDiT de 20B com edição de várias imagens, consistência de imagem única e suporte nativo a ControlNet — útil para edições complexas que se baseiam em várias imagens de origem.

edit-plusmulti-imagecontrolnet
04

Controle de ângulo de câmera com 96 poses

wavespeed-ai/qwen-image/edit-multiple-angles gera ângulos de câmera específicos a partir de uma única imagem usando um sistema de câmera com 96 poses — controle a rotação horizontal, a inclinação vertical e o zoom para vistas frontal, lateral, traseira e mais.

camera-angles96-pose3d-views
05

Decomposição para composição em camadas

wavespeed-ai/qwen-image/layered é um modelo unificado de decomposição de imagens em camadas para composição guiada por prompt — forneça pontos, caixas ou máscaras aproximadas para isolar sujeitos e dividir uma única imagem em camadas.

layeredcompositingdecomposition
06

Personalização com LoRA

As variantes com suporte a LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) permitem personalização rápida e geração refinada — treine ou aplique checkpoints LoRA para consistência de estilo, personagem ou marca.

loracustomizationconsistency

Dicas

Dicas de prompt para o Qwen Image

Conselhos práticos para obter melhores resultados com o Qwen Image — extraídos dos padrões que funcionam em modelos de imagem em pipelines de produção.

  1. 01

    Use o 2512 para a renderização de texto mais recente

    text-to-image-2512 é a variante aprimorada, com renderização de texto e compreensão de prompts superiores — prefira-a ao text-to-image base quando a tipografia importar.

  2. 02

    Edit-Multiple-Angles para vistas de produto

    edit-multiple-angles gera ângulos de câmera frontal, lateral, traseiro e personalizados a partir de uma única foto de produto — útil para catálogos de e-commerce sem uma sessão com várias câmeras.

  3. 03

    Edit-Plus para referências de várias imagens

    Quando uma edição depende de várias imagens de origem, use o edit-plus com suporte nativo a ControlNet, em vez da edição de imagem única.

  4. 04

    Layered para workflows de composição

    Use o layered para decompor uma imagem em camadas guiadas por prompt — isole sujeitos com pontos, caixas ou máscaras aproximadas para a composição posterior.

  5. 05

    Variantes LoRA para consistência de marca

    Aplique checkpoints LoRA treinados com text-to-image-2512-lora ou edit-plus-lora para manter estilo, personagem ou identidade de marca recorrentes entre as gerações.

  6. 06

    Edição bilíngue chinês/inglês

    O Edit e o Edit-LoRA suportam edição de imagem para imagem bilíngue chinês/inglês com preservação de estilo — útil para workflows de localização.

Preços

Preços da API de Qwen Image

O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).

API

Chame a API de Qwen Image

Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Comparar

Qwen Image vs alternativas

Quando escolher o Qwen Image em vez de modelos semelhantes na WaveSpeedAI.

Qwen Image vs Seedream 4.5

O Seedream 4.5 prioriza a tipografia e traz variantes Sequential para fixar a identidade em várias imagens. O Qwen Image cobre uma superfície de edição mais ampla — Edit-Plus, múltiplos ângulos, composição em camadas e edição bilíngue chinês/inglês.

Qwen Image vs GPT Image 2

O GPT Image 2 tem níveis de qualidade explícitos e workflow de edição com imagem de referência. O Qwen Image traz suporte nativo a ControlNet, ângulos de câmera com 96 poses e decomposição em camadas — primitivas de edição diferentes, a um custo menor por chamada.

Qwen Image vs Nano Banana 2

O Nano Banana 2 traz consistência de vários personagens (até 5) e busca na web como base. O Qwen Image vence em profundidade de edição — Edit-Plus com várias imagens, geração de ângulos de câmera e decomposição em camadas guiada por prompt.

FAQ

Qwen Image API — Perguntas frequentes

Preços, licença, integração — perguntas comuns sobre executar o Qwen Image na WaveSpeedAI.

O que é a API do Qwen Image?

Qwen Image é um modelo de geração de imagens da Alibaba disponibilizado como API REST na WaveSpeedAI. Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses. Você pode chamá-lo por código ou testá-lo no playground indicado acima.

Como chamo a API do Qwen Image?

Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.

Quanto custa a API do Qwen Image?

O Qwen Image começa em $0.02 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.

Quais variantes do Qwen Image estão disponíveis?

A WaveSpeedAI hospeda 21 endpoints de Qwen Image ativos: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, e mais. Cada variante tem sua própria página de playground e seu preço.

Posso usar os resultados do Qwen Image comercialmente?

Os direitos de uso comercial seguem a licença do modelo da Alibaba. A maioria dos modelos da Alibaba permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.

Por que usar o Qwen Image na WaveSpeedAI em vez de ir direto à fonte?

Uma chave de API e uma conta de cobrança para o Qwen Image E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da Alibaba.

Provedor

Sobre a Alibaba

A equipe por trás do Qwen Image e de toda a linha de modelos da Alibaba na WaveSpeedAI.

O Tongyi Lab da Alibaba produz a família de modelos de vídeo Wan e a família de LLMs Qwen. O Wan se destaca por ter sido lançado com pesos abertos, ampla cobertura de variantes (texto para vídeo, imagem para vídeo, referência para vídeo, video-edit, video-extend, image-edit, texto para imagem) e força constante em estabilidade de movimento e aderência ao prompt com prompts em vários idiomas.

Comece a criar com o Qwen Image na WaveSpeedAI

Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da Alibaba e de todos os outros provedores.