Qwen Image API
Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses.
Texto para imagem nas variantes base, 2512 aprimorada e 2.0-pro. Os endpoints de edição incluem Edit, Edit-Plus (várias imagens, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema de câmera com 96 poses) e Layered (decomposição guiada por prompt). Variantes da família Qwen Image 2.0 incluídas sob o mesmo prefixo.
/filters:quality(82)/examples/e26b4143e025f71d55e3e5704c446d2b/1783682236366122456_NdT2cmvE.webp)
Visão geral
Sobre o Qwen Image API
O que o Qwen Image faz, como ele se encaixa na linha de modelos da Alibaba e por que as equipes o escolhem.
Qwen Image é um modelo de geração e edição de imagens da Alibaba, disponível pela API REST da WaveSpeedAI. Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses.
Texto para imagem nas variantes base, 2512 aprimorada e 2.0-pro. Os endpoints de edição incluem Edit, Edit-Plus (várias imagens, ControlNet), Edit-LoRA, Edit-Multiple-Angles (sistema de câmera com 96 poses) e Layered (decomposição guiada por prompt). Variantes da família Qwen Image 2.0 incluídas sob o mesmo prefixo.
A família Qwen Image na WaveSpeedAI traz 21 endpoints REST cobrindo os fluxos de Image-To-Image, Text-To-Image, Training. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.
Execute o Qwen Image com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.
Endpoints
Todos os endpoints da API de Qwen Image
21 endpoints de Qwen Image disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.
/filters:quality(82)/media/images/20260408110013_8als1nwx.webp)
Qwen Image 2.0 Edit
Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110922_079iorac.webp)
Qwen Image 2.0 Pro Edit
Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110019_rr2dv7f5.webp)
Qwen Image 2.0 Text To Image
Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110930_uej3wr3b.webp)
Qwen Image 2.0 Pro Text To Image
Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110201_c4uo1ban.webp)
Qwen Image Edit 2509 Multiple Angles
Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105730_1fu19xjx.webp)
Qwen Image Max Edit
Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105738_sf8u0u8s.webp)
Qwen Image Max Text To Image
Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110235_id9bp4jx.webp)
Qwen Image Edit Multiple Angles
Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111145_9y1tzzdn.webp)
Qwen Image 2512 Lora Trainer
Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110225_tzvu0c8q.webp)
Qwen Image Text To Image 2512 Lora
Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110216_pnfbnar4.webp)
Qwen Image Text To Image 2512
Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110130_3mxvct8p.webp)
Qwen Image Edit 2511 Lora
Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110155_wmxhc3xt.webp)
Qwen Image Edit 2511
Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110230_htadxp5h.webp)
Qwen Image Layered
Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.
/filters:quality(82)/media/images/20260408110212_z5lpi1m1.webp)
Qwen Image Edit Plus Lora
Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110146_inh26a0l.webp)
Qwen Image Edit Plus
Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110141_4lrnn2jl.webp)
Qwen Image Edit Lora
Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110150_zif3ayyb.webp)
Qwen Image Edit
Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111422_uw2jz93m.webp)
Qwen Image Lora Trainer
Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408110137_50swwx4z.webp)
Qwen Image Text To Image Lora
Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110208_kl4q8jw4.webp)
Qwen Image Text To Image
Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemplos
Veja o Qwen Image em ação
Resultados reais gerados pela API do Qwen Image. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.
Como usar
Como usar a API do Qwen Image
Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.
- 01
Obtenha uma chave de API
Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.
- 02
Envie uma predição
Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.
- 03
Consulte até concluir
Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.
- 04
Leia a URL do resultado
Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do Qwen Image que você chamou.
Casos de uso
O que você pode criar com o Qwen Image
Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do Qwen Image.
Texto para imagem com MMDiT de 20B
wavespeed-ai/qwen-image/text-to-image é um modelo de texto para imagem de nova geração com MMDiT de 20B que gera imagens a partir de prompts de texto — o endpoint de geração base da família Qwen Image.
2512 aprimorado, com renderização de texto superior
wavespeed-ai/qwen-image/text-to-image-2512 é o modelo de texto para imagem mais recente da Qwen, com compreensão de prompts aprimorada, renderização de texto superior e suporte versátil a proporções de tela, segundo o catálogo.
Edição de várias imagens com o Edit-Plus
wavespeed-ai/qwen-image/edit-plus é um editor MMDiT de 20B com edição de várias imagens, consistência de imagem única e suporte nativo a ControlNet — útil para edições complexas que se baseiam em várias imagens de origem.
Controle de ângulo de câmera com 96 poses
wavespeed-ai/qwen-image/edit-multiple-angles gera ângulos de câmera específicos a partir de uma única imagem usando um sistema de câmera com 96 poses — controle a rotação horizontal, a inclinação vertical e o zoom para vistas frontal, lateral, traseira e mais.
Decomposição para composição em camadas
wavespeed-ai/qwen-image/layered é um modelo unificado de decomposição de imagens em camadas para composição guiada por prompt — forneça pontos, caixas ou máscaras aproximadas para isolar sujeitos e dividir uma única imagem em camadas.
Personalização com LoRA
As variantes com suporte a LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) permitem personalização rápida e geração refinada — treine ou aplique checkpoints LoRA para consistência de estilo, personagem ou marca.
Dicas
Dicas de prompt para o Qwen Image
Conselhos práticos para obter melhores resultados com o Qwen Image — extraídos dos padrões que funcionam em modelos de imagem em pipelines de produção.
- 01
Use o 2512 para a renderização de texto mais recente
text-to-image-2512 é a variante aprimorada, com renderização de texto e compreensão de prompts superiores — prefira-a ao text-to-image base quando a tipografia importar.
- 02
Edit-Multiple-Angles para vistas de produto
edit-multiple-angles gera ângulos de câmera frontal, lateral, traseiro e personalizados a partir de uma única foto de produto — útil para catálogos de e-commerce sem uma sessão com várias câmeras.
- 03
Edit-Plus para referências de várias imagens
Quando uma edição depende de várias imagens de origem, use o edit-plus com suporte nativo a ControlNet, em vez da edição de imagem única.
- 04
Layered para workflows de composição
Use o layered para decompor uma imagem em camadas guiadas por prompt — isole sujeitos com pontos, caixas ou máscaras aproximadas para a composição posterior.
- 05
Variantes LoRA para consistência de marca
Aplique checkpoints LoRA treinados com text-to-image-2512-lora ou edit-plus-lora para manter estilo, personagem ou identidade de marca recorrentes entre as gerações.
- 06
Edição bilíngue chinês/inglês
O Edit e o Edit-LoRA suportam edição de imagem para imagem bilíngue chinês/inglês com preservação de estilo — útil para workflows de localização.
Preços
Preços da API de Qwen Image
O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).
API
Chame a API de Qwen Image
Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
Qwen Image vs alternativas
Quando escolher o Qwen Image em vez de modelos semelhantes na WaveSpeedAI.
Qwen Image vs Seedream 4.5
O Seedream 4.5 prioriza a tipografia e traz variantes Sequential para fixar a identidade em várias imagens. O Qwen Image cobre uma superfície de edição mais ampla — Edit-Plus, múltiplos ângulos, composição em camadas e edição bilíngue chinês/inglês.
Qwen Image vs GPT Image 2
O GPT Image 2 tem níveis de qualidade explícitos e workflow de edição com imagem de referência. O Qwen Image traz suporte nativo a ControlNet, ângulos de câmera com 96 poses e decomposição em camadas — primitivas de edição diferentes, a um custo menor por chamada.
Qwen Image vs Nano Banana 2
O Nano Banana 2 traz consistência de vários personagens (até 5) e busca na web como base. O Qwen Image vence em profundidade de edição — Edit-Plus com várias imagens, geração de ângulos de câmera e decomposição em camadas guiada por prompt.
FAQ
Qwen Image API — Perguntas frequentes
Preços, licença, integração — perguntas comuns sobre executar o Qwen Image na WaveSpeedAI.
O que é a API do Qwen Image?
Qwen Image é um modelo de geração de imagens da Alibaba disponibilizado como API REST na WaveSpeedAI. Alibaba Qwen-Image — kit de nova geração de texto para imagem e edição com MMDiT de 20B, suporte bilíngue chinês/inglês, edição de várias imagens, personalização com LoRA, composição em camadas e um sistema de ângulos de câmera com 96 poses. Você pode chamá-lo por código ou testá-lo no playground indicado acima.
Como chamo a API do Qwen Image?
Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.
Quanto custa a API do Qwen Image?
O Qwen Image começa em $0.02 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.
Quais variantes do Qwen Image estão disponíveis?
A WaveSpeedAI hospeda 21 endpoints de Qwen Image ativos: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, e mais. Cada variante tem sua própria página de playground e seu preço.
Posso usar os resultados do Qwen Image comercialmente?
Os direitos de uso comercial seguem a licença do modelo da Alibaba. A maioria dos modelos da Alibaba permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.
Por que usar o Qwen Image na WaveSpeedAI em vez de ir direto à fonte?
Uma chave de API e uma conta de cobrança para o Qwen Image E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da Alibaba.
Provedor
Sobre a Alibaba
A equipe por trás do Qwen Image e de toda a linha de modelos da Alibaba na WaveSpeedAI.
O Tongyi Lab da Alibaba produz a família de modelos de vídeo Wan e a família de LLMs Qwen. O Wan se destaca por ter sido lançado com pesos abertos, ampla cobertura de variantes (texto para vídeo, imagem para vídeo, referência para vídeo, video-edit, video-extend, image-edit, texto para imagem) e força constante em estabilidade de movimento e aderência ao prompt com prompts em vários idiomas.
Comece a criar com o Qwen Image na WaveSpeedAI
Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da Alibaba e de todos os outros provedores.
/filters:quality(82)/examples/ab6c113bc342972e2bf6fa3a3dd02d44/1783682238198695915_4tkuDMV6.webp)
/filters:quality(82)/examples/ae55efa5dc15feeab655c08c99c0fb67/1783682240218864185_xajsBKir.webp)
/filters:quality(82)/examples/2aae35cf0e4f367122dc3f8306577ba6/1783682242738489413_BobmvEaj.webp)
/filters:quality(82)/examples/fb556f2b9aa99c70a63a0a144d14bfe1/1783682244605044938_9FNX6enx.webp)