Nano Banana 2.1 DOSTĘPNE — Najnowszy od Google | Wypróbuj →
AlibabaAPI obrazOd $0.02/uruchomienie

Qwen Image API

Alibaba Qwen-Image — zestaw narzędzi nowej generacji 20B MMDiT do tekstu na obraz i edycji z dwujęzyczną obsługą chińskiego/angielskiego, edycją wielu obrazów, dostosowywaniem LoRA, warstwowym komponowaniem i 96-pozycyjnym systemem kątów kamery.

Tekst na obraz w wariantach bazowym, rozszerzonym 2512 i 2.0-pro. Endpointy edycji obejmują Edit, Edit-Plus (wiele obrazów, ControlNet), Edit-LoRA, Edit-Multiple-Angles (96-pozycyjny system kamery) i Layered (dekompozycja sterowana promptem). Warianty rodziny Qwen Image 2.0 są dostępne pod tym samym prefiksem.

Przykładowy wynik Qwen Image

Przegląd

O modelu Qwen Image API

Co robi Qwen Image, jakie miejsce zajmuje w linii modeli Alibaba i dlaczego zespoły po niego sięgają.

Qwen Image to model generowania i edycji obrazów od Alibaba, dostępny przez REST API WaveSpeedAI. Alibaba Qwen-Image — zestaw narzędzi nowej generacji 20B MMDiT do tekstu na obraz i edycji z dwujęzyczną obsługą chińskiego/angielskiego, edycją wielu obrazów, dostosowywaniem LoRA, warstwowym komponowaniem i 96-pozycyjnym systemem kątów kamery.

Tekst na obraz w wariantach bazowym, rozszerzonym 2512 i 2.0-pro. Endpointy edycji obejmują Edit, Edit-Plus (wiele obrazów, ControlNet), Edit-LoRA, Edit-Multiple-Angles (96-pozycyjny system kamery) i Layered (dekompozycja sterowana promptem). Warianty rodziny Qwen Image 2.0 są dostępne pod tym samym prefiksem.

Rodzina Qwen Image w WaveSpeedAI zawiera 21 endpointów REST obejmujące workflowy: Image-To-Image, Text-To-Image, Training. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.

Uruchamiaj Qwen Image z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.

Endpointy

Wszystkie endpointy API Qwen Image

21 endpointów Qwen Image dostępnych teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.

image-to-imageQwen Image 2.0 Edit — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.03
image-to-imageQwen Image 2.0 Pro Edit — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.07
text-to-imageQwen Image 2.0 Text To Image — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.03
text-to-imageQwen Image 2.0 Pro Text To Image — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.07
image-to-imageQwen Image Edit 2509 Multiple Angles — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.025
image-to-imageQwen Image Max Edit — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.07
text-to-imageQwen Image Max Text To Image — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.07
image-to-imageQwen Image Edit Multiple Angles — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.025
trainingQwen Image 2512 Lora Trainer — podgląd training z Qwen Image od Alibaba

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $1.00
text-to-imageQwen Image Text To Image 2512 Lora — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.025
text-to-imageQwen Image Text To Image 2512 — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.02
image-to-imageQwen Image Edit 2511 Lora — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

od $0.025
image-to-imageQwen Image Edit 2511 — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

od $0.02
image-to-imageQwen Image Layered — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

od $0.025
image-to-imageQwen Image Edit Plus Lora — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.025
image-to-imageQwen Image Edit Plus — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.02
image-to-imageQwen Image Edit Lora — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

od $0.025
image-to-imageQwen Image Edit — podgląd image-to-image z Qwen Image od Alibaba

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.02
trainingQwen Image Lora Trainer — podgląd training z Qwen Image od Alibaba

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

od $1.00
text-to-imageQwen Image Text To Image Lora — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.025
text-to-imageQwen Image Text To Image — podgląd text-to-image z Qwen Image od Alibaba

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.02

Przykłady

Qwen Image w akcji

Prawdziwe wyniki wygenerowane przez API Qwen Image. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.

Jak zacząć

Jak korzystać z API Qwen Image

Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.

  1. 01

    Uzyskaj klucz API

    Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.

  2. 02

    Wyślij predykcję

    Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.

  3. 03

    Sprawdzaj ukończenie

    Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.

  4. 04

    Odczytaj adres wyniku

    Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu Qwen Image.

Zastosowania

Co możesz zbudować z Qwen Image

Typowe workflowy, do których deweloperzy i twórcy używają API Qwen Image.

01

Tekst na obraz 20B MMDiT

wavespeed-ai/qwen-image/text-to-image to model tekst na obraz nowej generacji 20B MMDiT, który generuje obrazy z promptów tekstowych — bazowy endpoint generowania w rodzinie Qwen Image.

text-to-image20bmmdit
02

Rozszerzony 2512 z doskonałym renderowaniem tekstu

wavespeed-ai/qwen-image/text-to-image-2512 to najnowszy model tekst na obraz Qwen z lepszym rozumieniem promptów, doskonałym renderowaniem tekstu i wszechstronną obsługą proporcji obrazu — według katalogu.

2512typographyaspect-ratio
03

Edycja wielu obrazów z Edit-Plus

wavespeed-ai/qwen-image/edit-plus to edytor 20B MMDiT z edycją wielu obrazów, spójnością pojedynczego obrazu i natywną obsługą ControlNet — przydatny przy złożonych edycjach odwołujących się do wielu obrazów źródłowych.

edit-plusmulti-imagecontrolnet
04

Kontrola kąta kamery w 96 pozycjach

wavespeed-ai/qwen-image/edit-multiple-angles generuje konkretne kąty kamery z jednego obrazu za pomocą 96-pozycyjnego systemu kamery — steruj obrotem poziomym, pochyleniem pionowym i zoomem dla widoków z przodu, z boku, z tyłu i innych.

camera-angles96-pose3d-views
05

Dekompozycja do komponowania warstwowego

wavespeed-ai/qwen-image/layered to ujednolicony model dekompozycji obrazu na warstwy do komponowania sterowanego promptem — podaj punkty, ramki lub zgrubne maski, aby wyodrębnić bohaterów i podzielić pojedynczy obraz na warstwy.

layeredcompositingdecomposition
06

Dostosowywanie LoRA

Warianty z obsługą LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) umożliwiają szybkie dostosowanie i dopracowane generowanie — trenuj lub stosuj punkty kontrolne LoRA dla spójności stylu, postaci lub marki.

loracustomizationconsistency

Wskazówki

Wskazówki do promptów dla Qwen Image

Praktyczne rady, jak uzyskiwać lepsze wyniki z Qwen Image — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli obrazu.

  1. 01

    Używaj 2512 dla najnowszego renderowania tekstu

    text-to-image-2512 to rozszerzony wariant z doskonałym renderowaniem tekstu i rozumieniem promptów — wybierz go zamiast bazowego text-to-image, gdy liczy się typografia.

  2. 02

    Edit-Multiple-Angles dla widoków produktu

    edit-multiple-angles generuje widoki z przodu, z boku, z tyłu i własne kąty kamery z jednego zdjęcia produktu — przydatne w katalogach e-commerce bez sesji wielokamerowej.

  3. 03

    Edit-Plus dla referencji z wielu obrazów

    Gdy edycja zależy od wielu obrazów źródłowych, użyj edit-plus z natywną obsługą ControlNet zamiast edycji pojedynczego obrazu.

  4. 04

    Layered do workflow komponowania

    Użyj layered, aby rozłożyć obraz na warstwy sterowane promptem — wyodrębnij bohaterów punktami, ramkami lub zgrubnymi maskami do dalszego komponowania.

  5. 05

    Warianty LoRA dla spójności marki

    Stosuj wytrenowane punkty kontrolne LoRA przez text-to-image-2512-lora lub edit-plus-lora dla powracającego stylu, postaci lub tożsamości marki w kolejnych generacjach.

  6. 06

    Dwujęzyczna edycja chiński/angielski

    Edit i Edit-LoRA obsługują dwujęzyczną edycję obraz na obraz chiński/angielski z zachowaniem stylu — przydatne w workflow lokalizacji.

Cennik

Cennik API Qwen Image

Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).

API

Wywołaj API Qwen Image

Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Porównanie

Qwen Image a alternatywy

Kiedy wybrać Qwen Image zamiast podobnych modeli w WaveSpeedAI.

Qwen Image a Seedream 4.5

Seedream 4.5 kładzie nacisk na typografię i oferuje warianty Sequential do blokowania tożsamości w wielu obrazach. Qwen Image obejmuje szerszy zakres edycji — Edit-Plus, wiele kątów, komponowanie warstwowe i dwujęzyczną edycję chiński/angielski.

Qwen Image a GPT Image 2

GPT Image 2 ma jawne poziomy jakości i workflow edycji z obrazem referencyjnym. Qwen Image oferuje natywną obsługę ControlNet, 96 kątów kamery i dekompozycję warstwową — inne prymitywy edycji przy niższym koszcie wywołania.

Qwen Image a Nano Banana 2

Nano Banana 2 oferuje spójność wielu postaci (do 5) i oparcie na wyszukiwaniu w sieci. Qwen Image wygrywa głębią edycji — wieloobrazowy Edit-Plus, generowanie kątów kamery i dekompozycja warstw sterowana promptem.

FAQ

Qwen Image API — najczęściej zadawane pytania

Cennik, licencja, integracja — typowe pytania o uruchamianie Qwen Image w WaveSpeedAI.

Czym jest API Qwen Image?

Qwen Image to model generowania obrazów od Alibaba, udostępniony jako REST API w WaveSpeedAI. Alibaba Qwen-Image — zestaw narzędzi nowej generacji 20B MMDiT do tekstu na obraz i edycji z dwujęzyczną obsługą chińskiego/angielskiego, edycją wielu obrazów, dostosowywaniem LoRA, warstwowym komponowaniem i 96-pozycyjnym systemem kątów kamery. Możesz wywoływać go programowo lub wypróbować w playground, do którego prowadzi link powyżej.

Jak wywołać API Qwen Image?

Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.

Ile kosztuje API Qwen Image?

Qwen Image zaczyna się od $0.02 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.

Jakie warianty Qwen Image są dostępne?

WaveSpeedAI udostępnia 21 aktywnych endpointów Qwen Image: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, i inne. Każdy wariant ma własną stronę playground i cennik.

Czy mogę używać wyników Qwen Image komercyjnie?

Prawa do komercyjnego użycia wynikają z licencji modelu Alibaba. Większość modeli Alibaba zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.

Dlaczego korzystać z Qwen Image w WaveSpeedAI zamiast bezpośrednio?

Jeden klucz API i jedno konto rozliczeniowe dla Qwen Image ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API Alibaba lub niższe.

Dostawca

O Alibaba

Zespół stojący za Qwen Image i szerszą linią modeli Alibaba w WaveSpeedAI.

Laboratorium Tongyi Alibaby tworzy rodzinę modeli wideo Wan oraz rodzinę modeli LLM Qwen. Wan wyróżnia się wydaniem z otwartymi wagami, szerokim zakresem wariantów (tekst na wideo, obraz na wideo, referencja na wideo, video-edit, video-extend, image-edit, tekst na obraz) oraz stałą mocną stroną w stabilności ruchu i wierności promptom w wielu językach.

Zacznij budować z Qwen Image w WaveSpeedAI

Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od Alibaba i wszystkich innych dostawców.