Nano Banana 2.1 ДОСТУПНА — Новинка от Google | Попробовать →
Войти
AlibabaAPI изображенияОт $0.02 за запуск

Qwen Image API

Qwen-Image от Alibaba — набор text-to-image и редактирования нового поколения на 20B MMDiT с двуязычной поддержкой китайского/английского, редактированием нескольких изображений, настройкой LoRA, послойным компоновкой и системой ракурсов камеры из 96 поз.

Text-to-image в базовом, улучшенном 2512 и 2.0-pro вариантах. Конечные точки edit включают Edit, Edit-Plus (несколько изображений, ControlNet), Edit-LoRA, Edit-Multiple-Angles (система камеры из 96 поз) и Layered (декомпозиция по промпту). Варианты семейства Qwen Image 2.0 включены под тем же префиксом.

Пример результата Qwen Image

Обзор

О модели Qwen Image API

Что делает Qwen Image, какое место занимает в линейке моделей Alibaba и почему её выбирают команды.

Qwen Image — модель генерации и редактирования изображений от Alibaba, доступная через REST API WaveSpeedAI. Qwen-Image от Alibaba — набор text-to-image и редактирования нового поколения на 20B MMDiT с двуязычной поддержкой китайского/английского, редактированием нескольких изображений, настройкой LoRA, послойным компоновкой и системой ракурсов камеры из 96 поз.

Text-to-image в базовом, улучшенном 2512 и 2.0-pro вариантах. Конечные точки edit включают Edit, Edit-Plus (несколько изображений, ControlNet), Edit-LoRA, Edit-Multiple-Angles (система камеры из 96 поз) и Layered (декомпозиция по промпту). Варианты семейства Qwen Image 2.0 включены под тем же префиксом.

Семейство Qwen Image в WaveSpeedAI включает 21 REST-эндпоинт для сценариев: Image-To-Image, Text-To-Image, Training. У каждого варианта свои цены, параметры и примеры результатов — выберите тот, что подходит под ваш тип входных данных и требования продакшена, или вызывайте несколько с одним API-ключом и собирайте многошаговые пайплайны.

Запускайте Qwen Image с тем же API-ключом, платёжным аккаунтом и лимитами, что и остальные 1000+ ИИ-моделей WaveSpeedAI. Без отдельной регистрации у вендора, без SDK для каждого провайдера, без разных лимитов у каждого поставщика — одна интеграция охватывает всё: от текста в изображение и текста в видео до синтеза аудио, 3D-генерации, апскейлинга и редактирования.

Эндпоинты

Все эндпоинты API Qwen Image

Сейчас в WaveSpeedAI доступно эндпоинтов Qwen Image: 21 — выберите вариант под ваш сценарий.

image-to-imageQwen Image 2.0 Edit — превью image-to-image Qwen Image от Alibaba

Qwen Image 2.0 Edit

Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.03
image-to-imageQwen Image 2.0 Pro Edit — превью image-to-image Qwen Image от Alibaba

Qwen Image 2.0 Pro Edit

Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.07
text-to-imageQwen Image 2.0 Text To Image — превью text-to-image Qwen Image от Alibaba

Qwen Image 2.0 Text To Image

Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.03
text-to-imageQwen Image 2.0 Pro Text To Image — превью text-to-image Qwen Image от Alibaba

Qwen Image 2.0 Pro Text To Image

Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.07
image-to-imageQwen Image Edit 2509 Multiple Angles — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit 2509 Multiple Angles

Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.025
image-to-imageQwen Image Max Edit — превью image-to-image Qwen Image от Alibaba

Qwen Image Max Edit

Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.07
text-to-imageQwen Image Max Text To Image — превью text-to-image Qwen Image от Alibaba

Qwen Image Max Text To Image

Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.07
image-to-imageQwen Image Edit Multiple Angles — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit Multiple Angles

Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.025
trainingQwen Image 2512 Lora Trainer — превью training Qwen Image от Alibaba

Qwen Image 2512 Lora Trainer

Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

от $1.00
text-to-imageQwen Image Text To Image 2512 Lora — превью text-to-image Qwen Image от Alibaba

Qwen Image Text To Image 2512 Lora

Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

от $0.025
text-to-imageQwen Image Text To Image 2512 — превью text-to-image Qwen Image от Alibaba

Qwen Image Text To Image 2512

Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

от $0.02
image-to-imageQwen Image Edit 2511 Lora — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit 2511 Lora

Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

от $0.025
image-to-imageQwen Image Edit 2511 — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit 2511

Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.

от $0.02
image-to-imageQwen Image Layered — превью image-to-image Qwen Image от Alibaba

Qwen Image Layered

Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.

от $0.025
image-to-imageQwen Image Edit Plus Lora — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit Plus Lora

Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.025
image-to-imageQwen Image Edit Plus — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit Plus

Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.02
image-to-imageQwen Image Edit Lora — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit Lora

Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.

от $0.025
image-to-imageQwen Image Edit — превью image-to-image Qwen Image от Alibaba

Qwen Image Edit

Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.02
trainingQwen Image Lora Trainer — превью training Qwen Image от Alibaba

Qwen Image Lora Trainer

Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!

от $1.00
text-to-imageQwen Image Text To Image Lora — превью text-to-image Qwen Image от Alibaba

Qwen Image Text To Image Lora

Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.025
text-to-imageQwen Image Text To Image — превью text-to-image Qwen Image от Alibaba

Qwen Image Text To Image

Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

от $0.02

Примеры

Qwen Image в деле

Реальные результаты, созданные через API Qwen Image. Наведите курсор на видео для предпросмотра, нажмите, чтобы открыть в полном размере.

Как использовать

Как использовать API Qwen Image

Четыре шага от регистрации до готовой генерации. Полные примеры на Python, Node.js и cURL — в разделе API ниже.

  1. 01

    Получите API-ключ

    Создайте аккаунт WaveSpeedAI и скопируйте API-ключ на панели управления. Новые аккаунты получают бесплатные стартовые кредиты — их хватит, чтобы несколько десятков раз запустить playground до начала списаний.

  2. 02

    Отправьте предсказание

    Отправьте входные данные в формате JSON методом POST на https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image. Эндпоинт сразу возвращает id предсказания — генерация асинхронная, поэтому соединение не нужно держать открытым на время инференса.

  3. 03

    Опрашивайте до завершения

    Выполняйте GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. При статусе completed забирайте результат; при failed, cancelled, timeout или deleted остановитесь с ошибкой; при любом другом статусе продолжайте опрос.

  4. 04

    Получите URL результата

    Когда статус станет "completed", возьмите URL из data.outputs[0]. Он указывает на созданный файл в CDN WaveSpeedAI — изображение, видео, аудио или 3D-файл, в зависимости от вызванного варианта Qwen Image.

Сценарии применения

Что можно создать с Qwen Image

Типичные сценарии, для которых разработчики и авторы используют API Qwen Image.

01

Text-to-image на 20B MMDiT

wavespeed-ai/qwen-image/text-to-image — text-to-image модель нового поколения на 20B MMDiT, создающая изображения по текстовым промптам — базовая конечная точка генерации в семействе Qwen Image.

text-to-image20bmmdit
02

Улучшенный 2512 с превосходной отрисовкой текста

wavespeed-ai/qwen-image/text-to-image-2512 — новейшая модель text-to-image от Qwen с улучшенным пониманием промпта, превосходной отрисовкой текста и поддержкой разных соотношений сторон, по данным каталога.

2512typographyaspect-ratio
03

Редактирование нескольких изображений с Edit-Plus

wavespeed-ai/qwen-image/edit-plus — редактор на 20B MMDiT с редактированием нескольких изображений, согласованностью одного изображения и нативной поддержкой ControlNet — полезно для сложных правок, опирающихся на несколько исходных изображений.

edit-plusmulti-imagecontrolnet
04

Управление ракурсом камеры из 96 поз

wavespeed-ai/qwen-image/edit-multiple-angles создаёт нужные ракурсы камеры по одному изображению с помощью системы камеры из 96 поз — управляйте горизонтальным поворотом, вертикальным наклоном и зумом для видов спереди, сбоку, сзади и других.

camera-angles96-pose3d-views
05

Послойная декомпозиция для компоновки

wavespeed-ai/qwen-image/layered — единая модель декомпозиции изображения на слои для компоновки по промпту — задайте точки, рамки или грубые маски, чтобы выделить героев и разделить одно изображение на слои.

layeredcompositingdecomposition
06

Настройка LoRA

Варианты с поддержкой LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) позволяют быстро настраивать и уточнять генерацию — обучайте или применяйте чекпоинты LoRA для согласованности стиля, персонажа или бренда.

loracustomizationconsistency

Советы

Советы по написанию запросов для Qwen Image

Практические советы, как получать лучшие результаты от Qwen Image, — на основе приёмов, которые работают в продакшен-пайплайнах для моделей изображений.

  1. 01

    Используйте 2512 для новейшей отрисовки текста

    text-to-image-2512 — улучшенный вариант с превосходной отрисовкой текста и пониманием промпта — выбирайте его вместо базового text-to-image, когда важна типографика.

  2. 02

    Edit-Multiple-Angles для видов продукта

    edit-multiple-angles создаёт виды спереди, сбоку, сзади и произвольные ракурсы камеры по одному фото продукта — полезно для каталогов e-commerce без многокамерной съёмки.

  3. 03

    Edit-Plus для референсов из нескольких изображений

    Когда правка зависит от нескольких исходных изображений, используйте edit-plus с нативной поддержкой ControlNet вместо редактирования одного изображения.

  4. 04

    Layered для процессов компоновки

    Используйте layered, чтобы разложить изображение на слои по промпту — выделяйте героев точками, рамками или грубыми масками для последующей компоновки.

  5. 05

    Варианты LoRA для согласованности бренда

    Применяйте обученные чекпоинты LoRA через text-to-image-2512-lora или edit-plus-lora для постоянного стиля, персонажа или фирменной идентичности во всех генерациях.

  6. 06

    Двуязычное редактирование на китайском/английском

    Edit и Edit-LoRA поддерживают двуязычное редактирование image-to-image на китайском/английском с сохранением стиля — полезно для процессов локализации.

Цены

Цены на API Qwen Image

Оплата — за каждый результат. Итоговая стоимость зависит от параметров, заданных в playground каждого варианта (разрешение, длительность, количество результатов, референсы).

API

Вызов API Qwen Image

Получите API-ключ на wavespeed.ai/accesskey, затем отправьте предсказание через REST. Playground генерирует готовые к вставке примеры для любой комбинации входных данных.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "size": "1024*1024",
    "output_format": "jpeg"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Сравнение

Qwen Image и альтернативы

Когда стоит выбрать Qwen Image, а не похожие модели в WaveSpeedAI.

Qwen Image и Seedream 4.5

Seedream 4.5 делает упор на типографику и предлагает варианты Sequential для фиксации идентичности на нескольких изображениях. Qwen Image охватывает более широкий набор редактирования — Edit-Plus, несколько ракурсов, послойную компоновку и двуязычное редактирование на китайском/английском.

Qwen Image и GPT Image 2

У GPT Image 2 есть явные уровни качества и процесс редактирования по референсным изображениям. Qwen Image предлагает нативную поддержку ControlNet, ракурсы камеры из 96 поз и послойную декомпозицию — другие примитивы редактирования по более низкой цене за вызов.

Qwen Image и Nano Banana 2

Nano Banana 2 даёт согласованность нескольких персонажей (до 5) и опору на веб-поиск. Qwen Image выигрывает по глубине редактирования — Edit-Plus для нескольких изображений, генерация ракурсов камеры и послойная декомпозиция по промпту.

FAQ

Qwen Image API — часто задаваемые вопросы

Цены, лицензия, интеграция — частые вопросы о запуске Qwen Image в WaveSpeedAI.

Что такое API Qwen Image?

Qwen Image — модель генерации изображений от Alibaba, доступная как REST API в WaveSpeedAI. Qwen-Image от Alibaba — набор text-to-image и редактирования нового поколения на 20B MMDiT с двуязычной поддержкой китайского/английского, редактированием нескольких изображений, настройкой LoRA, послойным компоновкой и системой ракурсов камеры из 96 поз. Её можно вызывать программно или попробовать в playground по ссылке выше.

Как вызывать API Qwen Image?

Создайте аккаунт WaveSpeedAI, скопируйте API-ключ на странице /accesskey и отправьте POST на https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image с входными данными в JSON. Эндпоинт вернёт id предсказания. Опрашивайте эндпоинт результата примерно раз в 2 секунды, для долгих задач увеличивайте интервал и останавливайтесь на любом финальном статусе. Примеры для продакшена на Python / Node.js / cURL — выше.

Сколько стоит API Qwen Image?

Qwen Image стоит от $0.02 за запуск. Точная стоимость зависит от заданных параметров (разрешение, длительность, количество результатов, референсы). Предпросмотр стоимости рядом с кнопкой «Сгенерировать» в playground показывает точную цену для ваших текущих данных.

Какие варианты Qwen Image доступны?

В WaveSpeedAI доступно рабочих эндпоинтов Qwen Image: 21 — wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, и другие. У каждого варианта своя страница playground и свои цены.

Можно ли использовать результаты Qwen Image в коммерческих целях?

Права на коммерческое использование определяются лицензией модели Alibaba. Большинство моделей Alibaba разрешают коммерческое использование результатов; краткое описание лицензии смотрите на странице playground каждой модели, а условия платформы — в Условиях использования WaveSpeedAI.

Зачем использовать Qwen Image в WaveSpeedAI, а не напрямую?

Один API-ключ и один платёжный аккаунт для Qwen Image И для 1000+ других ИИ-моделей от разных провайдеров. Без настройки SDK для каждого вендора, без отдельных лимитов, без переписывания интеграционного кода под каждого поставщика. Цены, как правило, на уровне прямого API Alibaba или ниже.

Разработчик

О Alibaba

Команда, стоящая за Qwen Image и всей линейкой моделей Alibaba в WaveSpeedAI.

Лаборатория Tongyi Lab компании Alibaba выпускает семейство видеомоделей Wan и семейство LLM Qwen. Wan известна открытыми весами, широким набором вариантов (text-to-video, image-to-video, reference-to-video, video-edit, video-extend, image-edit, text-to-image) и стабильно сильными показателями по устойчивости движения и следованию промпту в многоязычных запросах.

Начните создавать с Qwen Image в WaveSpeedAI

Бесплатные стартовые кредиты при регистрации. Один API-ключ для 1000+ ИИ-моделей от Alibaba и всех остальных провайдеров.