Qwen Image API
Qwen-Image จาก Alibaba — ชุดเครื่องมือข้อความเป็นภาพและแก้ไขรุ่นใหม่ 20B MMDiT รองรับสองภาษาจีน/อังกฤษ แก้ไขหลายภาพ ปรับแต่งด้วย LoRA การจัดองค์ประกอบแบบเลเยอร์ และระบบมุมกล้อง 96 ท่า
ข้อความเป็นภาพในตัวเลือกพื้นฐาน 2512 ที่ปรับปรุงแล้ว และ 2.0-pro endpoint แก้ไขประกอบด้วย Edit, Edit-Plus (หลายภาพ, ControlNet), Edit-LoRA, Edit-Multiple-Angles (ระบบกล้อง 96 ท่า) และ Layered (แยกส่วนด้วยพรอมต์) รวมตัวเลือกตระกูล Qwen Image 2.0 ภายใต้คำนำหน้าเดียวกัน
/filters:quality(82)/examples/e26b4143e025f71d55e3e5704c446d2b/1783682236366122456_NdT2cmvE.webp)
ภาพรวม
เกี่ยวกับ Qwen Image API
Qwen Image ทำอะไรได้ อยู่ตรงไหนในกลุ่มโมเดลของ Alibaba และทำไมทีมต่างๆ จึงเลือกใช้
Qwen Image คือโมเดลการสร้างและแก้ไขภาพจาก Alibaba ใช้งานได้ผ่าน REST API ของ WaveSpeedAI Qwen-Image จาก Alibaba — ชุดเครื่องมือข้อความเป็นภาพและแก้ไขรุ่นใหม่ 20B MMDiT รองรับสองภาษาจีน/อังกฤษ แก้ไขหลายภาพ ปรับแต่งด้วย LoRA การจัดองค์ประกอบแบบเลเยอร์ และระบบมุมกล้อง 96 ท่า
ข้อความเป็นภาพในตัวเลือกพื้นฐาน 2512 ที่ปรับปรุงแล้ว และ 2.0-pro endpoint แก้ไขประกอบด้วย Edit, Edit-Plus (หลายภาพ, ControlNet), Edit-LoRA, Edit-Multiple-Angles (ระบบกล้อง 96 ท่า) และ Layered (แยกส่วนด้วยพรอมต์) รวมตัวเลือกตระกูล Qwen Image 2.0 ภายใต้คำนำหน้าเดียวกัน
กลุ่ม Qwen Image บน WaveSpeedAI มี 21 REST endpoint ครอบคลุมเวิร์กโฟลว์ Image-To-Image, Text-To-Image, Training แต่ละแบบมีราคา พารามิเตอร์ที่ปรับได้ และตัวอย่างผลลัพธ์ของตัวเอง เลือกแบบที่ตรงกับประเภทอินพุตและข้อจำกัดของงานจริง หรือเรียกหลายแบบด้วย API key เดียวเพื่อประกอบเป็นไปป์ไลน์หลายขั้นตอน
รัน Qwen Image ผ่าน API key บัญชีเรียกเก็บเงิน และขีดจำกัดอัตราเดียวกับที่คุณใช้กับโมเดล AI กว่า 1,000 รายการอื่นบน WaveSpeedAI ไม่ต้องตั้งค่ากับผู้ให้บริการแยก ไม่ต้องใช้ SDK แยกตามผู้ให้บริการ และไม่ต้องจัดการขีดจำกัดอัตราแยกตามผู้ให้บริการ การเชื่อมต่อเดียวครอบคลุมทุกอย่างตั้งแต่ข้อความเป็นภาพและข้อความเป็นวิดีโอ ไปจนถึงการสังเคราะห์เสียง การสร้าง 3D การอัปสเกล และการแก้ไข
Endpoint
API endpoint ของ Qwen Image ทั้งหมด
21 endpoint ของ Qwen Image พร้อมใช้งานบน WaveSpeedAI แล้ว — เลือกแบบที่ตรงกับเวิร์กโฟลว์ของคุณ
/filters:quality(82)/media/images/20260408110013_8als1nwx.webp)
Qwen Image 2.0 Edit
Qwen Image 2.0 Edit is an advanced image-editing model with improved quality and better understanding of instructions. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110922_079iorac.webp)
Qwen Image 2.0 Pro Edit
Qwen Image 2.0 Pro Edit is a professional-grade image editing model with superior quality and advanced instruction understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110019_rr2dv7f5.webp)
Qwen Image 2.0 Text To Image
Qwen Image 2.0 is an advanced text-to-image model with enhanced image quality and improved prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110930_uej3wr3b.webp)
Qwen Image 2.0 Pro Text To Image
Qwen Image 2.0 Pro is a professional-grade text-to-image model with superior quality and advanced prompt understanding. Up to 2k. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110201_c4uo1ban.webp)
Qwen Image Edit 2509 Multiple Angles
Qwen Image Edit 2509 Multiple Angles is an AI image editing model that generates multiple-angle views of objects or scenes from a single image. Transform perspectives and create diverse viewpoints with text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105730_1fu19xjx.webp)
Qwen Image Max Edit
Qwen Image Max Edit is an AI model for image editing with text prompts, supporting both Chinese and English languages. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105738_sf8u0u8s.webp)
Qwen Image Max Text To Image
Qwen Image Max is a text-to-image model with high-quality image generation supporting Chinese and English prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110235_id9bp4jx.webp)
Qwen Image Edit Multiple Angles
Generate specific camera angles from a single image using a 96-pose camera system. Control horizontal rotation, vertical tilt, and zoom to create front, side, back views and more. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111145_9y1tzzdn.webp)
Qwen Image 2512 Lora Trainer
Qwen-Image-2512 LoRA Trainer lets you train custom LoRA models 10x faster with style, character, and object training. From concept to model in minutes, not hours—upload a ZIP file containing images to start. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110225_tzvu0c8q.webp)
Qwen Image Text To Image 2512 Lora
Qwen-Image-2512 LoRA is an enhanced 20B MMDiT text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110216_pnfbnar4.webp)
Qwen Image Text To Image 2512
Qwen Image 2512 is Qwen's latest text-to-image model with enhanced prompt understanding, superior text rendering, and versatile aspect ratio support. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408110130_3mxvct8p.webp)
Qwen Image Edit 2511 Lora
Qwen Image Edit 2511 LoRA is an enhanced version with custom LoRA support for personalized styles. It delivers stronger edit consistency, robust multi-person identity/pose consistency, custom LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110155_wmxhc3xt.webp)
Qwen Image Edit 2511
Qwen Image Edit 2511 is a major upgrade over 2509 for real-world image editing and design. It delivers stronger edit consistency, robust multi-person identity/pose consistency, built-in LoRA styles, enhanced industrial/product design, and improved geometric reasoning for structure-preserving edits. Built for stable production use with a ready-to-use REST API, no cold starts, and predictable pricing.
/filters:quality(82)/media/images/20260408110230_htadxp5h.webp)
Qwen Image Layered
Qwen-Image Layered is a unified image-layer decomposition model for prompt-guided compositing. Provide points, boxes, or rough masks to isolate subjects and regions, and the model splits a single image into multiple RGBA layers with clean alpha, soft edges, and correct occlusion order. Ready-to-use REST inference API with fast response, no cold starts, and affordable pricing.
/filters:quality(82)/media/images/20260408110212_z5lpi1m1.webp)
Qwen Image Edit Plus Lora
Qwen-Image-Edit-Plus (2509) is 20B MMDiT image-to-image editor supporting multi-image edits, single-image consistency, and native ControlNet. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110146_inh26a0l.webp)
Qwen Image Edit Plus
Qwen-Image-Edit-Plus (2509) is a 20B MMDiT image editor with multi-image editing, single-image consistency and native ControlNet support. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110141_4lrnn2jl.webp)
Qwen Image Edit Lora
Qwen-Image-Edit LoRA (20B) enables bilingual Chinese/English image-to-image editing with style preservation and semantic and appearance edits. Ready-to-use REST API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110150_zif3ayyb.webp)
Qwen Image Edit
Qwen-Image-Edit is a 20B MMDiT image-to-image model offering precise bilingual (Chinese & English) text edits while preserving style. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111422_uw2jz93m.webp)
Qwen Image Lora Trainer
Train custom Qwen-Image LoRA models 10x faster. Style training, character training, object training. From concept to model in minutes, not hours. Upload a ZIP file containing images to start!
/filters:quality(82)/media/images/20260408110137_50swwx4z.webp)
Qwen Image Text To Image Lora
Qwen-Image LoRA is a 20B MMDiT next-gen text-to-image model with LoRA support for fast customization and refined image generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110208_kl4q8jw4.webp)
Qwen Image Text To Image
Qwen-Image is a 20B MMDiT next-gen text-to-image model that generates images from text prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
ตัวอย่าง
ดู Qwen Image ทำงานจริง
ผลลัพธ์จริงที่สร้างโดย Qwen Image API วางเมาส์บนวิดีโอเพื่อดูตัวอย่าง คลิกเพื่อเปิดตัวดูขนาดเต็ม
วิธีใช้
วิธีใช้ Qwen Image API
สี่ขั้นตอนจากการสมัครไปจนถึงผลลัพธ์ที่เสร็จสมบูรณ์ ตัวอย่าง Python, Node.js และ cURL แบบเต็มอยู่ในส่วน API ด้านล่าง
- 01
รับ API key
สมัครบัญชี WaveSpeedAI แล้วคัดลอก API key จากแดชบอร์ด บัญชีใหม่มาพร้อมเครดิตเริ่มต้นฟรี เพียงพอให้ลองใช้ playground ได้หลายสิบครั้งก่อนเริ่มเรียกเก็บเงิน
- 02
ส่ง prediction
POST อินพุตของคุณเป็น JSON ไปที่ https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image endpoint จะส่ง prediction id กลับมาทันที การสร้างทำงานแบบอะซิงโครนัส คุณจึงไม่ต้องเปิดการเชื่อมต่อค้างไว้ระหว่างประมวลผล
- 03
poll เพื่อรอให้เสร็จ
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result เมื่อสถานะเป็น completed ให้นำผลลัพธ์ไปใช้ เมื่อเป็น failed, cancelled, timeout หรือ deleted ให้หยุดพร้อมแจ้งข้อผิดพลาด และ poll ต่อไปสำหรับสถานะอื่นทั้งหมด
- 04
อ่าน URL ของผลลัพธ์
เมื่อสถานะเป็น "completed" ให้อ่าน URL จาก data.outputs[0] URL ชี้ไปยังสื่อที่สร้างขึ้นของคุณบน CDN ของ WaveSpeedAI ซึ่งเป็นภาพ วิดีโอ เสียง หรือไฟล์ 3D ตามแบบของ Qwen Image ที่คุณเรียกใช้
กรณีการใช้งาน
สิ่งที่คุณสร้างได้ด้วย Qwen Image
เวิร์กโฟลว์ทั่วไปที่นักพัฒนาและครีเอเตอร์ใช้ Qwen Image API
ข้อความเป็นภาพ 20B MMDiT
wavespeed-ai/qwen-image/text-to-image เป็นโมเดลข้อความเป็นภาพรุ่นใหม่ 20B MMDiT ที่สร้างภาพจากพรอมต์ข้อความ — endpoint การสร้างพื้นฐานในตระกูล Qwen Image
2512 ที่ปรับปรุงแล้วพร้อมการเรนเดอร์ตัวอักษรที่เหนือกว่า
wavespeed-ai/qwen-image/text-to-image-2512 เป็นโมเดลข้อความเป็นภาพล่าสุดของ Qwen พร้อมความเข้าใจพรอมต์ที่ดีขึ้น การเรนเดอร์ตัวอักษรที่เหนือกว่า และรองรับอัตราส่วนภาพหลากหลายตามแค็ตตาล็อก
แก้ไขหลายภาพด้วย Edit-Plus
wavespeed-ai/qwen-image/edit-plus เป็นตัวแก้ไข 20B MMDiT ที่แก้ไขหลายภาพ รักษาความสม่ำเสมอของภาพเดี่ยว และรองรับ ControlNet ในตัว — มีประโยชน์กับการแก้ไขซับซ้อนที่อ้างอิงภาพต้นฉบับหลายภาพ
ควบคุมมุมกล้อง 96 ท่า
wavespeed-ai/qwen-image/edit-multiple-angles สร้างมุมกล้องเฉพาะจากภาพเดียวด้วยระบบกล้อง 96 ท่า — ควบคุมการหมุนแนวนอน การเอียงแนวตั้ง และการซูม สำหรับมุมหน้า ข้าง หลัง และอื่นๆ
แยกส่วนการจัดองค์ประกอบแบบเลเยอร์
wavespeed-ai/qwen-image/layered เป็นโมเดลแยกเลเยอร์ภาพแบบรวมสำหรับการจัดองค์ประกอบด้วยพรอมต์ — ระบุจุด กล่อง หรือมาสก์คร่าวๆ เพื่อแยกวัตถุและแบ่งภาพเดียวเป็นเลเยอร์
ปรับแต่งด้วย LoRA
ตัวเลือกที่รองรับ LoRA (text-to-image-2512-lora, edit-lora, edit-plus-lora) ช่วยปรับแต่งและสร้างอย่างประณีตได้รวดเร็ว — เทรนหรือใช้ checkpoint LoRA เพื่อความสม่ำเสมอของสไตล์ ตัวละคร หรือแบรนด์
เคล็ดลับ
เคล็ดลับการเขียนพรอมต์สำหรับ Qwen Image
คำแนะนำเชิงปฏิบัติเพื่อให้ได้ผลลัพธ์ที่ดีขึ้นจาก Qwen Image — มาจากรูปแบบที่ได้ผลกับโมเดลภาพในไปป์ไลน์การผลิตจริง
- 01
ใช้ 2512 สำหรับการเรนเดอร์ตัวอักษรล่าสุด
text-to-image-2512 เป็นตัวเลือกที่ปรับปรุงแล้วพร้อมการเรนเดอร์ตัวอักษรที่เหนือกว่าและความเข้าใจพรอมต์ — เลือกแทน text-to-image พื้นฐานเมื่อตัวอักษรสำคัญ
- 02
Edit-Multiple-Angles สำหรับมุมมองสินค้า
edit-multiple-angles สร้างมุมหน้า ข้าง หลัง และมุมกล้องกำหนดเองจากภาพถ่ายสินค้าภาพเดียว — มีประโยชน์กับแค็ตตาล็อกอีคอมเมิร์ซโดยไม่ต้องถ่ายหลายกล้อง
- 03
Edit-Plus สำหรับภาพอ้างอิงหลายภาพ
เมื่อการแก้ไขขึ้นกับภาพต้นฉบับหลายภาพ ให้ใช้ edit-plus พร้อม ControlNet ในตัว แทนการแก้ไขภาพเดี่ยว
- 04
Layered สำหรับเวิร์กโฟลว์จัดองค์ประกอบ
ใช้ layered เพื่อแยกภาพเป็นเลเยอร์ที่กำกับด้วยพรอมต์ — แยกวัตถุด้วยจุด กล่อง หรือมาสก์คร่าวๆ เพื่อใช้จัดองค์ประกอบต่อไป
- 05
ตัวเลือก LoRA เพื่อความสม่ำเสมอของแบรนด์
ใช้ checkpoint LoRA ที่เทรนแล้วผ่าน text-to-image-2512-lora หรือ edit-plus-lora เพื่อสไตล์ ตัวละคร หรืออัตลักษณ์แบรนด์ที่กลับมาซ้ำข้ามการสร้าง
- 06
การแก้ไขสองภาษาจีน/อังกฤษ
Edit และ Edit-LoRA รองรับการแก้ไขภาพเป็นภาพสองภาษาจีน/อังกฤษพร้อมรักษาสไตล์ — มีประโยชน์กับเวิร์กโฟลว์การปรับให้เข้ากับท้องถิ่น
ราคา
ราคา Qwen Image API
คิดราคาตามผลลัพธ์ ค่าใช้จ่ายสุดท้ายขึ้นอยู่กับพารามิเตอร์ที่คุณตั้งใน playground ของแต่ละแบบ (ความละเอียด ความยาว จำนวนผลลัพธ์ ภาพอ้างอิง)
API
เรียกใช้ Qwen Image API
สมัครรับ API key ที่ wavespeed.ai/accesskey แล้วส่ง prediction ผ่าน REST playground สร้างตัวอย่างพร้อมวางได้สำหรับอินพุตทุกแบบ
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"size": "1024*1024",
"output_format": "jpeg"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)เปรียบเทียบ
Qwen Image เทียบกับทางเลือกอื่น
เมื่อไรควรเลือก Qwen Image แทนโมเดลที่คล้ายกันบน WaveSpeedAI
Qwen Image เทียบกับ Seedream 4.5
Seedream 4.5 เน้นตัวอักษรและมีตัวเลือก Sequential สำหรับล็อกตัวตนหลายภาพ ส่วน Qwen Image ครอบคลุมการแก้ไขที่กว้างกว่า — Edit-Plus, หลายมุมกล้อง, การจัดองค์ประกอบแบบเลเยอร์ และการแก้ไขสองภาษาจีน/อังกฤษ
Qwen Image เทียบกับ GPT Image 2
GPT Image 2 มีระดับคุณภาพชัดเจนและเวิร์กโฟลว์แก้ไขด้วยภาพอ้างอิง ส่วน Qwen Image มี ControlNet ในตัว มุมกล้อง 96 ท่า และการแยกเลเยอร์ — องค์ประกอบพื้นฐานการแก้ไขต่างกันที่ต้นทุนต่อการเรียกต่ำกว่า
Qwen Image เทียบกับ Nano Banana 2
Nano Banana 2 มีความสม่ำเสมอหลายตัวละคร (สูงสุด 5) และการอิงการค้นเว็บ ส่วน Qwen Image ชนะด้านความลึกของการแก้ไข — Edit-Plus หลายภาพ การสร้างมุมกล้อง และการแยกเลเยอร์ด้วยพรอมต์
คำถามที่พบบ่อย
Qwen Image API — คำถามที่พบบ่อย
ราคา สัญญาอนุญาต การเชื่อมต่อ — คำถามที่พบบ่อยเกี่ยวกับการรัน Qwen Image บน WaveSpeedAI
Qwen Image API คืออะไร
Qwen Image คือโมเดลการสร้างภาพของ Alibaba ที่เปิดให้ใช้เป็น REST API บน WaveSpeedAI Qwen-Image จาก Alibaba — ชุดเครื่องมือข้อความเป็นภาพและแก้ไขรุ่นใหม่ 20B MMDiT รองรับสองภาษาจีน/อังกฤษ แก้ไขหลายภาพ ปรับแต่งด้วย LoRA การจัดองค์ประกอบแบบเลเยอร์ และระบบมุมกล้อง 96 ท่า คุณเรียกใช้ผ่านโค้ดหรือลองใช้จาก playground ที่ลิงก์ไว้ด้านบนได้
เรียกใช้ Qwen Image API อย่างไร
สมัครบัญชี WaveSpeedAI คัดลอก API key จาก /accesskey แล้ว POST ไปที่ https://api.wavespeed.ai/api/v3/wavespeed-ai/qwen-image/text-to-image พร้อมอินพุตของคุณเป็น JSON endpoint จะส่ง prediction id กลับมา poll endpoint ผลลัพธ์โดยเริ่มประมาณทุก 2 วินาที เพิ่มช่วงเวลาสำหรับงานที่ใช้เวลานาน และหยุดเมื่อได้สถานะสิ้นสุดใดๆ ตัวอย่าง Python / Node.js / cURL ที่เหมาะกับงานจริงอยู่ด้านบน
Qwen Image API มีค่าใช้จ่ายเท่าไร
Qwen Image เริ่มต้นที่ $0.02 ต่อครั้ง ค่าใช้จ่ายจริงขึ้นอยู่กับพารามิเตอร์ที่คุณตั้ง (ความละเอียด ความยาว จำนวนผลลัพธ์ ภาพอ้างอิง) ตัวอย่างค่าใช้จ่ายแบบเรียลไทม์ข้างปุ่ม Generate ใน playground แสดงราคาที่แน่นอนสำหรับอินพุตปัจจุบันของคุณ
Qwen Image มีแบบไหนให้ใช้บ้าง
WaveSpeedAI มี endpoint Qwen Image ที่ใช้งานได้ 21 รายการ: wavespeed-ai/qwen-image-2.0/edit, wavespeed-ai/qwen-image-2.0-pro/edit, wavespeed-ai/qwen-image-2.0/text-to-image, wavespeed-ai/qwen-image-2.0-pro/text-to-image, wavespeed-ai/qwen-image/edit-2509-multiple-angles, wavespeed-ai/qwen-image-max/edit, wavespeed-ai/qwen-image-max/text-to-image, wavespeed-ai/qwen-image/edit-multiple-angles, และอื่นๆ แต่ละแบบมีหน้า playground และราคาของตัวเอง
ใช้ผลลัพธ์ของ Qwen Image เชิงพาณิชย์ได้ไหม
สิทธิ์ในการใช้เชิงพาณิชย์เป็นไปตามสัญญาอนุญาตของโมเดล Alibaba โมเดลของ Alibaba ส่วนใหญ่อนุญาตให้ใช้ผลลัพธ์เชิงพาณิชย์ ดูสรุปสัญญาอนุญาตเฉพาะในหน้า playground ของแต่ละโมเดล และข้อกำหนดการใช้บริการของ WaveSpeedAI สำหรับเงื่อนไขระดับแพลตฟอร์ม
ทำไมต้องใช้ Qwen Image บน WaveSpeedAI แทนการเชื่อมต่อตรง
API key เดียวและบัญชีเรียกเก็บเงินเดียวสำหรับ Qwen Image และโมเดล AI อื่นกว่า 1,000 รายการจากผู้ให้บริการอื่น ไม่ต้องตั้งค่า SDK แยกตามผู้ให้บริการ ไม่ต้องจัดการขีดจำกัดอัตราแยกกัน และไม่ต้องเขียนโค้ดเชื่อมต่อใหม่ทุกครั้งที่เปลี่ยนผู้ให้บริการ โดยทั่วไปราคาเท่ากับหรือต่ำกว่า API ตรงของ Alibaba
ผู้พัฒนา
เกี่ยวกับ Alibaba
ทีมเบื้องหลัง Qwen Image และกลุ่มโมเดลอื่นๆ ของ Alibaba บน WaveSpeedAI
Tongyi Lab ของ Alibaba ผลิตโมเดลวิดีโอตระกูล Wan และ LLM ตระกูล Qwen โดย Wan โดดเด่นที่เปิดตัวพร้อม open weights มีตัวเลือกครอบคลุมกว้าง (ข้อความเป็นวิดีโอ ภาพเป็นวิดีโอ reference-to-video video-edit video-extend image-edit ข้อความเป็นภาพ) และมีความแข็งแกร่งสม่ำเสมอด้านความเสถียรของการเคลื่อนไหวและการทำตามพรอมต์ในพรอมต์หลายภาษา
เริ่มสร้างด้วย Qwen Image บน WaveSpeedAI
รับเครดิตเริ่มต้นฟรีเมื่อสมัคร API key เดียวใช้ได้กับโมเดล AI กว่า 1,000 รายการจาก Alibaba และผู้ให้บริการอื่นทุกราย
/filters:quality(82)/examples/ab6c113bc342972e2bf6fa3a3dd02d44/1783682238198695915_4tkuDMV6.webp)
/filters:quality(82)/examples/ae55efa5dc15feeab655c08c99c0fb67/1783682240218864185_xajsBKir.webp)
/filters:quality(82)/examples/2aae35cf0e4f367122dc3f8306577ba6/1783682242738489413_BobmvEaj.webp)
/filters:quality(82)/examples/fb556f2b9aa99c70a63a0a144d14bfe1/1783682244605044938_9FNX6enx.webp)