Vidu Q4 API
Vidu Q4 จาก Shengshu — ภาพเป็นวิดีโอและ reference-to-video คลิปยาว 3-16 วินาที เอาต์พุต 540p ถึง 4K และสร้างเสียงได้ตามต้องการ Reference-to-video รับภาพอ้างอิงได้สูงสุด 12 ภาพและคลิปเสียงอ้างอิงสูงสุด 3 คลิปในคำขอเดียว
สอง endpoint: vidu/q4-preview/image-to-video ทำให้ภาพเดียวเคลื่อนไหว ส่วน vidu/q4-preview/reference-to-video สร้างฉากจากพรอมต์พร้อมภาพอ้างอิงสูงสุด 12 ภาพและคลิปเสียงอ้างอิง 3 คลิป ทั้งสองรองรับความยาวเป็นวินาทีเต็มตั้งแต่ 3 ถึง 16 วินาที ห้าความละเอียดตั้งแต่ 540p ถึง 4K และสวิตช์เปิด-ปิดเสียง
ภาพรวม
เกี่ยวกับ Vidu Q4 API
Vidu Q4 ทำอะไรได้ อยู่ตรงไหนในกลุ่มโมเดลของ Shengshu และทำไมทีมต่างๆ จึงเลือกใช้
Vidu Q4 คือโมเดลการสร้างวิดีโอจาก Shengshu ใช้งานได้ผ่าน REST API ของ WaveSpeedAI Vidu Q4 จาก Shengshu — ภาพเป็นวิดีโอและ reference-to-video คลิปยาว 3-16 วินาที เอาต์พุต 540p ถึง 4K และสร้างเสียงได้ตามต้องการ Reference-to-video รับภาพอ้างอิงได้สูงสุด 12 ภาพและคลิปเสียงอ้างอิงสูงสุด 3 คลิปในคำขอเดียว
สอง endpoint: vidu/q4-preview/image-to-video ทำให้ภาพเดียวเคลื่อนไหว ส่วน vidu/q4-preview/reference-to-video สร้างฉากจากพรอมต์พร้อมภาพอ้างอิงสูงสุด 12 ภาพและคลิปเสียงอ้างอิง 3 คลิป ทั้งสองรองรับความยาวเป็นวินาทีเต็มตั้งแต่ 3 ถึง 16 วินาที ห้าความละเอียดตั้งแต่ 540p ถึง 4K และสวิตช์เปิด-ปิดเสียง
กลุ่ม Vidu Q4 บน WaveSpeedAI มี 2 REST endpoint ครอบคลุมเวิร์กโฟลว์ Reference-To-Video, Image-To-Video แต่ละแบบมีราคา พารามิเตอร์ที่ปรับได้ และตัวอย่างผลลัพธ์ของตัวเอง เลือกแบบที่ตรงกับประเภทอินพุตและข้อจำกัดของงานจริง หรือเรียกหลายแบบด้วย API key เดียวเพื่อประกอบเป็นไปป์ไลน์หลายขั้นตอน
รัน Vidu Q4 ผ่าน API key บัญชีเรียกเก็บเงิน และขีดจำกัดอัตราเดียวกับที่คุณใช้กับโมเดล AI กว่า 1,000 รายการอื่นบน WaveSpeedAI ไม่ต้องตั้งค่ากับผู้ให้บริการแยก ไม่ต้องใช้ SDK แยกตามผู้ให้บริการ และไม่ต้องจัดการขีดจำกัดอัตราแยกตามผู้ให้บริการ การเชื่อมต่อเดียวครอบคลุมทุกอย่างตั้งแต่ข้อความเป็นภาพและข้อความเป็นวิดีโอ ไปจนถึงการสังเคราะห์เสียง การสร้าง 3D การอัปสเกล และการแก้ไข
สเปก
ความสามารถและสถานะการเปิดตัวของ Vidu Q4 API
รายละเอียดเฉพาะของโมเดลที่นักพัฒนาค้นหาก่อนเลือก API: ความพร้อมใช้งาน ความยาวผลลัพธ์ที่คาดหวัง การรองรับภาพอ้างอิง และทางเลือกสำรองที่ใช้งานได้ในปัจจุบัน
Endpoint
2 ตัวเลือก
ภาพเป็นวิดีโอและ reference-to-video
ความยาว
3-16 วินาที
วินาทีเต็มใดก็ได้ ค่าเริ่มต้นคือ 5 วินาที
ความละเอียด
540p ถึง 4K
540p, 720p, 1080p, 2K, 4K ค่าเริ่มต้นคือ 720p
อ้างอิง
ภาพ 12 + เสียง 3
บน reference-to-video ควบคู่กับพรอมต์ข้อความ
Endpoint
API endpoint ของ Vidu Q4 ทั้งหมด
2 endpoint ของ Vidu Q4 พร้อมใช้งานบน WaveSpeedAI แล้ว — เลือกแบบที่ตรงกับเวิร์กโฟลว์ของคุณ
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
ตัวอย่าง
ดู Vidu Q4 ทำงานจริง
ผลลัพธ์จริงที่สร้างโดย Vidu Q4 API วางเมาส์บนวิดีโอเพื่อดูตัวอย่าง คลิกเพื่อเปิดตัวดูขนาดเต็ม
วิธีใช้
วิธีใช้ Vidu Q4 API
สี่ขั้นตอนจากการสมัครไปจนถึงผลลัพธ์ที่เสร็จสมบูรณ์ ตัวอย่าง Python, Node.js และ cURL แบบเต็มอยู่ในส่วน API ด้านล่าง
- 01
รับ API key
สมัครบัญชี WaveSpeedAI แล้วคัดลอก API key จากแดชบอร์ด บัญชีใหม่มาพร้อมเครดิตเริ่มต้นฟรี เพียงพอให้ลองใช้ playground ได้หลายสิบครั้งก่อนเริ่มเรียกเก็บเงิน
- 02
ส่ง prediction
POST อินพุตของคุณเป็น JSON ไปที่ https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video endpoint จะส่ง prediction id กลับมาทันที การสร้างทำงานแบบอะซิงโครนัส คุณจึงไม่ต้องเปิดการเชื่อมต่อค้างไว้ระหว่างประมวลผล
- 03
poll เพื่อรอให้เสร็จ
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result เมื่อสถานะเป็น completed ให้นำผลลัพธ์ไปใช้ เมื่อเป็น failed, cancelled, timeout หรือ deleted ให้หยุดพร้อมแจ้งข้อผิดพลาด และ poll ต่อไปสำหรับสถานะอื่นทั้งหมด
- 04
อ่าน URL ของผลลัพธ์
เมื่อสถานะเป็น "completed" ให้อ่าน URL จาก data.outputs[0] URL ชี้ไปยังสื่อที่สร้างขึ้นของคุณบน CDN ของ WaveSpeedAI ซึ่งเป็นภาพ วิดีโอ เสียง หรือไฟล์ 3D ตามแบบของ Vidu Q4 ที่คุณเรียกใช้
กรณีการใช้งาน
สิ่งที่คุณสร้างได้ด้วย Vidu Q4
เวิร์กโฟลว์ทั่วไปที่นักพัฒนาและครีเอเตอร์ใช้ Vidu Q4 API
แอนิเมชันสินค้าจากภาพเดียว
vidu/q4-preview/image-to-video เปลี่ยนภาพสินค้าภาพเดียวให้เป็นคลิปโปรโมต อธิบายการเคลื่อนกล้องและการเคลื่อนไหวที่ต้องการ โดยภาพยังคงเป็นหลักยึดทางภาพ
ตัวละครที่หน้าตาคงเดิม
vidu/q4-preview/reference-to-video รับภาพอ้างอิงได้สูงสุด 12 ภาพ ตัวละครประจำ มาสคอต หรือพรีเซนเตอร์จึงแสดงได้จากหลายมุมและยังจดจำได้ในทุกคลิป
ฉากที่นำทางด้วยเสียง
เพิ่มคลิปเสียงอ้างอิงได้สูงสุด 3 คลิปผ่านฟิลด์ audios ควบคู่กับภาพของคุณ และเปิด generate_audio ไว้เพื่อรับคลิปพร้อมเสียงในการเรียกครั้งเดียว
4K พร้อมส่งมอบ
ทั้งสอง endpoint ให้เอาต์พุต 540p, 720p, 1080p, 2K หรือ 4K ทำดราฟต์ที่ 540p หรือ 720p แล้วรันพรอมต์ที่อนุมัติแล้วอีกครั้งที่ความละเอียดสำหรับส่งมอบ โดยไม่ต้องอัปสเกลแยก
ครบทุกฟอร์แมตโซเชียล
Reference-to-video เรนเดอร์ได้ทั้ง 16:9, 9:16, 1:1, 3:4 หรือ 4:3 ครอบคลุม YouTube, Reels, Shorts, โพสต์ฟีด และหน้าสินค้าจากชุดอ้างอิงเดียวกัน
คลิปยาวพอดีจังหวะ
ความยาวเป็นวินาทีเต็มใดก็ได้ตั้งแต่ 3 ถึง 16 วินาที ลูป 3 วินาที บัมเปอร์ 6 วินาที และสปอต 15 วินาทีจึงมาจาก endpoint เดียวกันทั้งหมด
เคล็ดลับ
เคล็ดลับการเขียนพรอมต์สำหรับ Vidu Q4
คำแนะนำเชิงปฏิบัติเพื่อให้ได้ผลลัพธ์ที่ดีขึ้นจาก Vidu Q4 — มาจากรูปแบบที่ได้ผลกับโมเดลวิดีโอในไปป์ไลน์การผลิตจริง
- 01
ใช้ภาพต้นฉบับที่สะอาดและแสงดี
สำหรับ vidu/q4-preview/image-to-video ภาพจะกำหนดตัวแบบ การจัดเฟรม และสไตล์ เลือกภาพคมชัดที่มีตัวแบบชัดเจนเพียงหนึ่งเดียว แล้วใช้พรอมต์บอกการเคลื่อนไหวและทิศทางกล้อง แทนการอธิบายซ้ำสิ่งที่เห็นอยู่แล้ว
- 02
ให้ภาพอ้างอิงแต่ละภาพมีหน้าที่
กับ vidu/q4-preview/reference-to-video ให้ใช้ภาพอ้างอิงที่อยู่ในฉากจริง — ตัวละคร สินค้า สถานที่ — และระบุในพรอมต์ว่าแต่ละภาพควรปรากฏอย่างไร แทนการส่งภาพที่เกี่ยวข้องกันแบบหลวมๆ
- 03
ให้แอ็กชันพอดีกับความยาว
ขอปริมาณแอ็กชันที่เหมาะกับความยาวคลิป คลิป 3-5 วินาทีเหมาะกับการเคลื่อนไหวหรือท่าทางเดียว เก็บแอ็กชันหลายขั้นตอนไว้สำหรับ 10-16 วินาที
- 04
ดราฟต์ต่ำ ส่งมอบสูง
ลองไอเดียที่ 540p หรือ 720p ด้วยความยาวสั้นๆ แล้วรันพรอมต์ที่เลือกอีกครั้งที่ 1080p, 2K หรือ 4K สำหรับส่งมอบ
- 05
ตัดสินใจเรื่องเสียงและการเขียนพรอมต์ใหม่ตั้งแต่แรก
generate_audio เปิดอยู่โดยค่าเริ่มต้น ปิดไว้เมื่อคุณจะใส่ซาวด์แทร็กเอง บนภาพเป็นวิดีโอ ให้ตั้ง enable_prompt_expansion เป็น false เมื่อต้องการให้ใช้พรอมต์ตามที่เขียนไว้ทุกคำ
ราคา
ราคา Vidu Q4 API
คิดราคาตามผลลัพธ์ ค่าใช้จ่ายสุดท้ายขึ้นอยู่กับพารามิเตอร์ที่คุณตั้งใน playground ของแต่ละแบบ (ความละเอียด ความยาว จำนวนผลลัพธ์ ภาพอ้างอิง)
| Endpoint | ประเภท | ราคาเริ่มต้น |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
เรียกใช้ Vidu Q4 API
สมัครรับ API key ที่ wavespeed.ai/accesskey แล้วส่ง prediction ผ่าน REST playground สร้างตัวอย่างพร้อมวางได้สำหรับอินพุตทุกแบบ
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)เปรียบเทียบ
Vidu Q4 เทียบกับทางเลือกอื่น
เมื่อไรควรเลือก Vidu Q4 แทนโมเดลที่คล้ายกันบน WaveSpeedAI
Vidu Q4 เทียบกับ Vidu Q3
Reference-to-video ของ Vidu Q3 รับภาพอ้างอิง 1-4 ภาพ ส่วน Q4 รับได้สูงสุด 12 ภาพพร้อมเสียงอ้างอิงสูงสุด 3 คลิป และทั้งสอง endpoint ของ Q4 ไปถึง 4K Q3 ยังเป็นตัวเลือกสำหรับข้อความเป็นวิดีโอ การเติมเฟรมระหว่างคีย์เฟรมเริ่มต้นกับสิ้นสุด และระดับ Pro กับ Turbo
Vidu Q4 เทียบกับ Seedance 2.5
Seedance 2.5 สร้างช็อตเดียวยาวได้สูงสุด 30 วินาที และเพิ่ม endpoint สำหรับแก้ไขและต่อความยาววิดีโอ ส่วน Vidu Q4 โฟกัสที่การสร้างจากภาพและจากอ้างอิง ด้วยเอาต์พุตสูงสุด 4K
Vidu Q4 เทียบกับ Wan 3.0
Wan 3.0 มีข้อความ ภาพ และ reference-to-video ยาวสูงสุด 30 วินาทีที่ความละเอียดสูงสุด 1080p ส่วน Vidu Q4 ยาวสูงสุด 16 วินาที แต่เพิ่มเอาต์พุต 2K และ 4K และภาพอ้างอิงสูงสุด 12 ภาพ
คำถามที่พบบ่อย
Vidu Q4 API — คำถามที่พบบ่อย
ราคา สัญญาอนุญาต การเชื่อมต่อ — คำถามที่พบบ่อยเกี่ยวกับการรัน Vidu Q4 บน WaveSpeedAI
Vidu Q4 API คืออะไร
Vidu Q4 คือโมเดลการสร้างวิดีโอของ Shengshu ที่เปิดให้ใช้เป็น REST API บน WaveSpeedAI Vidu Q4 จาก Shengshu — ภาพเป็นวิดีโอและ reference-to-video คลิปยาว 3-16 วินาที เอาต์พุต 540p ถึง 4K และสร้างเสียงได้ตามต้องการ Reference-to-video รับภาพอ้างอิงได้สูงสุด 12 ภาพและคลิปเสียงอ้างอิงสูงสุด 3 คลิปในคำขอเดียว คุณเรียกใช้ผ่านโค้ดหรือลองใช้จาก playground ที่ลิงก์ไว้ด้านบนได้
เรียกใช้ Vidu Q4 API อย่างไร
สมัครบัญชี WaveSpeedAI คัดลอก API key จาก /accesskey แล้ว POST ไปที่ https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video พร้อมอินพุตของคุณเป็น JSON endpoint จะส่ง prediction id กลับมา poll endpoint ผลลัพธ์โดยเริ่มประมาณทุก 2 วินาที เพิ่มช่วงเวลาสำหรับงานที่ใช้เวลานาน และหยุดเมื่อได้สถานะสิ้นสุดใดๆ ตัวอย่าง Python / Node.js / cURL ที่เหมาะกับงานจริงอยู่ด้านบน
Vidu Q4 API มีค่าใช้จ่ายเท่าไร
Vidu Q4 เริ่มต้นที่ $0.25 ต่อครั้ง ค่าใช้จ่ายจริงขึ้นอยู่กับพารามิเตอร์ที่คุณตั้ง (ความละเอียด ความยาว จำนวนผลลัพธ์ ภาพอ้างอิง) ตัวอย่างค่าใช้จ่ายแบบเรียลไทม์ข้างปุ่ม Generate ใน playground แสดงราคาที่แน่นอนสำหรับอินพุตปัจจุบันของคุณ
Vidu Q4 มีแบบไหนให้ใช้บ้าง
WaveSpeedAI มี endpoint Vidu Q4 ที่ใช้งานได้ 2 รายการ: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video แต่ละแบบมีหน้า playground และราคาของตัวเอง
ใช้ผลลัพธ์ของ Vidu Q4 เชิงพาณิชย์ได้ไหม
สิทธิ์ในการใช้เชิงพาณิชย์เป็นไปตามสัญญาอนุญาตของโมเดล Shengshu โมเดลของ Shengshu ส่วนใหญ่อนุญาตให้ใช้ผลลัพธ์เชิงพาณิชย์ ดูสรุปสัญญาอนุญาตเฉพาะในหน้า playground ของแต่ละโมเดล และข้อกำหนดการใช้บริการของ WaveSpeedAI สำหรับเงื่อนไขระดับแพลตฟอร์ม
ทำไมต้องใช้ Vidu Q4 บน WaveSpeedAI แทนการเชื่อมต่อตรง
API key เดียวและบัญชีเรียกเก็บเงินเดียวสำหรับ Vidu Q4 และโมเดล AI อื่นกว่า 1,000 รายการจากผู้ให้บริการอื่น ไม่ต้องตั้งค่า SDK แยกตามผู้ให้บริการ ไม่ต้องจัดการขีดจำกัดอัตราแยกกัน และไม่ต้องเขียนโค้ดเชื่อมต่อใหม่ทุกครั้งที่เปลี่ยนผู้ให้บริการ โดยทั่วไปราคาเท่ากับหรือต่ำกว่า API ตรงของ Shengshu
ผู้พัฒนา
เกี่ยวกับ Shengshu
ทีมเบื้องหลัง Vidu Q4 และกลุ่มโมเดลอื่นๆ ของ Shengshu บน WaveSpeedAI
Shengshu Technology เป็นห้องปฏิบัติการ AI ของจีนที่แยกตัวออกมาจากมหาวิทยาลัยชิงหวา เบื้องหลังโมเดลสร้างวิดีโอตระกูล Vidu โดย Vidu Q4 รุ่นใหม่ล่าสุดเพิ่มภาพเป็นวิดีโอและ reference-to-video ที่รองรับภาพอ้างอิงสูงสุด 12 ภาพ คลิปเสียงอ้างอิงสูงสุด 3 คลิป และเอาต์พุตสูงสุด 4K ส่วน Vidu Q3 มีข้อความเป็นวิดีโอ ภาพเป็นวิดีโอ reference-to-video (ภาพอ้างอิง 1-4 ภาพเพื่อความสม่ำเสมอหลายวัตถุ) และ start-end-to-video (เติมเฟรมระหว่างคีย์เฟรมสองภาพ) ในระดับ Standard, Pro และ Turbo บางตัวเลือกรองรับเอาต์พุตยาวสูงสุด 16 วินาที
เริ่มสร้างด้วย Vidu Q4 บน WaveSpeedAI
รับเครดิตเริ่มต้นฟรีเมื่อสมัคร API key เดียวใช้ได้กับโมเดล AI กว่า 1,000 รายการจาก Shengshu และผู้ให้บริการอื่นทุกราย