Vidu Q4 API
Shengshu Vidu Q4 — image-to-video và reference-to-video với clip dài 3-16 giây, đầu ra từ 540p đến 4K và tùy chọn tạo âm thanh. Reference-to-video nhận tối đa 12 ảnh tham chiếu và tối đa 3 đoạn âm thanh tham chiếu trong một yêu cầu.
Hai endpoint: vidu/q4-preview/image-to-video làm chuyển động một ảnh duy nhất, còn vidu/q4-preview/reference-to-video dựng cảnh từ prompt cùng tối đa 12 ảnh tham chiếu và 3 đoạn âm thanh tham chiếu. Cả hai đều nhận thời lượng là số giây nguyên bất kỳ từ 3 đến 16, năm mức độ phân giải từ 540p đến 4K và một tùy chọn bật/tắt âm thanh.
Tổng quan
Giới thiệu về Vidu Q4 API
Vidu Q4 làm được gì, nằm ở đâu trong dòng mô hình của Shengshu, và vì sao các đội ngũ chọn nó.
Vidu Q4 là mô hình tạo video từ Shengshu, có sẵn qua REST API của WaveSpeedAI. Shengshu Vidu Q4 — image-to-video và reference-to-video với clip dài 3-16 giây, đầu ra từ 540p đến 4K và tùy chọn tạo âm thanh. Reference-to-video nhận tối đa 12 ảnh tham chiếu và tối đa 3 đoạn âm thanh tham chiếu trong một yêu cầu.
Hai endpoint: vidu/q4-preview/image-to-video làm chuyển động một ảnh duy nhất, còn vidu/q4-preview/reference-to-video dựng cảnh từ prompt cùng tối đa 12 ảnh tham chiếu và 3 đoạn âm thanh tham chiếu. Cả hai đều nhận thời lượng là số giây nguyên bất kỳ từ 3 đến 16, năm mức độ phân giải từ 540p đến 4K và một tùy chọn bật/tắt âm thanh.
Họ Vidu Q4 trên WaveSpeedAI cung cấp 2 endpoint REST bao gồm 2 quy trình Reference-To-Video, Image-To-Video. Mỗi biến thể có giá, các tham số điều chỉnh và kết quả mẫu riêng — hãy chọn biến thể phù hợp với dạng đầu vào và ràng buộc sản xuất của bạn, hoặc gọi nhiều biến thể từ cùng một API key để ghép các pipeline nhiều bước.
Chạy Vidu Q4 bằng cùng API key, tài khoản thanh toán và hạn mức tốc độ bạn dùng cho hơn 1.000 mô hình AI khác trên WaveSpeedAI. Không cần thiết lập nhà cung cấp riêng, không cần SDK cho từng nhà cung cấp, không có hạn mức tốc độ riêng của từng hãng — một lần tích hợp bao quát mọi thứ, từ text-to-image và text-to-video đến tổng hợp âm thanh, tạo 3D, nâng cấp và chỉnh sửa.
Thông số
Khả năng và trạng thái phát hành của Vidu Q4 API
Các chi tiết riêng của mô hình mà nhà phát triển tìm kiếm trước khi chọn API: tình trạng khả dụng, độ dài đầu ra dự kiến, hỗ trợ tham chiếu và phương án thay thế đang hoạt động.
Endpoint
2 biến thể
Image-to-video và reference-to-video.
Thời lượng
3-16 giây
Số giây nguyên bất kỳ; mặc định là 5 giây.
Độ phân giải
540p đến 4K
540p, 720p, 1080p, 2K, 4K; mặc định là 720p.
Tham chiếu
12 ảnh + 3 âm thanh
Trên reference-to-video, đi kèm prompt văn bản.
Endpoint
Tất cả endpoint API Vidu Q4
2 endpoint Vidu Q4 hiện có sẵn trên WaveSpeedAI — hãy chọn biến thể phù hợp với quy trình của bạn.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ví dụ
Xem Vidu Q4 hoạt động
Kết quả thật do API Vidu Q4 tạo ra. Rê chuột lên video để xem trước, nhấp để mở trình xem kích thước đầy đủ.
Hướng dẫn
Cách dùng API Vidu Q4
Bốn bước từ đăng ký đến khi có kết quả. Ví dụ đầy đủ bằng Python, Node.js và cURL nằm ở phần API bên dưới.
- 01
Lấy API key
Đăng ký tài khoản WaveSpeedAI và sao chép API key từ bảng điều khiển. Tài khoản mới được tặng credit dùng thử miễn phí — đủ để chạy playground vài chục lần trước khi bắt đầu tính phí.
- 02
Gửi một prediction
POST đầu vào của bạn dưới dạng JSON tới https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Endpoint trả về prediction id ngay lập tức — việc tạo là bất đồng bộ nên bạn không phải giữ kết nối mở trong lúc suy luận.
- 03
Poll để chờ hoàn tất
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Trả về kết quả khi completed; dừng và báo lỗi khi failed, cancelled, timeout hoặc deleted; tiếp tục poll với mọi trạng thái khác.
- 04
Đọc URL kết quả
Khi status là "completed", đọc URL từ data.outputs[0]. URL trỏ tới media bạn đã tạo trên CDN của WaveSpeedAI — ảnh, video, âm thanh hoặc tệp 3D tùy biến thể Vidu Q4 bạn đã gọi.
Trường hợp sử dụng
Bạn có thể xây dựng gì với Vidu Q4
Các quy trình phổ biến mà nhà phát triển và người sáng tạo dùng API Vidu Q4 cho.
Hoạt ảnh sản phẩm từ một bức ảnh
vidu/q4-preview/image-to-video biến một ảnh sản phẩm thành clip quảng bá. Hãy mô tả chuyển động máy quay và chuyển động bạn muốn; bức ảnh luôn là điểm neo hình ảnh.
Nhân vật luôn đúng hình mẫu
vidu/q4-preview/reference-to-video nhận tối đa 12 ảnh tham chiếu, nhờ đó nhân vật định kỳ, linh vật hay người đại diện có thể xuất hiện từ nhiều góc độ mà vẫn dễ nhận ra qua các clip.
Cảnh được dẫn dắt bằng âm thanh
Thêm tối đa 3 đoạn âm thanh tham chiếu qua trường audios cùng với ảnh, và giữ generate_audio bật để nhận clip có âm thanh chỉ trong một lần gọi.
4K sẵn sàng bàn giao
Cả hai endpoint đều xuất 540p, 720p, 1080p, 2K hoặc 4K. Làm bản nháp ở 540p hoặc 720p, sau đó chạy lại prompt đã duyệt ở độ phân giải bàn giao mà không cần bước nâng cấp riêng.
Mọi định dạng mạng xã hội
Reference-to-video kết xuất 16:9, 9:16, 1:1, 3:4 hoặc 4:3, đáp ứng YouTube, Reels, Shorts, bài đăng bảng tin và trang sản phẩm từ cùng một bộ tham chiếu.
Clip vừa khít nhịp
Thời lượng là số giây nguyên bất kỳ từ 3 đến 16, nên vòng lặp 3 giây, đoạn bumper 6 giây và spot 15 giây đều đến từ cùng một endpoint.
Mẹo
Mẹo viết prompt cho Vidu Q4
Lời khuyên thực tế để có kết quả tốt hơn từ Vidu Q4 — rút ra từ các mẫu hiệu quả trên các mô hình video trong các pipeline sản xuất.
- 01
Dùng ảnh nguồn rõ nét, đủ sáng
Với vidu/q4-preview/image-to-video, ảnh quyết định chủ thể, bố cục khung hình và phong cách. Hãy chọn ảnh sắc nét với một chủ thể rõ ràng, rồi dùng prompt cho chuyển động và hướng máy quay thay vì mô tả lại những gì đã thấy trong ảnh.
- 02
Giao cho mỗi tham chiếu một vai trò
Với vidu/q4-preview/reference-to-video, hãy dùng các tham chiếu thực sự thuộc về cảnh — nhân vật, sản phẩm, bối cảnh — và nêu rõ trong prompt mỗi tham chiếu sẽ xuất hiện thế nào, thay vì gửi những ảnh ít liên quan.
- 03
Khớp lượng hành động với thời lượng
Yêu cầu lượng hành động phù hợp với độ dài clip. Clip 3-5 giây hợp với một chuyển động hoặc cử chỉ; hãy để hành động nhiều bước cho 10-16 giây.
- 04
Nháp ở mức thấp, bàn giao ở mức cao
Khám phá ý tưởng ở 540p hoặc 720p với thời lượng ngắn, sau đó chạy lại prompt đã chọn ở 1080p, 2K hoặc 4K để bàn giao.
- 05
Quyết định trước về âm thanh và viết lại prompt
generate_audio được bật mặc định; hãy tắt khi bạn sẽ tự thêm nhạc nền. Trên image-to-video, đặt enable_prompt_expansion thành false khi bạn muốn prompt được dùng đúng như đã viết.
Giá
Giá API Vidu Q4
Giá tính theo từng kết quả đầu ra. Khoản phí cuối cùng thay đổi theo các tham số bạn đặt trong playground của từng biến thể (độ phân giải, thời lượng, số kết quả, tham chiếu).
| Endpoint | Loại | Giá khởi điểm |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Gọi API Vidu Q4
Đăng ký API key tại wavespeed.ai/accesskey, rồi gửi prediction qua REST. Playground tạo sẵn mã mẫu có thể dán ngay cho mọi tổ hợp đầu vào.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)So sánh
Vidu Q4 so với các lựa chọn khác
Khi nào nên chọn Vidu Q4 thay vì các mô hình tương tự trên WaveSpeedAI.
Vidu Q4 so với Vidu Q3
Reference-to-video của Vidu Q3 nhận 1-4 ảnh tham chiếu; Q4 nhận tối đa 12 ảnh cùng tối đa 3 tham chiếu âm thanh, và cả hai endpoint Q4 đều đạt 4K. Q3 vẫn là lựa chọn cho text-to-video, nội suy keyframe đầu-cuối và các bậc Pro, Turbo.
Vidu Q4 so với Seedance 2.5
Seedance 2.5 tạo cảnh quay đơn dài tới 30 giây và có thêm các endpoint chỉnh sửa và kéo dài video. Vidu Q4 tập trung vào tạo video dựa trên ảnh và tham chiếu với đầu ra tới 4K.
Vidu Q4 so với Wan 3.0
Wan 3.0 có text-to-video, image-to-video và reference-to-video dài tới 30 giây, độ phân giải tới 1080p. Vidu Q4 tối đa 16 giây nhưng bổ sung đầu ra 2K, 4K và tối đa 12 ảnh tham chiếu.
Câu hỏi thường gặp
Vidu Q4 API — Câu hỏi thường gặp
Giá, giấy phép, tích hợp — những câu hỏi phổ biến về việc chạy Vidu Q4 trên WaveSpeedAI.
API Vidu Q4 là gì?
Vidu Q4 là mô hình tạo video của Shengshu, được cung cấp dưới dạng REST API trên WaveSpeedAI. Shengshu Vidu Q4 — image-to-video và reference-to-video với clip dài 3-16 giây, đầu ra từ 540p đến 4K và tùy chọn tạo âm thanh. Reference-to-video nhận tối đa 12 ảnh tham chiếu và tối đa 3 đoạn âm thanh tham chiếu trong một yêu cầu. Bạn có thể gọi bằng lập trình hoặc thử từ playground ở liên kết phía trên.
Làm sao để gọi API Vidu Q4?
Đăng ký tài khoản WaveSpeedAI, sao chép API key từ /accesskey, rồi POST tới https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video với đầu vào dưới dạng JSON. Endpoint trả về prediction id. Hãy poll endpoint kết quả khoảng mỗi 2 giây, tăng khoảng cách với các tác vụ chạy lâu, và dừng ở bất kỳ trạng thái kết thúc nào. Ví dụ Python / Node.js / cURL hướng tới môi trường production ở phía trên.
API Vidu Q4 có giá bao nhiêu?
Vidu Q4 bắt đầu từ $0.25 mỗi lượt chạy. Chi phí chính xác thay đổi theo các tham số bạn đặt (độ phân giải, thời lượng, số kết quả, tham chiếu). Phần xem trước chi phí trực tiếp cạnh nút Tạo trong playground hiển thị giá chính xác cho đầu vào hiện tại của bạn.
Có những biến thể Vidu Q4 nào?
WaveSpeedAI cung cấp 2 endpoint Vidu Q4 đang hoạt động: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Mỗi biến thể có trang playground và giá riêng.
Tôi có thể dùng kết quả của Vidu Q4 cho mục đích thương mại không?
Quyền sử dụng thương mại tuân theo giấy phép mô hình của Shengshu. Hầu hết mô hình của Shengshu cho phép dùng kết quả đầu ra cho mục đích thương mại; hãy xem trang playground của từng mô hình để biết tóm tắt giấy phép cụ thể, và Điều khoản dịch vụ của WaveSpeedAI cho các điều kiện cấp nền tảng.
Tại sao dùng Vidu Q4 trên WaveSpeedAI thay vì gọi trực tiếp?
Một API key + một tài khoản thanh toán cho Vidu Q4 VÀ hơn 1.000 mô hình AI khác từ các nhà cung cấp khác. Không cần thiết lập SDK cho từng hãng, không có hạn mức tốc độ riêng, không phải viết lại mã tích hợp cho từng hãng. Giá thường ngang bằng hoặc thấp hơn API trực tiếp của Shengshu.
Nhà cung cấp
Giới thiệu về Shengshu
Đội ngũ đứng sau Vidu Q4 và dòng mô hình Shengshu rộng hơn trên WaveSpeedAI.
Shengshu Technology là phòng thí nghiệm AI của Trung Quốc tách ra từ Đại học Thanh Hoa, đứng sau dòng mô hình tạo video Vidu. Vidu Q4, thế hệ mới nhất, bổ sung image-to-video và reference-to-video với tối đa 12 ảnh tham chiếu, tối đa 3 đoạn âm thanh tham chiếu và đầu ra tới 4K. Vidu Q3 có text-to-video, image-to-video, reference-to-video (1-4 ảnh tham chiếu để nhất quán nhiều thực thể) và start-end-to-video (nội suy keyframe giữa hai ảnh tĩnh) ở các bậc Standard, Pro và Turbo. Một số biến thể hỗ trợ đầu ra tới 16 giây.
Bắt đầu xây dựng với Vidu Q4 trên WaveSpeedAI
Tặng credit dùng thử miễn phí khi đăng ký. Một API key cho hơn 1.000 mô hình AI từ Shengshu và mọi nhà cung cấp khác.