Vidu Q3 API
Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 ảnh tham chiếu để nhất quán nhiều thực thể) và start-end-to-video. Ba phân khúc: Standard, Pro, Turbo. Đầu ra dài tới 16 giây ở một số biến thể.
Các phân khúc Standard, Pro (đầu ra 1-16 giây) và Turbo (nhanh hơn). Reference-to-video nhận 1-4 ảnh tham chiếu để tạo video nhất quán nhiều thực thể ở 360p-1080p, dài tới 16 giây. Start-end-to-video nối hai khung hình chính (1-16 giây ở Pro). Biến thể image-to-video-pro hỗ trợ 720p/1080p/2K/4K.
Tổng quan
Giới thiệu về Vidu Q3 API
Vidu Q3 làm được gì, nằm ở đâu trong dòng mô hình của Shengshu, và vì sao các đội ngũ chọn nó.
Vidu Q3 là mô hình tạo video từ Shengshu, có sẵn qua REST API của WaveSpeedAI. Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 ảnh tham chiếu để nhất quán nhiều thực thể) và start-end-to-video. Ba phân khúc: Standard, Pro, Turbo. Đầu ra dài tới 16 giây ở một số biến thể.
Các phân khúc Standard, Pro (đầu ra 1-16 giây) và Turbo (nhanh hơn). Reference-to-video nhận 1-4 ảnh tham chiếu để tạo video nhất quán nhiều thực thể ở 360p-1080p, dài tới 16 giây. Start-end-to-video nối hai khung hình chính (1-16 giây ở Pro). Biến thể image-to-video-pro hỗ trợ 720p/1080p/2K/4K.
Họ Vidu Q3 trên WaveSpeedAI cung cấp 13 endpoint REST bao gồm 3 quy trình Text-To-Video, Image-To-Video, Reference-To-Video. Mỗi biến thể có giá, các tham số điều chỉnh và kết quả mẫu riêng — hãy chọn biến thể phù hợp với dạng đầu vào và ràng buộc sản xuất của bạn, hoặc gọi nhiều biến thể từ cùng một API key để ghép các pipeline nhiều bước.
Chạy Vidu Q3 bằng cùng API key, tài khoản thanh toán và hạn mức tốc độ bạn dùng cho hơn 1.000 mô hình AI khác trên WaveSpeedAI. Không cần thiết lập nhà cung cấp riêng, không cần SDK cho từng nhà cung cấp, không có hạn mức tốc độ riêng của từng hãng — một lần tích hợp bao quát mọi thứ, từ text-to-image và text-to-video đến tổng hợp âm thanh, tạo 3D, nâng cấp và chỉnh sửa.
Endpoint
Tất cả endpoint API Vidu Q3
13 endpoint Vidu Q3 hiện có sẵn trên WaveSpeedAI — hãy chọn biến thể phù hợp với quy trình của bạn.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Ví dụ
Xem Vidu Q3 hoạt động
Kết quả thật do API Vidu Q3 tạo ra. Rê chuột lên video để xem trước, nhấp để mở trình xem kích thước đầy đủ.
Hướng dẫn
Cách dùng API Vidu Q3
Bốn bước từ đăng ký đến khi có kết quả. Ví dụ đầy đủ bằng Python, Node.js và cURL nằm ở phần API bên dưới.
- 01
Lấy API key
Đăng ký tài khoản WaveSpeedAI và sao chép API key từ bảng điều khiển. Tài khoản mới được tặng credit dùng thử miễn phí — đủ để chạy playground vài chục lần trước khi bắt đầu tính phí.
- 02
Gửi một prediction
POST đầu vào của bạn dưới dạng JSON tới https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Endpoint trả về prediction id ngay lập tức — việc tạo là bất đồng bộ nên bạn không phải giữ kết nối mở trong lúc suy luận.
- 03
Poll để chờ hoàn tất
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Trả về kết quả khi completed; dừng và báo lỗi khi failed, cancelled, timeout hoặc deleted; tiếp tục poll với mọi trạng thái khác.
- 04
Đọc URL kết quả
Khi status là "completed", đọc URL từ data.outputs[0]. URL trỏ tới media bạn đã tạo trên CDN của WaveSpeedAI — ảnh, video, âm thanh hoặc tệp 3D tùy biến thể Vidu Q3 bạn đã gọi.
Trường hợp sử dụng
Bạn có thể xây dựng gì với Vidu Q3
Các quy trình phổ biến mà nhà phát triển và người sáng tạo dùng API Vidu Q3 cho.
Reference-to-video với 1-4 tham chiếu
vidu/q3/reference-to-video tạo video nhất quán nhiều thực thể từ 1-4 ảnh tham chiếu với hướng dẫn bằng prompt văn bản. Hỗ trợ 360p-1080p, dài tới 16 giây, nhiều tỷ lệ khung hình. Hữu ích cho các cảnh đông người, nơi nhiều chủ thể được tham chiếu phải giữ sự mạch lạc.
Nội suy khung hình chính đầu-cuối
vidu/q3/start-end-to-video tạo video bằng cách nội suy giữa hai khung hình chính. Các phân khúc Pro và Turbo cũng hỗ trợ start-end với thời lượng 1-16 giây. Hữu ích cho storyboard kiểu animatic khi bạn đã có ảnh tĩnh đầu và cuối.
Đầu ra dài tới 16 giây
Theo danh mục, ở các biến thể Pro và reference-to-video: thời lượng 1-16 giây. Dài hơn khoảng 5-8 giây của nhiều mô hình video cạnh tranh — hữu ích cho các nhịp kể chuyện trọn vẹn trong một lần tạo.
Image-to-video độ phân giải cao
vidu/q3/image-to-video-pro hỗ trợ 720p / 1080p / 2K / 4K từ ảnh. Hữu ích để có đầu ra chuẩn bàn giao mà không cần bước nâng cấp độ phân giải khi bắt đầu từ ảnh tĩnh.
Phân khúc Pro (rẻ nhất)
vidu/q3-pro/* là phân khúc Vidu Q3 rẻ nhất — hữu ích cho công việc khối lượng lớn. Bao gồm image-to-video, text-to-video và start-end-to-video với đầu ra 1-16 giây.
Mẹo
Mẹo viết prompt cho Vidu Q3
Lời khuyên thực tế để có kết quả tốt hơn từ Vidu Q3 — rút ra từ các mẫu hiệu quả trên các mô hình video trong các pipeline sản xuất.
- 01
Dùng hỗ trợ 1-4 ảnh tham chiếu cho cảnh nhiều thực thể
vidu/q3/reference-to-video nhận 1-4 ảnh tham chiếu để tạo video nhất quán nhiều thực thể với hướng dẫn bằng prompt văn bản. Hữu ích cho cảnh dàn diễn viên, trưng bày nhóm sản phẩm và storyboard nhiều chủ thể.
- 02
Nội suy khung đầu-cuối cho quy trình keyframe
vidu/q3/start-end-to-video nối hai ảnh tĩnh bằng chuyển động được tạo. Đặc biệt hữu ích cho công việc kiểu animatic, storyboard theo tư thế chủ chốt và ghép concept art thành chuyển động mà không phải viết lại prompt cho từng đoạn.
- 03
Chọn bậc có chủ đích
Standard là bậc phân phối mặc định; bậc Pro (đầu ra 1-16 giây) được định vị cho khối lượng lớn; bậc Turbo ưu tiên tốc độ. Hãy xem bảng giá trực tiếp trên trang này để biết chi phí hiện tại của từng bậc — bậc Pro của Vidu Q3 có giá cạnh tranh bất thường.
- 04
Đầu ra tới 16 giây ở một số biến thể
Theo danh mục, ở bậc Pro và các biến thể reference-to-video: thời lượng 1-16 giây. Dài hơn khoảng 5-8 giây của nhiều mô hình video cạnh tranh — hữu ích cho trọn nhịp tường thuật trong một lần tạo.
- 05
image-to-video-pro cho đầu ra độ phân giải cao
vidu/q3/image-to-video-pro hỗ trợ độ phân giải 720p / 1080p / 2K / 4K từ ảnh. Hữu ích để có đầu ra cấp phân phối mà không cần bước nâng cấp khi bắt đầu từ một ảnh tĩnh.
Giá
Giá API Vidu Q3
Giá tính theo từng kết quả đầu ra. Khoản phí cuối cùng thay đổi theo các tham số bạn đặt trong playground của từng biến thể (độ phân giải, thời lượng, số kết quả, tham chiếu).
| Endpoint | Loại | Giá khởi điểm |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Gọi API Vidu Q3
Đăng ký API key tại wavespeed.ai/accesskey, rồi gửi prediction qua REST. Playground tạo sẵn mã mẫu có thể dán ngay cho mọi tổ hợp đầu vào.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)So sánh
Vidu Q3 so với các lựa chọn khác
Khi nào nên chọn Vidu Q3 thay vì các mô hình tương tự trên WaveSpeedAI.
Vidu Q3 so với Seedance 2.0
Seedance 2.0 có tổng hợp âm thanh gốc trên mọi biến thể và phân khúc Turbo. Vidu Q3 rẻ hơn đáng kể và có nội suy start-end như một endpoint chính thức mà Seedance không có.
Vidu Q3 so với Kling 3.0
Kling 3.0 có Standard, Pro và 4K cùng điều khiển chuyển động như một endpoint phụ. Vidu Q3 rẻ hơn ở hầu hết các phân khúc và có start-end-to-video cùng reference-to-video (1-4 tham chiếu) là các biến thể cốt lõi.
Vidu Q3 so với Wan 2.7
Wan 2.7 có reference-to-video, video-edit, video-extend, image-edit và text-to-image trong cùng dòng. Vidu Q3 tập trung vào mảng tạo video với các phân khúc rẻ hơn và quy trình nội suy start-end.
Câu hỏi thường gặp
Vidu Q3 API — Câu hỏi thường gặp
Giá, giấy phép, tích hợp — những câu hỏi phổ biến về việc chạy Vidu Q3 trên WaveSpeedAI.
API Vidu Q3 là gì?
Vidu Q3 là mô hình tạo video của Shengshu, được cung cấp dưới dạng REST API trên WaveSpeedAI. Shengshu Vidu Q3 — text-to-video, image-to-video, reference-to-video (1-4 ảnh tham chiếu để nhất quán nhiều thực thể) và start-end-to-video. Ba phân khúc: Standard, Pro, Turbo. Đầu ra dài tới 16 giây ở một số biến thể. Bạn có thể gọi bằng lập trình hoặc thử từ playground ở liên kết phía trên.
Làm sao để gọi API Vidu Q3?
Đăng ký tài khoản WaveSpeedAI, sao chép API key từ /accesskey, rồi POST tới https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video với đầu vào dưới dạng JSON. Endpoint trả về prediction id. Hãy poll endpoint kết quả khoảng mỗi 2 giây, tăng khoảng cách với các tác vụ chạy lâu, và dừng ở bất kỳ trạng thái kết thúc nào. Ví dụ Python / Node.js / cURL hướng tới môi trường production ở phía trên.
API Vidu Q3 có giá bao nhiêu?
Vidu Q3 bắt đầu từ $0.15 mỗi lượt chạy. Chi phí chính xác thay đổi theo các tham số bạn đặt (độ phân giải, thời lượng, số kết quả, tham chiếu). Phần xem trước chi phí trực tiếp cạnh nút Tạo trong playground hiển thị giá chính xác cho đầu vào hiện tại của bạn.
Có những biến thể Vidu Q3 nào?
WaveSpeedAI cung cấp 13 endpoint Vidu Q3 đang hoạt động: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, và nhiều hơn nữa. Mỗi biến thể có trang playground và giá riêng.
Tôi có thể dùng kết quả của Vidu Q3 cho mục đích thương mại không?
Quyền sử dụng thương mại tuân theo giấy phép mô hình của Shengshu. Hầu hết mô hình của Shengshu cho phép dùng kết quả đầu ra cho mục đích thương mại; hãy xem trang playground của từng mô hình để biết tóm tắt giấy phép cụ thể, và Điều khoản dịch vụ của WaveSpeedAI cho các điều kiện cấp nền tảng.
Tại sao dùng Vidu Q3 trên WaveSpeedAI thay vì gọi trực tiếp?
Một API key + một tài khoản thanh toán cho Vidu Q3 VÀ hơn 1.000 mô hình AI khác từ các nhà cung cấp khác. Không cần thiết lập SDK cho từng hãng, không có hạn mức tốc độ riêng, không phải viết lại mã tích hợp cho từng hãng. Giá thường ngang bằng hoặc thấp hơn API trực tiếp của Shengshu.
Nhà cung cấp
Giới thiệu về Shengshu
Đội ngũ đứng sau Vidu Q3 và dòng mô hình Shengshu rộng hơn trên WaveSpeedAI.
Shengshu Technology là phòng thí nghiệm AI của Trung Quốc tách ra từ Đại học Thanh Hoa, đứng sau dòng mô hình tạo video Vidu. Vidu Q3 có text-to-video, image-to-video, reference-to-video (1-4 ảnh tham chiếu để nhất quán nhiều thực thể) và start-end-to-video (nội suy keyframe giữa hai ảnh tĩnh) ở các bậc Standard, Pro và Turbo. Một số biến thể hỗ trợ đầu ra tới 16 giây.
Bắt đầu xây dựng với Vidu Q3 trên WaveSpeedAI
Tặng credit dùng thử miễn phí khi đăng ký. Một API key cho hơn 1.000 mô hình AI từ Shengshu và mọi nhà cung cấp khác.