Vidu Q3 API
Shengshu Vidu Q3 — teks-ke-video, gambar-ke-video, referensi-ke-video (1-4 gambar referensi untuk konsistensi multi-entitas), dan start-end-to-video. Tiga tingkat: Standard, Pro, Turbo. Output hingga 16 detik pada beberapa varian.
Tingkat Standard, Pro (output 1-16 dtk), dan Turbo (lebih cepat). Referensi-ke-video menerima 1-4 gambar referensi untuk video multi-entitas yang konsisten pada 360p-1080p, hingga 16 detik. Start-end-to-video menjembatani dua keyframe (1-16 dtk pada Pro). Varian image-to-video-pro mendukung 720p/1080p/2K/4K.
Ringkasan
Tentang Vidu Q3 API
Apa yang dilakukan Vidu Q3, posisinya dalam jajaran model Shengshu, dan mengapa banyak tim memilihnya.
Vidu Q3 adalah model pembuatan video dari Shengshu, tersedia melalui REST API WaveSpeedAI. Shengshu Vidu Q3 — teks-ke-video, gambar-ke-video, referensi-ke-video (1-4 gambar referensi untuk konsistensi multi-entitas), dan start-end-to-video. Tiga tingkat: Standard, Pro, Turbo. Output hingga 16 detik pada beberapa varian.
Tingkat Standard, Pro (output 1-16 dtk), dan Turbo (lebih cepat). Referensi-ke-video menerima 1-4 gambar referensi untuk video multi-entitas yang konsisten pada 360p-1080p, hingga 16 detik. Start-end-to-video menjembatani dua keyframe (1-16 dtk pada Pro). Varian image-to-video-pro mendukung 720p/1080p/2K/4K.
Keluarga Vidu Q3 di WaveSpeedAI menyediakan 13 endpoint REST yang mencakup alur kerja Text-To-Video, Image-To-Video, Reference-To-Video. Setiap varian memiliki harga, parameter, dan contoh output sendiri — pilih yang sesuai dengan modalitas input dan kebutuhan produksi Anda, atau panggil beberapa sekaligus dengan satu API key untuk menyusun pipeline multi-langkah.
Jalankan Vidu Q3 dengan API key, akun penagihan, dan batas laju yang sama dengan yang Anda pakai untuk 1.000+ model AI lainnya di WaveSpeedAI. Tanpa penyiapan vendor terpisah, tanpa SDK per penyedia, tanpa batas laju per vendor — satu integrasi mencakup semuanya, dari text-to-image dan text-to-video hingga sintesis audio, pembuatan 3D, upscaling, dan pengeditan.
Endpoint
Semua endpoint API Vidu Q3
13 endpoint Vidu Q3 tersedia sekarang di WaveSpeedAI — pilih varian yang sesuai dengan alur kerja Anda.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Contoh
Lihat Vidu Q3 beraksi
Output nyata yang dihasilkan oleh API Vidu Q3. Arahkan kursor ke video mana pun untuk pratinjau, klik untuk membuka penampil ukuran penuh.
Cara pakai
Cara menggunakan API Vidu Q3
Empat langkah dari pendaftaran hingga hasil jadi. Contoh lengkap Python, Node.js, dan cURL ada di bagian API di bawah.
- 01
Dapatkan API key
Daftar akun WaveSpeedAI dan salin API key Anda dari dasbor. Akun baru mendapat kredit awal gratis — cukup untuk menjalankan playground beberapa puluh kali sebelum penagihan dimulai.
- 02
Kirim prediksi
POST input Anda sebagai JSON ke https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Endpoint langsung mengembalikan id prediksi — proses generasi bersifat asinkron sehingga Anda tidak perlu menahan koneksi terbuka selama inferensi.
- 03
Polling hingga selesai
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Ambil output saat completed; hentikan dengan error saat failed, cancelled, timeout, atau deleted; lanjutkan polling untuk status lainnya.
- 04
Baca URL output
Setelah status "completed", baca URL dari data.outputs[0]. URL tersebut mengarah ke media hasil generasi Anda di CDN WaveSpeedAI — file gambar, video, audio, atau 3D tergantung varian Vidu Q3 yang Anda panggil.
Kasus penggunaan
Apa yang bisa Anda bangun dengan Vidu Q3
Alur kerja umum yang dipakai pengembang dan kreator dengan API Vidu Q3.
Referensi-ke-video dengan 1-4 referensi
vidu/q3/reference-to-video menghasilkan video multi-entitas yang konsisten dari 1-4 gambar referensi dengan panduan prompt teks. Mendukung 360p-1080p, hingga 16 detik, beberapa rasio aspek. Berguna untuk adegan ansambel di mana beberapa subjek referensi harus tetap koheren.
Interpolasi keyframe awal-akhir
vidu/q3/start-end-to-video membuat video dengan menginterpolasi dua keyframe. Tingkat Pro dan Turbo juga mendukung start-end dengan durasi 1-16 dtk. Berguna untuk storyboard gaya animatic saat Anda sudah punya still awal dan akhir.
Output hingga 16 detik
Klaim katalog pada varian Pro dan referensi-ke-video: durasi 1-16 detik. Lebih panjang daripada jendela 5-8 dtk pada banyak model video pesaing — berguna untuk alur naratif utuh dalam satu pembuatan.
Gambar-ke-video beresolusi tinggi
vidu/q3/image-to-video-pro mendukung 720p / 1080p / 2K / 4K dari gambar. Berguna untuk output kelas hasil akhir tanpa tahap upscaling saat memulai dari gambar diam.
Tingkat Pro (termurah)
vidu/q3-pro/* adalah tingkat Vidu Q3 termurah — berguna untuk pekerjaan volume tinggi. Mencakup gambar-ke-video, teks-ke-video, dan start-end-to-video dengan output 1-16 detik.
Tips
Tips menulis prompt untuk Vidu Q3
Saran praktis untuk mendapatkan output yang lebih baik dari Vidu Q3 — diambil dari pola yang berhasil pada model video di pipeline produksi.
- 01
Gunakan dukungan 1-4 gambar referensi untuk adegan multi-entitas
vidu/q3/reference-to-video menerima 1-4 gambar referensi untuk video multi-entitas yang konsisten dengan panduan prompt teks. Berguna untuk adegan pemeran ansambel, presentasi produk berkelompok, dan storyboard multi-subjek.
- 02
Interpolasi bingkai awal-akhir untuk alur kerja keyframe
vidu/q3/start-end-to-video menjembatani dua gambar diam dengan gerakan hasil pembuatan. Sangat berguna untuk pekerjaan gaya animatic, storyboard berbasis pose kunci, dan menyambung concept art menjadi gerakan tanpa membuat prompt ulang tiap segmen.
- 03
Pilih tingkat secara sengaja
Standard adalah tingkat hasil akhir default; tingkat Pro (output 1-16 detik) diposisikan untuk pekerjaan volume tinggi; tingkat Turbo mengutamakan kecepatan. Periksa tabel harga langsung di halaman ini untuk biaya per tingkat terkini — tingkat Pro Vidu Q3 sangat kompetitif.
- 04
Output hingga 16 detik pada beberapa varian
Klaim katalog pada varian Pro dan referensi-ke-video: durasi 1-16 detik. Lebih panjang daripada jendela 5-8 dtk pada banyak model video pesaing — berguna untuk alur naratif utuh dalam satu pembuatan.
- 05
image-to-video-pro untuk output resolusi tinggi
vidu/q3/image-to-video-pro mendukung resolusi 720p / 1080p / 2K / 4K dari gambar. Berguna untuk output kelas hasil akhir tanpa tahap upscaling saat memulai dari gambar diam.
Harga
Harga API Vidu Q3
Harga dihitung per output. Biaya akhir menyesuaikan parameter yang Anda atur di playground setiap varian (resolusi, durasi, jumlah output, referensi).
| Endpoint | Jenis | Harga mulai dari |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Panggil API Vidu Q3
Daftar untuk mendapatkan API key di wavespeed.ai/accesskey, lalu kirim prediksi melalui REST. Playground menghasilkan contoh siap tempel untuk kombinasi input apa pun.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Perbandingan
Vidu Q3 vs alternatif
Kapan memilih Vidu Q3 dibanding model serupa di WaveSpeedAI.
Vidu Q3 vs Seedance 2.0
Seedance 2.0 menyediakan sintesis audio native di setiap varian dan tingkat Turbo. Vidu Q3 jauh lebih murah dan menyediakan interpolasi awal-akhir sebagai endpoint utama yang tidak dimiliki Seedance.
Vidu Q3 vs Kling 3.0
Kling 3.0 mencakup Standard, Pro, dan 4K dengan motion-control sebagai sub-endpoint. Vidu Q3 lebih murah di sebagian besar tingkat dan menyediakan start-end-to-video serta referensi-ke-video (1-4 referensi) sebagai varian inti.
Vidu Q3 vs Wan 2.7
Wan 2.7 menyediakan referensi-ke-video, video-edit, video-extend, image-edit, dan teks-ke-gambar dalam keluarga yang sama. Vidu Q3 tetap berfokus pada pembuatan video dengan tingkat lebih murah dan alur kerja interpolasi awal-akhir.
FAQ
Vidu Q3 API — Pertanyaan yang sering diajukan
Harga, lisensi, integrasi — pertanyaan umum tentang menjalankan Vidu Q3 di WaveSpeedAI.
Apa itu API Vidu Q3?
Vidu Q3 adalah model pembuatan video dari Shengshu yang tersedia sebagai REST API di WaveSpeedAI. Shengshu Vidu Q3 — teks-ke-video, gambar-ke-video, referensi-ke-video (1-4 gambar referensi untuk konsistensi multi-entitas), dan start-end-to-video. Tiga tingkat: Standard, Pro, Turbo. Output hingga 16 detik pada beberapa varian. Anda dapat memanggilnya secara terprogram atau mencobanya dari playground yang ditautkan di atas.
Bagaimana cara memanggil API Vidu Q3?
Daftar akun WaveSpeedAI, salin API key Anda dari /accesskey, lalu POST ke https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video dengan input Anda sebagai JSON. Endpoint mengembalikan id prediksi. Lakukan polling pada endpoint hasil dengan interval sekitar 2 detik, perpanjang interval untuk tugas yang berjalan lama, dan berhenti pada status akhir apa pun. Contoh Python / Node.js / cURL untuk produksi ada di atas.
Berapa biaya API Vidu Q3?
Vidu Q3 mulai dari $0.15 per run. Biaya pastinya menyesuaikan parameter yang Anda atur (resolusi, durasi, jumlah output, referensi). Pratinjau biaya langsung di samping tombol Generate di playground menampilkan harga pasti untuk input Anda saat ini.
Varian Vidu Q3 apa saja yang tersedia?
WaveSpeedAI menyediakan 13 endpoint Vidu Q3 aktif: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, dan lainnya. Setiap varian memiliki halaman playground dan harga sendiri.
Bisakah output Vidu Q3 dipakai secara komersial?
Hak penggunaan komersial mengikuti lisensi model Shengshu. Sebagian besar model Shengshu mengizinkan penggunaan output secara komersial; lihat halaman playground tiap model untuk ringkasan lisensinya, dan Ketentuan Layanan WaveSpeedAI untuk ketentuan tingkat platform.
Mengapa memakai Vidu Q3 di WaveSpeedAI dan bukan langsung?
Satu API key + satu akun penagihan untuk Vidu Q3 DAN 1.000+ model AI lain dari penyedia lain. Tanpa penyiapan SDK per vendor, tanpa batas laju terpisah, tanpa menulis ulang kode integrasi untuk tiap vendor. Harganya umumnya setara atau di bawah API langsung dari Shengshu.
Penyedia
Tentang Shengshu
Tim di balik Vidu Q3 dan jajaran model Shengshu lainnya di WaveSpeedAI.
Shengshu Technology adalah lab AI Tiongkok yang lahir dari Universitas Tsinghua, di balik keluarga model pembuatan video Vidu. Vidu Q3 menyediakan teks-ke-video, gambar-ke-video, referensi-ke-video (1-4 gambar referensi untuk konsistensi multi-entitas), dan start-end-to-video (interpolasi keyframe antara dua gambar diam) di tingkat Standard, Pro, dan Turbo. Beberapa varian mendukung output hingga 16 detik.
Mulai membangun dengan Vidu Q3 di WaveSpeedAI
Kredit awal gratis saat mendaftar. Satu API key untuk 1.000+ model AI dari Shengshu dan semua penyedia lainnya.