Vidu Q4 API
Shengshu Vidu Q4 — gambar-ke-video dan referensi-ke-video dengan klip 3-16 detik, output 540p hingga 4K, serta audio hasil pembuatan opsional. Referensi-ke-video menerima hingga 12 gambar referensi dan hingga 3 klip audio referensi dalam satu permintaan.
Dua endpoint: vidu/q4-preview/image-to-video menghidupkan satu gambar, dan vidu/q4-preview/reference-to-video membangun adegan dari prompt plus hingga 12 gambar referensi dan 3 klip audio referensi. Keduanya menerima durasi berapa pun dalam detik bulat dari 3 hingga 16 detik, lima resolusi dari 540p hingga 4K, dan tombol audio.
Ringkasan
Tentang Vidu Q4 API
Apa yang dilakukan Vidu Q4, posisinya dalam jajaran model Shengshu, dan mengapa banyak tim memilihnya.
Vidu Q4 adalah model pembuatan video dari Shengshu, tersedia melalui REST API WaveSpeedAI. Shengshu Vidu Q4 — gambar-ke-video dan referensi-ke-video dengan klip 3-16 detik, output 540p hingga 4K, serta audio hasil pembuatan opsional. Referensi-ke-video menerima hingga 12 gambar referensi dan hingga 3 klip audio referensi dalam satu permintaan.
Dua endpoint: vidu/q4-preview/image-to-video menghidupkan satu gambar, dan vidu/q4-preview/reference-to-video membangun adegan dari prompt plus hingga 12 gambar referensi dan 3 klip audio referensi. Keduanya menerima durasi berapa pun dalam detik bulat dari 3 hingga 16 detik, lima resolusi dari 540p hingga 4K, dan tombol audio.
Keluarga Vidu Q4 di WaveSpeedAI menyediakan 2 endpoint REST yang mencakup alur kerja Reference-To-Video, Image-To-Video. Setiap varian memiliki harga, parameter, dan contoh output sendiri — pilih yang sesuai dengan modalitas input dan kebutuhan produksi Anda, atau panggil beberapa sekaligus dengan satu API key untuk menyusun pipeline multi-langkah.
Jalankan Vidu Q4 dengan API key, akun penagihan, dan batas laju yang sama dengan yang Anda pakai untuk 1.000+ model AI lainnya di WaveSpeedAI. Tanpa penyiapan vendor terpisah, tanpa SDK per penyedia, tanpa batas laju per vendor — satu integrasi mencakup semuanya, dari text-to-image dan text-to-video hingga sintesis audio, pembuatan 3D, upscaling, dan pengeditan.
Spesifikasi
Kemampuan dan status rilis Vidu Q4 API
Detail khusus model yang dicari pengembang sebelum memilih API: ketersediaan, perkiraan panjang output, dukungan referensi, dan alternatif aktif saat ini.
Endpoint
2 varian
Gambar-ke-video dan referensi-ke-video.
Durasi
3-16 dtk
Berapa pun dalam detik bulat; default 5 dtk.
Resolusi
540p hingga 4K
540p, 720p, 1080p, 2K, 4K; default 720p.
Referensi
12 gambar + 3 audio
Pada referensi-ke-video, bersama prompt teks.
Endpoint
Semua endpoint API Vidu Q4
2 endpoint Vidu Q4 tersedia sekarang di WaveSpeedAI — pilih varian yang sesuai dengan alur kerja Anda.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Contoh
Lihat Vidu Q4 beraksi
Output nyata yang dihasilkan oleh API Vidu Q4. Arahkan kursor ke video mana pun untuk pratinjau, klik untuk membuka penampil ukuran penuh.
Cara pakai
Cara menggunakan API Vidu Q4
Empat langkah dari pendaftaran hingga hasil jadi. Contoh lengkap Python, Node.js, dan cURL ada di bagian API di bawah.
- 01
Dapatkan API key
Daftar akun WaveSpeedAI dan salin API key Anda dari dasbor. Akun baru mendapat kredit awal gratis — cukup untuk menjalankan playground beberapa puluh kali sebelum penagihan dimulai.
- 02
Kirim prediksi
POST input Anda sebagai JSON ke https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video. Endpoint langsung mengembalikan id prediksi — proses generasi bersifat asinkron sehingga Anda tidak perlu menahan koneksi terbuka selama inferensi.
- 03
Polling hingga selesai
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Ambil output saat completed; hentikan dengan error saat failed, cancelled, timeout, atau deleted; lanjutkan polling untuk status lainnya.
- 04
Baca URL output
Setelah status "completed", baca URL dari data.outputs[0]. URL tersebut mengarah ke media hasil generasi Anda di CDN WaveSpeedAI — file gambar, video, audio, atau 3D tergantung varian Vidu Q4 yang Anda panggil.
Kasus penggunaan
Apa yang bisa Anda bangun dengan Vidu Q4
Alur kerja umum yang dipakai pengembang dan kreator dengan API Vidu Q4.
Animasi produk dari satu foto
vidu/q4-preview/image-to-video mengubah satu foto produk menjadi klip promosi. Jelaskan gerakan kamera dan gerakan yang Anda inginkan; gambar tetap menjadi jangkar visual.
Karakter yang tetap konsisten
vidu/q4-preview/reference-to-video menerima hingga 12 gambar referensi, sehingga karakter berulang, maskot, atau juru bicara dapat ditampilkan dari berbagai sudut dan tetap mudah dikenali di setiap klip.
Adegan yang dipandu suara
Tambahkan hingga 3 klip audio referensi melalui field audios bersama gambar Anda, dan biarkan generate_audio aktif untuk mendapatkan klip bersuara dalam satu panggilan.
4K siap kirim
Kedua endpoint menghasilkan output 540p, 720p, 1080p, 2K, atau 4K. Buat draf di 540p atau 720p, lalu jalankan ulang prompt yang disetujui pada resolusi akhir tanpa tahap upscaling terpisah.
Semua format media sosial
Referensi-ke-video merender 16:9, 9:16, 1:1, 3:4, atau 4:3, mencakup YouTube, Reels, Shorts, postingan feed, dan halaman produk dari referensi yang sama.
Klip yang pas dengan ritme
Durasi bisa berapa pun dalam detik bulat dari 3 hingga 16, sehingga loop 3 detik, bumper 6 detik, dan spot 15 detik semuanya berasal dari endpoint yang sama.
Tips
Tips menulis prompt untuk Vidu Q4
Saran praktis untuk mendapatkan output yang lebih baik dari Vidu Q4 — diambil dari pola yang berhasil pada model video di pipeline produksi.
- 01
Gunakan gambar sumber yang bersih dan terang
Untuk vidu/q4-preview/image-to-video, gambar menentukan subjek, framing, dan gaya. Pilih gambar tajam dengan satu subjek yang jelas, lalu gunakan prompt untuk arahan gerakan dan kamera alih-alih menjelaskan ulang apa yang sudah terlihat.
- 02
Beri setiap referensi peran yang jelas
Dengan vidu/q4-preview/reference-to-video, gunakan referensi yang memang termasuk dalam adegan — karakter, produk, latar — dan jelaskan di prompt bagaimana masing-masing harus muncul, alih-alih mengirim gambar yang kurang berkaitan.
- 03
Sesuaikan aksi dengan durasi
Mintalah jumlah aksi yang sesuai dengan panjang klip. Klip 3-5 detik cocok untuk satu gerakan atau gestur; simpan aksi bertahap untuk 10-16 detik.
- 04
Draf rendah, kirim tinggi
Jelajahi ide di 540p atau 720p dengan durasi pendek, lalu jalankan ulang prompt terpilih di 1080p, 2K, atau 4K untuk hasil akhir.
- 05
Tentukan audio dan penulisan ulang prompt sejak awal
generate_audio aktif secara default; matikan jika Anda akan menambahkan soundtrack sendiri. Pada gambar-ke-video, setel enable_prompt_expansion ke false jika Anda ingin prompt digunakan persis seperti yang ditulis.
Harga
Harga API Vidu Q4
Harga dihitung per output. Biaya akhir menyesuaikan parameter yang Anda atur di playground setiap varian (resolusi, durasi, jumlah output, referensi).
| Endpoint | Jenis | Harga mulai dari |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Panggil API Vidu Q4
Daftar untuk mendapatkan API key di wavespeed.ai/accesskey, lalu kirim prediksi melalui REST. Playground menghasilkan contoh siap tempel untuk kombinasi input apa pun.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Perbandingan
Vidu Q4 vs alternatif
Kapan memilih Vidu Q4 dibanding model serupa di WaveSpeedAI.
Vidu Q4 vs Vidu Q3
Referensi-ke-video Vidu Q3 menerima 1-4 gambar referensi; Q4 menerima hingga 12 gambar plus hingga 3 referensi audio, dan kedua endpoint Q4 mencapai 4K. Q3 tetap menjadi pilihan untuk teks-ke-video, interpolasi keyframe awal-akhir, serta tingkat Pro dan Turbo-nya.
Vidu Q4 vs Seedance 2.5
Seedance 2.5 mendukung single shot hingga 30 detik dan menambahkan endpoint edit serta perpanjangan video. Vidu Q4 berfokus pada pembuatan berbasis gambar dan referensi dengan output hingga 4K.
Vidu Q4 vs Wan 3.0
Wan 3.0 menyediakan teks-, gambar-, dan referensi-ke-video hingga 30 detik pada resolusi hingga 1080p. Vidu Q4 maksimal 16 detik, tetapi menambahkan output 2K dan 4K serta hingga 12 gambar referensi.
FAQ
Vidu Q4 API — Pertanyaan yang sering diajukan
Harga, lisensi, integrasi — pertanyaan umum tentang menjalankan Vidu Q4 di WaveSpeedAI.
Apa itu API Vidu Q4?
Vidu Q4 adalah model pembuatan video dari Shengshu yang tersedia sebagai REST API di WaveSpeedAI. Shengshu Vidu Q4 — gambar-ke-video dan referensi-ke-video dengan klip 3-16 detik, output 540p hingga 4K, serta audio hasil pembuatan opsional. Referensi-ke-video menerima hingga 12 gambar referensi dan hingga 3 klip audio referensi dalam satu permintaan. Anda dapat memanggilnya secara terprogram atau mencobanya dari playground yang ditautkan di atas.
Bagaimana cara memanggil API Vidu Q4?
Daftar akun WaveSpeedAI, salin API key Anda dari /accesskey, lalu POST ke https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video dengan input Anda sebagai JSON. Endpoint mengembalikan id prediksi. Lakukan polling pada endpoint hasil dengan interval sekitar 2 detik, perpanjang interval untuk tugas yang berjalan lama, dan berhenti pada status akhir apa pun. Contoh Python / Node.js / cURL untuk produksi ada di atas.
Berapa biaya API Vidu Q4?
Vidu Q4 mulai dari $0.25 per run. Biaya pastinya menyesuaikan parameter yang Anda atur (resolusi, durasi, jumlah output, referensi). Pratinjau biaya langsung di samping tombol Generate di playground menampilkan harga pasti untuk input Anda saat ini.
Varian Vidu Q4 apa saja yang tersedia?
WaveSpeedAI menyediakan 2 endpoint Vidu Q4 aktif: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. Setiap varian memiliki halaman playground dan harga sendiri.
Bisakah output Vidu Q4 dipakai secara komersial?
Hak penggunaan komersial mengikuti lisensi model Shengshu. Sebagian besar model Shengshu mengizinkan penggunaan output secara komersial; lihat halaman playground tiap model untuk ringkasan lisensinya, dan Ketentuan Layanan WaveSpeedAI untuk ketentuan tingkat platform.
Mengapa memakai Vidu Q4 di WaveSpeedAI dan bukan langsung?
Satu API key + satu akun penagihan untuk Vidu Q4 DAN 1.000+ model AI lain dari penyedia lain. Tanpa penyiapan SDK per vendor, tanpa batas laju terpisah, tanpa menulis ulang kode integrasi untuk tiap vendor. Harganya umumnya setara atau di bawah API langsung dari Shengshu.
Penyedia
Tentang Shengshu
Tim di balik Vidu Q4 dan jajaran model Shengshu lainnya di WaveSpeedAI.
Shengshu Technology adalah lab AI Tiongkok yang lahir dari Universitas Tsinghua, di balik keluarga model pembuatan video Vidu. Vidu Q4, generasi terbaru, menambahkan gambar-ke-video dan referensi-ke-video dengan hingga 12 gambar referensi, hingga 3 klip audio referensi, dan output hingga 4K. Vidu Q3 menyediakan teks-ke-video, gambar-ke-video, referensi-ke-video (1-4 gambar referensi untuk konsistensi multi-entitas), dan start-end-to-video (interpolasi keyframe antara dua gambar diam) di tingkat Standard, Pro, dan Turbo. Beberapa varian mendukung output hingga 16 detik.
Mulai membangun dengan Vidu Q4 di WaveSpeedAI
Kredit awal gratis saat mendaftar. Satu API key untuk 1.000+ model AI dari Shengshu dan semua penyedia lainnya.