Vidu Q4 API
Shengshu Vidu Q4 — 3-16 सेकंड के क्लिप, 540p से 4K आउटपुट और वैकल्पिक जनरेटेड ऑडियो के साथ image-to-video और reference-to-video। Reference-to-video एक ही रिक्वेस्ट में 12 तक रेफ़रेंस इमेज और 3 तक रेफ़रेंस ऑडियो क्लिप लेता है।
दो एंडपॉइंट: vidu/q4-preview/image-to-video एक इमेज को एनिमेट करता है, और vidu/q4-preview/reference-to-video एक प्रॉम्प्ट के साथ 12 तक रेफ़रेंस इमेज और 3 रेफ़रेंस ऑडियो क्लिप से सीन बनाता है। दोनों 3 से 16 सेकंड तक कोई भी पूर्ण-सेकंड अवधि, 540p से 4K तक पाँच रिज़ॉल्यूशन और ऑडियो टॉगल सपोर्ट करते हैं।
अवलोकन
Vidu Q4 API के बारे में
Vidu Q4 क्या करता है, Shengshu की मॉडल श्रृंखला में इसकी जगह क्या है, और टीमें इसे क्यों चुनती हैं।
Vidu Q4, Shengshu का वीडियो जनरेशन मॉडल है, जो WaveSpeedAI REST API के ज़रिए उपलब्ध है। Shengshu Vidu Q4 — 3-16 सेकंड के क्लिप, 540p से 4K आउटपुट और वैकल्पिक जनरेटेड ऑडियो के साथ image-to-video और reference-to-video। Reference-to-video एक ही रिक्वेस्ट में 12 तक रेफ़रेंस इमेज और 3 तक रेफ़रेंस ऑडियो क्लिप लेता है।
दो एंडपॉइंट: vidu/q4-preview/image-to-video एक इमेज को एनिमेट करता है, और vidu/q4-preview/reference-to-video एक प्रॉम्प्ट के साथ 12 तक रेफ़रेंस इमेज और 3 रेफ़रेंस ऑडियो क्लिप से सीन बनाता है। दोनों 3 से 16 सेकंड तक कोई भी पूर्ण-सेकंड अवधि, 540p से 4K तक पाँच रिज़ॉल्यूशन और ऑडियो टॉगल सपोर्ट करते हैं।
WaveSpeedAI पर Vidu Q4 परिवार में Reference-To-Video, Image-To-Video वर्कफ़्लो को कवर करने वाले 2 REST एंडपॉइंट हैं। हर वेरिएंट की अपनी प्राइसिंग, पैरामीटर और उदाहरण आउटपुट हैं — अपने इनपुट मोडैलिटी और प्रोडक्शन ज़रूरतों के अनुसार चुनें, या एक ही API कुंजी से कई वेरिएंट कॉल करके मल्टी-स्टेप पाइपलाइन बनाएं।
Vidu Q4 को उसी API कुंजी, बिलिंग अकाउंट और रेट-लिमिट के साथ चलाएं जिसका उपयोग आप WaveSpeedAI के अन्य 1,000+ AI मॉडल के लिए करते हैं। अलग वेंडर सेटअप नहीं, प्रति-प्रदाता SDK नहीं, प्रति-वेंडर रेट-लिमिट नहीं — एक ही इंटीग्रेशन टेक्स्ट-टू-इमेज और टेक्स्ट-टू-वीडियो से लेकर ऑडियो सिंथेसिस, 3D जनरेशन, अपस्केलिंग और एडिटिंग तक सब कुछ कवर करता है।
स्पेसिफ़िकेशन
Vidu Q4 API की क्षमताएँ और रिलीज़ स्थिति
मॉडल-विशिष्ट जानकारी जो डेवलपर API चुनने से पहले खोजते हैं: उपलब्धता, अपेक्षित आउटपुट अवधि, रेफरेंस सपोर्ट और वर्तमान लाइव विकल्प।
एंडपॉइंट
2 वेरिएंट
Image-to-video और reference-to-video।
अवधि
3-16 s
कोई भी पूर्ण संख्या में सेकंड; डिफ़ॉल्ट 5 s है।
रिज़ॉल्यूशन
540p से 4K
540p, 720p, 1080p, 2K, 4K; डिफ़ॉल्ट 720p है।
रेफ़रेंस
12 इमेज + 3 ऑडियो
Reference-to-video पर, टेक्स्ट प्रॉम्प्ट के साथ।
एंडपॉइंट
सभी Vidu Q4 API एंडपॉइंट
WaveSpeedAI पर अभी 2 Vidu Q4 एंडपॉइंट उपलब्ध हैं — अपने वर्कफ़्लो के अनुकूल वेरिएंट चुनें।
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
उदाहरण
Vidu Q4 को काम करते देखें
Vidu Q4 API से बनाए गए असली आउटपुट। किसी भी वीडियो पर होवर करके प्रीव्यू देखें, पूर्ण आकार का व्यूअर खोलने के लिए क्लिक करें।
कैसे करें
Vidu Q4 API का उपयोग कैसे करें
साइनअप से तैयार जनरेशन तक चार चरण। पूरे Python, Node.js और cURL उदाहरण नीचे API सेक्शन में हैं।
- 01
API कुंजी प्राप्त करें
WaveSpeedAI अकाउंट बनाएं और डैशबोर्ड से अपनी API कुंजी कॉपी करें। नए अकाउंट के साथ मुफ़्त शुरुआती क्रेडिट मिलते हैं — बिलिंग शुरू होने से पहले प्लेग्राउंड को कई दर्जन बार चलाने के लिए पर्याप्त।
- 02
prediction सबमिट करें
अपना इनपुट JSON के रूप में https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video पर POST करें। एंडपॉइंट तुरंत एक prediction id लौटाता है — जनरेशन असिंक्रोनस होते हैं, इसलिए इनफ़रेंस के दौरान आपको कनेक्शन खुला नहीं रखना पड़ता।
- 03
पूर्ण होने तक पोल करें
https://api.wavespeed.ai/api/v3/predictions/{request_id}/result पर GET करें। completed पर आउटपुट लौटाएं; failed, cancelled, timeout या deleted पर त्रुटि के साथ रुकें; बाकी हर status पर पोलिंग जारी रखें।
- 04
आउटपुट URL पढ़ें
status "completed" होने पर data.outputs[0] से URL पढ़ें। यह URL WaveSpeedAI CDN पर आपके बनाए मीडिया की ओर इशारा करता है — आपके कॉल किए गए Vidu Q4 वेरिएंट के अनुसार इमेज, वीडियो, ऑडियो या 3D फ़ाइल।
उपयोग के मामले
Vidu Q4 से आप क्या बना सकते हैं
आम वर्कफ़्लो जिनके लिए डेवलपर और क्रिएटर Vidu Q4 API का उपयोग करते हैं।
एक फ़ोटो से प्रोडक्ट एनिमेशन
vidu/q4-preview/image-to-video एक प्रोडक्ट शॉट को प्रमोशनल क्लिप में बदल देता है। आप जो कैमरा मूव और मोशन चाहते हैं उसका वर्णन करें; इमेज विज़ुअल एंकर बनी रहती है।
किरदार जो हर क्लिप में एक जैसे दिखें
vidu/q4-preview/reference-to-video 12 तक रेफ़रेंस इमेज स्वीकार करता है, ताकि कोई बार-बार आने वाला किरदार, मैस्कॉट या स्पोक्सपर्सन कई एंगल से दिखाया जा सके और सभी क्लिप में पहचाना जा सके।
ध्वनि से निर्देशित सीन
अपनी इमेज के साथ audios फ़ील्ड के ज़रिए 3 तक रेफ़रेंस ऑडियो क्लिप जोड़ें, और एक ही कॉल में साउंड वाला क्लिप पाने के लिए generate_audio चालू रखें।
डिलीवरी के लिए तैयार 4K
दोनों एंडपॉइंट 540p, 720p, 1080p, 2K या 4K आउटपुट देते हैं। 540p या 720p में ड्राफ़्ट बनाएँ, फिर अलग अपस्केलिंग पास के बिना स्वीकृत प्रॉम्प्ट को डिलीवरी रिज़ॉल्यूशन पर दोबारा चलाएँ।
हर सोशल फ़ॉर्मैट
Reference-to-video 16:9, 9:16, 1:1, 3:4 या 4:3 में रेंडर करता है, जिससे एक ही रेफ़रेंस से YouTube, Reels, Shorts, फ़ीड पोस्ट और प्रोडक्ट पेज सब कवर हो जाते हैं।
बीट के हिसाब से क्लिप की लंबाई
अवधि 3 से 16 तक कोई भी पूर्ण संख्या में सेकंड हो सकती है, इसलिए 3 सेकंड का लूप, 6 सेकंड का बम्पर और 15 सेकंड का स्पॉट — सब एक ही एंडपॉइंट से बनते हैं।
सुझाव
Vidu Q4 के लिए प्रॉम्प्ट लिखने के सुझाव
Vidu Q4 से बेहतर आउटपुट पाने के व्यावहारिक सुझाव — प्रोडक्शन पाइपलाइन में वीडियो मॉडल पर काम करने वाले पैटर्न से लिए गए।
- 01
साफ़, अच्छी रोशनी वाली सोर्स इमेज इस्तेमाल करें
vidu/q4-preview/image-to-video में इमेज ही विषय, फ़्रेमिंग और स्टाइल तय करती है। एक स्पष्ट विषय वाली शार्प इमेज चुनें, फिर जो पहले से दिख रहा है उसे दोबारा बताने के बजाय प्रॉम्प्ट का इस्तेमाल मोशन और कैमरा निर्देशन के लिए करें।
- 02
हर रेफ़रेंस को एक काम दें
vidu/q4-preview/reference-to-video के साथ ऐसे रेफ़रेंस इस्तेमाल करें जो सीन का हिस्सा हों — किरदार, प्रोडक्ट, लोकेशन — और ढीले-ढाले संबंधित इमेज भेजने के बजाय प्रॉम्प्ट में बताएँ कि हर एक कैसे दिखना चाहिए।
- 03
एक्शन को अवधि के अनुसार रखें
क्लिप की लंबाई के हिसाब से उतना ही एक्शन माँगें। 3-5 सेकंड का क्लिप एक मूव या जेस्चर के लिए ठीक है; कई चरणों वाले एक्शन को 10-16 सेकंड के लिए रखें।
- 04
कम में ड्राफ़्ट, ज़्यादा में डिलीवरी
छोटी अवधि के साथ 540p या 720p में आइडिया आज़माएँ, फिर डिलीवरी के लिए चुने गए प्रॉम्प्ट को 1080p, 2K या 4K पर दोबारा चलाएँ।
- 05
ऑडियो और प्रॉम्प्ट रीराइटिंग पहले ही तय करें
generate_audio डिफ़ॉल्ट रूप से चालू रहता है; अगर आप अपना साउंडट्रैक जोड़ेंगे तो इसे बंद कर दें। Image-to-video पर, अगर आप चाहते हैं कि आपका प्रॉम्प्ट जैसा लिखा है वैसा ही इस्तेमाल हो, तो enable_prompt_expansion को false पर सेट करें।
प्राइसिंग
Vidu Q4 API प्राइसिंग
प्राइसिंग प्रति आउटपुट है। अंतिम शुल्क उन पैरामीटर के अनुसार बदलता है जो आप हर वेरिएंट के प्लेग्राउंड में सेट करते हैं (रिज़ॉल्यूशन, अवधि, आउटपुट संख्या, रेफरेंस)।
| एंडपॉइंट | प्रकार | शुरुआती कीमत |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Vidu Q4 API कॉल करें
wavespeed.ai/accesskey पर API कुंजी बनाएं, फिर REST के ज़रिए prediction सबमिट करें। प्लेग्राउंड इनपुट के किसी भी संयोजन के लिए सीधे पेस्ट करने योग्य नमूने तैयार करता है।
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)तुलना
Vidu Q4 बनाम विकल्प
WaveSpeedAI पर समान मॉडल की तुलना में Vidu Q4 कब चुनें।
Vidu Q4 बनाम Vidu Q3
Vidu Q3 reference-to-video 1-4 रेफ़रेंस इमेज लेता है; Q4 12 तक इमेज और 3 तक ऑडियो रेफ़रेंस लेता है, और Q4 के दोनों एंडपॉइंट 4K तक जाते हैं। text-to-video, start-end कीफ़्रेम इंटरपोलेशन और Pro व Turbo टियर के लिए Q3 अब भी सही विकल्प है।
Vidu Q4 बनाम Seedance 2.5
Seedance 2.5 30 सेकंड तक के सिंगल शॉट देता है और वीडियो एडिटिंग व एक्सटेंशन एंडपॉइंट भी जोड़ता है। Vidu Q4 4K तक आउटपुट के साथ इमेज- और रेफ़रेंस-आधारित जनरेशन पर केंद्रित है।
Vidu Q4 बनाम Wan 3.0
Wan 3.0 1080p तक 30 सेकंड तक का text-, image- और reference-to-video देता है। Vidu Q4 अधिकतम 16 सेकंड तक जाता है, लेकिन 2K और 4K आउटपुट और 12 तक रेफ़रेंस इमेज जोड़ता है।
FAQ
Vidu Q4 API — अक्सर पूछे जाने वाले प्रश्न
प्राइसिंग, लाइसेंस, इंटीग्रेशन — WaveSpeedAI पर Vidu Q4 चलाने के बारे में आम सवाल।
Vidu Q4 API क्या है?
Vidu Q4, Shengshu का वीडियो जनरेशन मॉडल है, जो WaveSpeedAI पर REST API के रूप में उपलब्ध है। Shengshu Vidu Q4 — 3-16 सेकंड के क्लिप, 540p से 4K आउटपुट और वैकल्पिक जनरेटेड ऑडियो के साथ image-to-video और reference-to-video। Reference-to-video एक ही रिक्वेस्ट में 12 तक रेफ़रेंस इमेज और 3 तक रेफ़रेंस ऑडियो क्लिप लेता है। आप इसे प्रोग्रामेटिक रूप से कॉल कर सकते हैं या ऊपर दिए प्लेग्राउंड से आज़मा सकते हैं।
Vidu Q4 API को कैसे कॉल करें?
WaveSpeedAI अकाउंट बनाएं, /accesskey से अपनी API कुंजी कॉपी करें, फिर अपना इनपुट JSON के रूप में https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video पर POST करें। एंडपॉइंट एक prediction id लौटाता है। रिज़ल्ट एंडपॉइंट को लगभग हर 2 सेकंड पर पोल करना शुरू करें, लंबे टास्क के लिए अंतराल बढ़ाएं, और किसी भी अंतिम status पर रुक जाएं। प्रोडक्शन-उन्मुख Python / Node.js / cURL उदाहरण ऊपर हैं।
Vidu Q4 API की कीमत कितनी है?
Vidu Q4 $0.25 प्रति रन से शुरू होता है। सटीक लागत आपके सेट किए पैरामीटर (रिज़ॉल्यूशन, अवधि, आउटपुट संख्या, रेफरेंस) के अनुसार बदलती है। प्लेग्राउंड में Generate बटन के पास लाइव कॉस्ट प्रीव्यू आपके वर्तमान इनपुट की सटीक कीमत दिखाता है।
Vidu Q4 के कौन-से वेरिएंट उपलब्ध हैं?
WaveSpeedAI पर 2 लाइव Vidu Q4 एंडपॉइंट हैं: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video। हर वेरिएंट का अपना प्लेग्राउंड पेज और प्राइसिंग है।
क्या मैं Vidu Q4 के आउटपुट का व्यावसायिक उपयोग कर सकता हूँ?
व्यावसायिक उपयोग के अधिकार Shengshu मॉडल लाइसेंस के अनुसार होते हैं। अधिकांश Shengshu मॉडल आउटपुट के व्यावसायिक उपयोग की अनुमति देते हैं; विशिष्ट लाइसेंस सारांश के लिए हर मॉडल का प्लेग्राउंड पेज और प्लेटफ़ॉर्म-स्तर की शर्तों के लिए WaveSpeedAI की सेवा की शर्तें देखें।
सीधे जाने के बजाय WaveSpeedAI पर Vidu Q4 क्यों इस्तेमाल करें?
एक API कुंजी + एक बिलिंग अकाउंट, Vidu Q4 और अन्य प्रदाताओं के 1,000+ दूसरे AI मॉडल के लिए। प्रति-वेंडर SDK सेटअप नहीं, अलग रेट-लिमिट नहीं, हर वेंडर के लिए इंटीग्रेशन कोड दोबारा लिखना नहीं। प्राइसिंग आमतौर पर Shengshu के सीधे API के बराबर या उससे कम होती है।
प्रदाता
Shengshu के बारे में
WaveSpeedAI पर Vidu Q4 और Shengshu की व्यापक मॉडल श्रृंखला के पीछे की टीम।
Shengshu Technology Tsinghua University से निकली एक चीनी AI लैब है, जो वीडियो जनरेशन मॉडल की Vidu फ़ैमिली के पीछे है। सबसे नई पीढ़ी Vidu Q4, 12 तक रेफ़रेंस इमेज, 3 तक रेफ़रेंस ऑडियो क्लिप और 4K तक आउटपुट के साथ image-to-video और reference-to-video जोड़ती है। Vidu Q3 Standard, Pro और Turbo टियर में text-to-video, image-to-video, reference-to-video (मल्टी-एंटिटी निरंतरता के लिए 1-4 रेफ़रेंस इमेज), और start-end-to-video (दो स्टिल के बीच कीफ़्रेम इंटरपोलेशन) देता है। कुछ वेरिएंट 16 सेकंड तक के आउटपुट सपोर्ट करते हैं।
WaveSpeedAI पर Vidu Q4 के साथ बनाना शुरू करें
साइनअप पर मुफ़्त शुरुआती क्रेडिट। Shengshu और हर अन्य प्रदाता के 1,000+ AI मॉडल के लिए एक API कुंजी।