Vidu Q3 API
Shengshu Vidu Q3 — tekst na wideo, obraz na wideo, referencja na wideo (1–4 obrazy referencyjne dla spójności wielu obiektów) i start-end-to-video. Trzy poziomy: Standard, Pro, Turbo. W niektórych wariantach wyniki do 16 sekund.
Poziomy Standard, Pro (wyniki 1–16 s) i Turbo (szybszy). Referencja na wideo przyjmuje 1–4 obrazy referencyjne dla spójnych wideo z wieloma obiektami w 360p–1080p, do 16 sekund. Start-end-to-video łączy dwie klatki kluczowe (1–16 s w Pro). Wariant image-to-video-pro obsługuje 720p/1080p/2K/4K.
Przegląd
O modelu Vidu Q3 API
Co robi Vidu Q3, jakie miejsce zajmuje w linii modeli Shengshu i dlaczego zespoły po niego sięgają.
Vidu Q3 to model generowania wideo od Shengshu, dostępny przez REST API WaveSpeedAI. Shengshu Vidu Q3 — tekst na wideo, obraz na wideo, referencja na wideo (1–4 obrazy referencyjne dla spójności wielu obiektów) i start-end-to-video. Trzy poziomy: Standard, Pro, Turbo. W niektórych wariantach wyniki do 16 sekund.
Poziomy Standard, Pro (wyniki 1–16 s) i Turbo (szybszy). Referencja na wideo przyjmuje 1–4 obrazy referencyjne dla spójnych wideo z wieloma obiektami w 360p–1080p, do 16 sekund. Start-end-to-video łączy dwie klatki kluczowe (1–16 s w Pro). Wariant image-to-video-pro obsługuje 720p/1080p/2K/4K.
Rodzina Vidu Q3 w WaveSpeedAI zawiera 13 endpointów REST obejmujące workflowy: Text-To-Video, Image-To-Video, Reference-To-Video. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.
Uruchamiaj Vidu Q3 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.
Endpointy
Wszystkie endpointy API Vidu Q3
13 endpointów Vidu Q3 dostępnych teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Przykłady
Vidu Q3 w akcji
Prawdziwe wyniki wygenerowane przez API Vidu Q3. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.
Jak zacząć
Jak korzystać z API Vidu Q3
Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.
- 01
Uzyskaj klucz API
Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.
- 02
Wyślij predykcję
Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.
- 03
Sprawdzaj ukończenie
Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.
- 04
Odczytaj adres wyniku
Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu Vidu Q3.
Zastosowania
Co możesz zbudować z Vidu Q3
Typowe workflowy, do których deweloperzy i twórcy używają API Vidu Q3.
Referencja na wideo z 1–4 referencjami
vidu/q3/reference-to-video generuje spójne wideo z wieloma obiektami z 1–4 obrazów referencyjnych, sterowane promptem tekstowym. Obsługuje 360p–1080p, do 16 sekund i wiele proporcji obrazu. Przydatne w scenach zespołowych, gdzie wiele referencyjnych bohaterów musi pozostać spójnych.
Interpolacja klatek kluczowych początek–koniec
vidu/q3/start-end-to-video tworzy wideo, interpolując między dwiema klatkami kluczowymi. Poziomy Pro i Turbo również obsługują start-end o długości 1–16 s. Przydatne przy storyboardach w stylu animatiku, gdy masz obrazy początkowy i końcowy.
Wyniki do 16 sekund
Deklaracja z katalogu dla wariantów Pro i reference-to-video: długość 1–16 sekund. Więcej niż 5–8 s oferowane przez wiele konkurencyjnych modeli wideo — przydatne dla pełnych akcentów narracyjnych w jednym generowaniu.
Obraz na wideo w wysokiej rozdzielczości
vidu/q3/image-to-video-pro obsługuje 720p / 1080p / 2K / 4K z obrazów. Przydatne dla wyjścia klasy dostawy bez etapu upscalingu, gdy zaczynasz od obrazu statycznego.
Poziom Pro (najtańszy)
vidu/q3-pro/* to najtańszy poziom Vidu Q3 — przydatny przy pracy na dużą skalę. Obejmuje obraz na wideo, tekst na wideo i start-end-to-video z wynikami 1–16 sekund.
Wskazówki
Wskazówki do promptów dla Vidu Q3
Praktyczne rady, jak uzyskiwać lepsze wyniki z Vidu Q3 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli wideo.
- 01
Wykorzystaj obsługę 1–4 obrazów referencyjnych w scenach z wieloma obiektami
vidu/q3/reference-to-video przyjmuje 1–4 obrazy referencyjne dla spójnych wideo z wieloma obiektami, sterowanych promptem tekstowym. Przydatne w scenach zespołowych, grupowych prezentacjach produktów i storyboardach z wieloma bohaterami.
- 02
Interpolacja klatki początkowej i końcowej w workflow klatek kluczowych
vidu/q3/start-end-to-video łączy dwa obrazy statyczne wygenerowanym ruchem. Szczególnie przydatne w pracy w stylu animatiku, storyboardach opartych na pozach kluczowych i zamianie concept artu w ruch bez ponownego promptowania każdego segmentu.
- 03
Wybierz poziom świadomie
Standard to domyślny poziom dostawy; poziom Pro (wyniki 1–16 sekund) jest pozycjonowany do pracy na dużą skalę; poziom Turbo stawia na szybkość. Sprawdź aktualny koszt poziomów w tabeli cennika na tej stronie — poziom Pro Vidu Q3 jest wyjątkowo konkurencyjny.
- 04
Wyniki do 16 sekund w niektórych wariantach
Deklaracja z katalogu dla wariantów Pro i reference-to-video: długość 1–16 sekund. Więcej niż 5–8 s oferowane przez wiele konkurencyjnych modeli wideo — przydatne dla pełnych akcentów narracyjnych w jednym generowaniu.
- 05
image-to-video-pro dla wyjścia w wysokiej rozdzielczości
vidu/q3/image-to-video-pro obsługuje rozdzielczość 720p / 1080p / 2K / 4K z obrazów. Przydatne dla wyjścia klasy dostawy bez etapu upscalingu, gdy zaczynasz od obrazu statycznego.
Cennik
Cennik API Vidu Q3
Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).
| Endpoint | Typ | Cena początkowa |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Wywołaj API Vidu Q3
Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Porównanie
Vidu Q3 a alternatywy
Kiedy wybrać Vidu Q3 zamiast podobnych modeli w WaveSpeedAI.
Vidu Q3 a Seedance 2.0
Seedance 2.0 oferuje natywną syntezę dźwięku w każdym wariancie i poziom Turbo. Vidu Q3 jest wyraźnie tańszy i oferuje interpolację początek–koniec jako pełnoprawny endpoint, którego Seedance nie ma.
Vidu Q3 a Kling 3.0
Kling 3.0 obejmuje Standard, Pro i 4K z motion control jako pod-endpointem. Vidu Q3 jest tańszy na większości poziomów i oferuje start-end-to-video oraz referencję na wideo (1–4 referencje) jako podstawowe warianty.
Vidu Q3 a Wan 2.7
Wan 2.7 oferuje w jednej rodzinie referencję na wideo, video-edit, video-extend, image-edit i tekst na obraz. Vidu Q3 pozostaje skupiony na generowaniu wideo, z tańszymi poziomami i workflow interpolacji początek–koniec.
FAQ
Vidu Q3 API — najczęściej zadawane pytania
Cennik, licencja, integracja — typowe pytania o uruchamianie Vidu Q3 w WaveSpeedAI.
Czym jest API Vidu Q3?
Vidu Q3 to model generowania wideo od Shengshu, udostępniony jako REST API w WaveSpeedAI. Shengshu Vidu Q3 — tekst na wideo, obraz na wideo, referencja na wideo (1–4 obrazy referencyjne dla spójności wielu obiektów) i start-end-to-video. Trzy poziomy: Standard, Pro, Turbo. W niektórych wariantach wyniki do 16 sekund. Możesz wywoływać go programowo lub wypróbować w playground, do którego prowadzi link powyżej.
Jak wywołać API Vidu Q3?
Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.
Ile kosztuje API Vidu Q3?
Vidu Q3 zaczyna się od $0.15 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.
Jakie warianty Vidu Q3 są dostępne?
WaveSpeedAI udostępnia 13 aktywnych endpointów Vidu Q3: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, i inne. Każdy wariant ma własną stronę playground i cennik.
Czy mogę używać wyników Vidu Q3 komercyjnie?
Prawa do komercyjnego użycia wynikają z licencji modelu Shengshu. Większość modeli Shengshu zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.
Dlaczego korzystać z Vidu Q3 w WaveSpeedAI zamiast bezpośrednio?
Jeden klucz API i jedno konto rozliczeniowe dla Vidu Q3 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API Shengshu lub niższe.
Dostawca
O Shengshu
Zespół stojący za Vidu Q3 i szerszą linią modeli Shengshu w WaveSpeedAI.
Shengshu Technology to chińskie laboratorium AI wywodzące się z Uniwersytetu Tsinghua, stojące za rodziną modeli generowania wideo Vidu. Vidu Q3 oferuje tekst na wideo, obraz na wideo, referencję na wideo (1–4 obrazy referencyjne dla spójności wielu obiektów) i start-end-to-video (interpolacja klatek kluczowych między dwoma obrazami) na poziomach Standard, Pro i Turbo. Niektóre warianty obsługują wyniki do 16 sekund.
Zacznij budować z Vidu Q3 w WaveSpeedAI
Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od Shengshu i wszystkich innych dostawców.