Vidu Q3 API
Shengshu Vidu Q3 — 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video를 제공합니다. Standard, Pro, Turbo의 세 가지 등급이 있으며, 일부 변형은 최대 16초 출력을 지원합니다.
Standard, Pro(1~16초 출력), Turbo(더 빠름) 등급입니다. 레퍼런스-투-비디오는 멀티 엔티티가 일관된 비디오를 위해 1~4장의 레퍼런스 이미지를 받으며, 360p~1080p, 최대 16초를 지원합니다. Start-end-to-video는 두 키프레임을 연결합니다(Pro에서 1~16초). image-to-video-pro 변형은 720p/1080p/2K/4K를 지원합니다.
개요
Vidu Q3 API 소개
Vidu Q3의 기능, Shengshu 모델 라인업에서의 위치, 그리고 팀들이 이 모델을 선택하는 이유.
Shengshu의 비디오 생성 모델 Vidu Q3. WaveSpeedAI REST API로 바로 사용할 수 있습니다. Shengshu Vidu Q3 — 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video를 제공합니다. Standard, Pro, Turbo의 세 가지 등급이 있으며, 일부 변형은 최대 16초 출력을 지원합니다.
Standard, Pro(1~16초 출력), Turbo(더 빠름) 등급입니다. 레퍼런스-투-비디오는 멀티 엔티티가 일관된 비디오를 위해 1~4장의 레퍼런스 이미지를 받으며, 360p~1080p, 최대 16초를 지원합니다. Start-end-to-video는 두 키프레임을 연결합니다(Pro에서 1~16초). image-to-video-pro 변형은 720p/1080p/2K/4K를 지원합니다.
WaveSpeedAI의 Vidu Q3 제품군은 Text-To-Video, Image-To-Video, Reference-To-Video 워크플로를 아우르는 REST 엔드포인트 13개를 제공합니다. 각 변형은 고유한 가격, 파라미터, 예시 출력을 갖고 있으니 입력 방식과 운영 조건에 맞는 것을 고르거나, 같은 API 키로 여러 개를 호출해 다단계 파이프라인을 구성하세요.
Vidu Q3 실행에도 WaveSpeedAI의 다른 1,000개 이상의 AI 모델과 같은 API 키, 결제 계정, 요청 한도 체계를 그대로 사용합니다. 별도의 벤더 설정도, 제공사별 SDK도, 벤더별 요청 한도 체계도 필요 없습니다. 하나의 연동으로 텍스트 → 이미지, 텍스트 → 비디오부터 오디오 합성, 3D 생성, 업스케일링, 편집까지 모두 지원합니다.
엔드포인트
Vidu Q3 API 전체 엔드포인트
Vidu Q3 엔드포인트 13개를 지금 WaveSpeedAI에서 사용할 수 있습니다. 워크플로에 맞는 변형을 고르세요.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
예시
Vidu Q3 활용 예시
Vidu Q3 API로 생성한 실제 출력물입니다. 비디오 위에 마우스를 올리면 미리 보고, 클릭하면 전체 크기 뷰어가 열립니다.
사용 방법
Vidu Q3 API 사용 방법
가입부터 결과물 생성까지 네 단계입니다. Python, Node.js, cURL 전체 예시는 아래 API 섹션에 있습니다.
- 01
API 키 받기
WaveSpeedAI 계정을 만들고 대시보드에서 API 키를 복사하세요. 신규 계정에는 무료 스타터 크레딧이 제공되어, 요금이 청구되기 전에 Playground를 수십 번 실행해 볼 수 있습니다.
- 02
Prediction 제출
입력을 JSON으로 https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video에 POST하세요. 엔드포인트가 prediction id를 즉시 반환합니다. 생성은 비동기로 처리되므로 추론 중에 연결을 계속 열어 둘 필요가 없습니다.
- 03
완료될 때까지 폴링
https://api.wavespeed.ai/api/v3/predictions/{request_id}/result로 GET 요청을 보내세요. completed이면 outputs를 반환하고, failed, cancelled, timeout, deleted이면 오류로 종료하며, 그 밖의 모든 status에서는 폴링을 계속합니다.
- 04
출력 URL 읽기
status가 "completed"가 되면 data.outputs[0]에서 URL을 읽으세요. 이 URL은 WaveSpeedAI CDN에 있는 생성된 미디어를 가리키며, 호출한 Vidu Q3 변형에 따라 이미지, 비디오, 오디오 또는 3D 파일입니다.
활용 사례
Vidu Q3 활용 사례
개발자와 크리에이터가 Vidu Q3 API를 사용하는 대표적인 워크플로입니다.
1~4개의 레퍼런스를 쓰는 레퍼런스-투-비디오
vidu/q3/reference-to-video는 텍스트 프롬프트 가이드와 함께 1~4장의 레퍼런스 이미지로 멀티 엔티티가 일관된 비디오를 생성합니다. 360p~1080p, 최대 16초, 다양한 화면 비율을 지원합니다. 레퍼런스로 지정한 여러 피사체가 일관되게 유지되어야 하는 앙상블 장면에 유용합니다.
시작-종료 키프레임 보간
vidu/q3/start-end-to-video는 두 키프레임 사이를 보간해 비디오를 만듭니다. Pro와 Turbo 등급도 1~16초 길이의 시작-종료를 지원합니다. 시작과 종료 스틸이 있는 애니매틱 스타일 스토리보딩에 유용합니다.
최대 16초 출력
Pro 및 레퍼런스-투-비디오 변형의 카탈로그 설명: 1~16초 길이. 경쟁하는 많은 비디오 모델의 5~8초 범위보다 길어, 한 번의 생성으로 완전한 서사 단위를 담을 때 유용합니다.
고해상도 이미지-투-비디오
vidu/q3/image-to-video-pro는 이미지에서 720p / 1080p / 2K / 4K를 지원합니다. 스틸에서 시작할 때 업스케일링 없이 납품 수준의 출력을 얻을 수 있어 유용합니다.
Pro 등급(가장 저렴)
vidu/q3-pro/*는 가장 저렴한 Vidu Q3 등급으로, 대량 작업에 유용합니다. 1~16초 출력의 이미지-투-비디오, 텍스트-투-비디오, start-end-to-video를 지원합니다.
팁
Vidu Q3 프롬프트 작성 팁
Vidu Q3에서 더 나은 결과를 얻기 위한 실용적인 조언입니다. 운영 파이프라인에서 비디오 모델 전반에 통하는 패턴을 바탕으로 했습니다.
- 01
멀티 엔티티 장면에는 1~4개 레퍼런스 이미지 지원을 활용하세요
vidu/q3/reference-to-video는 텍스트 프롬프트 가이드와 함께 멀티 엔티티가 일관된 비디오를 만들기 위해 1~4장의 레퍼런스 이미지를 받습니다. 앙상블 캐스트 장면, 단체 제품 쇼케이스, 다중 피사체 스토리보드에 유용합니다.
- 02
키프레임 워크플로에는 시작-종료 프레임 보간
vidu/q3/start-end-to-video는 두 스틸 사이를 생성된 모션으로 연결합니다. 애니매틱 스타일 작업, 키 포즈 기반 스토리보딩, 구간마다 프롬프트를 다시 쓰지 않고 콘셉트 아트를 모션으로 이어 붙일 때 특히 유용합니다.
- 03
등급을 의도적으로 고르세요
Standard는 기본 납품 등급이고, Pro 등급(1~16초 출력)은 대량 작업을 위한 포지션이며, Turbo 등급은 속도를 우선합니다. 등급별 현재 비용은 이 페이지의 실시간 가격표를 확인하세요. Vidu Q3의 Pro 등급은 유난히 경쟁력이 있습니다.
- 04
일부 변형은 최대 16초 출력
Pro 및 레퍼런스-투-비디오 변형의 카탈로그 설명: 1~16초 길이. 경쟁하는 많은 비디오 모델의 5~8초 범위보다 길어, 한 번의 생성으로 완전한 서사 단위를 담을 때 유용합니다.
- 05
고해상도 출력에는 image-to-video-pro
vidu/q3/image-to-video-pro는 이미지에서 720p / 1080p / 2K / 4K 해상도를 지원합니다. 스틸에서 시작할 때 업스케일링 없이 납품 수준의 출력을 얻을 수 있어 유용합니다.
가격
Vidu Q3 API 가격
가격은 출력당 책정됩니다. 최종 요금은 각 변형의 Playground에서 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다.
| 엔드포인트 | 유형 | 시작 가격 |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Vidu Q3 API 호출하기
wavespeed.ai/accesskey에서 API 키를 발급받은 뒤 REST로 prediction을 제출하세요. Playground에서 입력 조합별로 바로 붙여넣을 수 있는 샘플이 생성됩니다.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)비교
Vidu Q3 vs 대안
비슷한 WaveSpeedAI 모델과 비교한 Vidu Q3의 선택 기준.
Vidu Q3 vs Seedance 2.0
Seedance 2.0은 모든 변형에서 네이티브 오디오 합성과 Turbo 등급을 제공합니다. Vidu Q3는 눈에 띄게 더 저렴하며, Seedance에는 없는 시작-종료 보간을 핵심 엔드포인트로 제공합니다.
Vidu Q3 vs Kling 3.0
Kling 3.0은 Standard, Pro, 4K를 제공하며 모션 컨트롤은 하위 엔드포인트입니다. Vidu Q3는 대부분의 등급에서 더 저렴하고, start-end-to-video와 레퍼런스-투-비디오(레퍼런스 1~4개)를 핵심 변형으로 제공합니다.
Vidu Q3 vs Wan 2.7
Wan 2.7은 한 패밀리에 레퍼런스-투-비디오, video-edit, video-extend, image-edit, 텍스트-투-이미지를 제공합니다. Vidu Q3는 비디오 생성에 집중하며, 더 저렴한 등급과 시작-종료 보간 워크플로를 제공합니다.
FAQ
Vidu Q3 API — 자주 묻는 질문
가격, 라이선스, 연동 — WaveSpeedAI에서 Vidu Q3 실행에 관한 자주 묻는 질문.
Vidu Q3 API란 무엇인가요?
Vidu Q3 — WaveSpeedAI에서 REST API로 제공되는 Shengshu의 비디오 생성 모델입니다. Shengshu Vidu Q3 — 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video를 제공합니다. Standard, Pro, Turbo의 세 가지 등급이 있으며, 일부 변형은 최대 16초 출력을 지원합니다. 프로그래밍 방식으로 호출하거나 위에 링크된 Playground에서 체험해 볼 수 있습니다.
Vidu Q3 API는 어떻게 호출하나요?
WaveSpeedAI 계정을 만들고 /accesskey에서 API 키를 복사한 뒤, 입력을 JSON으로 https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video에 POST하세요. 엔드포인트가 prediction id를 반환합니다. 결과 엔드포인트 폴링은 약 2초마다 시작하고, 오래 걸리는 작업은 간격을 늘리며, 종료 status가 나오면 중단하세요. 운영 환경용 Python / Node.js / cURL 예시는 위에 있습니다.
Vidu Q3 API 요금은 얼마인가요?
Vidu Q3의 가격은 회당 $0.15부터입니다. 정확한 비용은 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다. Playground의 생성 버튼 옆 실시간 비용 미리보기에서 현재 입력 기준의 정확한 가격을 확인할 수 있습니다.
Vidu Q3에는 어떤 변형이 있나요?
WaveSpeedAI에는 라이브 Vidu Q3 엔드포인트가 13개 있습니다: vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video 외 다수. 각 변형에는 고유한 Playground 페이지와 가격이 있습니다.
Vidu Q3 출력물을 상업적으로 사용할 수 있나요?
상업적 사용 권한은 Shengshu 모델 라이선스를 따릅니다. 대부분의 Shengshu 모델은 출력물의 상업적 사용을 허용합니다. 구체적인 라이선스 요약은 각 모델의 Playground 페이지를, 플랫폼 수준의 조건은 WaveSpeedAI 이용약관을 참고하세요.
직접 연동하지 않고 WaveSpeedAI에서 Vidu Q3 모델을 사용하는 이유는 무엇인가요?
API 키 하나와 결제 계정 하나로 Vidu Q3 모델과 다른 제공사의 1,000개 이상의 AI 모델을 모두 사용합니다. 벤더별 SDK 설정도, 별도의 요청 한도 체계도, 벤더마다 연동 코드를 다시 쓸 일도 없습니다. 가격은 대체로 Shengshu의 직접 API와 같거나 더 저렴합니다.
제공사
Shengshu 소개
WaveSpeedAI의 Vidu Q3 및 Shengshu 전체 모델 라인업을 만든 팀.
Shengshu Technology는 칭화대학교에서 분사한 중국 AI 연구소로, Vidu 비디오 생성 모델 패밀리를 만듭니다. Vidu Q3는 Standard, Pro, Turbo 등급에서 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video(두 스틸 사이의 키프레임 보간)를 제공합니다. 일부 변형은 최대 16초 출력을 지원합니다.
WaveSpeedAI에서 Vidu Q3 시작하기
가입 시 무료 스타터 크레딧 제공. Shengshu 및 다른 모든 제공사의 1,000개 이상 AI 모델을 API 키 하나로.