Vidu Q4 API
Shengshu Vidu Q4 — 3~16초 클립, 540p~4K 출력, 선택형 오디오 생성을 갖춘 이미지-투-비디오와 레퍼런스-투-비디오를 제공합니다. 레퍼런스-투-비디오는 한 번의 요청으로 최대 12장의 레퍼런스 이미지와 최대 3개의 레퍼런스 오디오 클립을 받습니다.
두 가지 엔드포인트: vidu/q4-preview/image-to-video는 이미지 한 장에 움직임을 더하고, vidu/q4-preview/reference-to-video는 프롬프트와 최대 12장의 레퍼런스 이미지, 3개의 레퍼런스 오디오 클립으로 장면을 구성합니다. 둘 다 3~16초 사이의 모든 정수 초 길이, 540p부터 4K까지 다섯 가지 해상도, 오디오 켜기/끄기를 지원합니다.
개요
Vidu Q4 API 소개
Vidu Q4의 기능, Shengshu 모델 라인업에서의 위치, 그리고 팀들이 이 모델을 선택하는 이유.
Shengshu의 비디오 생성 모델 Vidu Q4. WaveSpeedAI REST API로 바로 사용할 수 있습니다. Shengshu Vidu Q4 — 3~16초 클립, 540p~4K 출력, 선택형 오디오 생성을 갖춘 이미지-투-비디오와 레퍼런스-투-비디오를 제공합니다. 레퍼런스-투-비디오는 한 번의 요청으로 최대 12장의 레퍼런스 이미지와 최대 3개의 레퍼런스 오디오 클립을 받습니다.
두 가지 엔드포인트: vidu/q4-preview/image-to-video는 이미지 한 장에 움직임을 더하고, vidu/q4-preview/reference-to-video는 프롬프트와 최대 12장의 레퍼런스 이미지, 3개의 레퍼런스 오디오 클립으로 장면을 구성합니다. 둘 다 3~16초 사이의 모든 정수 초 길이, 540p부터 4K까지 다섯 가지 해상도, 오디오 켜기/끄기를 지원합니다.
WaveSpeedAI의 Vidu Q4 제품군은 Reference-To-Video, Image-To-Video 워크플로를 아우르는 REST 엔드포인트 2개를 제공합니다. 각 변형은 고유한 가격, 파라미터, 예시 출력을 갖고 있으니 입력 방식과 운영 조건에 맞는 것을 고르거나, 같은 API 키로 여러 개를 호출해 다단계 파이프라인을 구성하세요.
Vidu Q4 실행에도 WaveSpeedAI의 다른 1,000개 이상의 AI 모델과 같은 API 키, 결제 계정, 요청 한도 체계를 그대로 사용합니다. 별도의 벤더 설정도, 제공사별 SDK도, 벤더별 요청 한도 체계도 필요 없습니다. 하나의 연동으로 텍스트 → 이미지, 텍스트 → 비디오부터 오디오 합성, 3D 생성, 업스케일링, 편집까지 모두 지원합니다.
사양
Vidu Q4 API 기능 및 출시 현황
API를 고르기 전에 개발자가 찾아보는 모델별 세부 정보입니다. 제공 여부, 예상 출력 길이, 레퍼런스 지원, 현재 사용 가능한 대체 모델을 담았습니다.
엔드포인트
2개 변형
이미지-투-비디오와 레퍼런스-투-비디오.
길이
3~16초
모든 정수 초 단위 가능, 기본값은 5초입니다.
해상도
540p~4K
540p, 720p, 1080p, 2K, 4K, 기본값은 720p입니다.
레퍼런스
이미지 12장 + 오디오 3개
레퍼런스-투-비디오에서 텍스트 프롬프트와 함께 사용합니다.
엔드포인트
Vidu Q4 API 전체 엔드포인트
Vidu Q4 엔드포인트 2개를 지금 WaveSpeedAI에서 사용할 수 있습니다. 워크플로에 맞는 변형을 고르세요.
/filters:quality(82)/media/images/1790656175314160249_JiSjQ9AW.webp)
Q4 Preview Reference To Video
Vidu Q4 Reference-to-Video generates subject-consistent AI videos from text prompts, 1-12 reference images, and up to 3 reference audio clips, supporting character consistency, product videos, social content, brand assets, and reference-guided storytelling workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790656159881988529_32y4wP0a.webp)
Q4 Preview Image To Video
Vidu Q4 Image-to-Video animates a single reference image into high-quality AI video with prompt-guided motion, optional audio, 3-16 second duration, and output resolutions from 540P to 4K for product animation, social content, marketing creatives, cinematic visuals, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
예시
Vidu Q4 활용 예시
Vidu Q4 API로 생성한 실제 출력물입니다. 비디오 위에 마우스를 올리면 미리 보고, 클릭하면 전체 크기 뷰어가 열립니다.
사용 방법
Vidu Q4 API 사용 방법
가입부터 결과물 생성까지 네 단계입니다. Python, Node.js, cURL 전체 예시는 아래 API 섹션에 있습니다.
- 01
API 키 받기
WaveSpeedAI 계정을 만들고 대시보드에서 API 키를 복사하세요. 신규 계정에는 무료 스타터 크레딧이 제공되어, 요금이 청구되기 전에 Playground를 수십 번 실행해 볼 수 있습니다.
- 02
Prediction 제출
입력을 JSON으로 https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video에 POST하세요. 엔드포인트가 prediction id를 즉시 반환합니다. 생성은 비동기로 처리되므로 추론 중에 연결을 계속 열어 둘 필요가 없습니다.
- 03
완료될 때까지 폴링
https://api.wavespeed.ai/api/v3/predictions/{request_id}/result로 GET 요청을 보내세요. completed이면 outputs를 반환하고, failed, cancelled, timeout, deleted이면 오류로 종료하며, 그 밖의 모든 status에서는 폴링을 계속합니다.
- 04
출력 URL 읽기
status가 "completed"가 되면 data.outputs[0]에서 URL을 읽으세요. 이 URL은 WaveSpeedAI CDN에 있는 생성된 미디어를 가리키며, 호출한 Vidu Q4 변형에 따라 이미지, 비디오, 오디오 또는 3D 파일입니다.
활용 사례
Vidu Q4 활용 사례
개발자와 크리에이터가 Vidu Q4 API를 사용하는 대표적인 워크플로입니다.
사진 한 장으로 만드는 제품 애니메이션
vidu/q4-preview/image-to-video는 제품 사진 한 장을 프로모션 클립으로 바꿉니다. 원하는 카메라 무브와 움직임을 설명하면, 이미지가 시각적 기준점으로 유지됩니다.
모습이 흔들리지 않는 캐릭터
vidu/q4-preview/reference-to-video는 최대 12장의 레퍼런스 이미지를 받으므로, 반복 등장하는 캐릭터, 마스코트, 대변인을 여러 각도에서 보여 주면서도 클립마다 알아볼 수 있게 유지합니다.
사운드로 이끄는 장면
audios 필드로 이미지와 함께 최대 3개의 레퍼런스 오디오 클립을 추가하고, generate_audio를 켜 두면 한 번의 호출로 사운드가 포함된 클립을 얻을 수 있습니다.
바로 납품 가능한 4K
두 엔드포인트 모두 540p, 720p, 1080p, 2K, 4K로 출력합니다. 540p나 720p로 초안을 만든 뒤, 승인된 프롬프트를 납품 해상도로 다시 실행하면 별도의 업스케일링 단계가 필요 없습니다.
모든 소셜 포맷 대응
레퍼런스-투-비디오는 16:9, 9:16, 1:1, 3:4, 4:3으로 렌더링해, 같은 레퍼런스로 YouTube, Reels, Shorts, 피드 게시물, 제품 페이지까지 모두 커버합니다.
비트에 맞춘 클립 길이
길이는 3~16초 사이의 모든 정수 초로 설정할 수 있어, 3초 루프, 6초 범퍼, 15초 스팟을 모두 같은 엔드포인트에서 만들 수 있습니다.
팁
Vidu Q4 프롬프트 작성 팁
Vidu Q4에서 더 나은 결과를 얻기 위한 실용적인 조언입니다. 운영 파이프라인에서 비디오 모델 전반에 통하는 패턴을 바탕으로 했습니다.
- 01
깨끗하고 조명이 좋은 소스 이미지를 사용하세요
vidu/q4-preview/image-to-video에서는 이미지가 피사체, 구도, 스타일을 결정합니다. 피사체가 하나로 분명한 선명한 이미지를 고르고, 이미 보이는 내용을 다시 설명하기보다 프롬프트로 움직임과 카메라 연출을 지시하세요.
- 02
레퍼런스마다 역할을 주세요
vidu/q4-preview/reference-to-video에서는 캐릭터, 제품, 배경처럼 장면에 실제로 필요한 레퍼런스를 사용하고, 각각이 어떻게 등장해야 하는지 프롬프트에 적으세요. 관련성이 낮은 이미지를 느슨하게 보내는 것은 피하세요.
- 03
동작의 양을 길이에 맞추세요
클립 길이에 맞는 양의 동작을 요청하세요. 3~5초 클립에는 하나의 움직임이나 제스처가 어울리며, 여러 단계의 동작은 10~16초에 맡기세요.
- 04
초안은 낮게, 납품은 높게
540p나 720p의 짧은 길이로 아이디어를 탐색한 뒤, 선택한 프롬프트를 1080p, 2K, 4K로 다시 실행해 납품하세요.
- 05
오디오와 프롬프트 재작성 여부는 미리 정하세요
generate_audio는 기본적으로 켜져 있으니, 직접 사운드트랙을 넣을 경우 끄세요. 이미지-투-비디오에서 프롬프트를 작성한 그대로 사용하려면 enable_prompt_expansion을 false로 설정하세요.
가격
Vidu Q4 API 가격
가격은 출력당 책정됩니다. 최종 요금은 각 변형의 Playground에서 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다.
| 엔드포인트 | 유형 | 시작 가격 |
|---|---|---|
| vidu/ | reference-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
API
Vidu Q4 API 호출하기
wavespeed.ai/accesskey에서 API 키를 발급받은 뒤 REST로 prediction을 제출하세요. Playground에서 입력 조합별로 바로 붙여넣을 수 있는 샘플이 생성됩니다.
POSThttps://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": true,
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"resolution": "720p",
"duration": 5,
"enable_prompt_expansion": True,
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)비교
Vidu Q4 vs 대안
비슷한 WaveSpeedAI 모델과 비교한 Vidu Q4의 선택 기준.
Vidu Q4 vs Vidu Q3
Vidu Q3 레퍼런스-투-비디오는 1~4장의 레퍼런스 이미지를 받지만, Q4는 최대 12장의 이미지와 최대 3개의 오디오 레퍼런스를 받으며 Q4의 두 엔드포인트 모두 4K까지 지원합니다. 텍스트-투-비디오, 시작-종료 키프레임 보간, Pro 및 Turbo 등급이 필요하다면 여전히 Q3가 적합합니다.
Vidu Q4 vs Seedance 2.5
Seedance 2.5는 최대 30초의 싱글 샷을 지원하며 비디오 편집 및 연장 엔드포인트를 추가로 제공합니다. Vidu Q4는 최대 4K 출력으로 이미지와 레퍼런스 기반 생성에 집중합니다.
Vidu Q4 vs Wan 3.0
Wan 3.0은 최대 30초, 최대 1080p의 텍스트-, 이미지-, 레퍼런스-투-비디오를 제공합니다. Vidu Q4는 최대 16초이지만 2K 및 4K 출력과 최대 12장의 레퍼런스 이미지를 지원합니다.
FAQ
Vidu Q4 API — 자주 묻는 질문
가격, 라이선스, 연동 — WaveSpeedAI에서 Vidu Q4 실행에 관한 자주 묻는 질문.
Vidu Q4 API란 무엇인가요?
Vidu Q4 — WaveSpeedAI에서 REST API로 제공되는 Shengshu의 비디오 생성 모델입니다. Shengshu Vidu Q4 — 3~16초 클립, 540p~4K 출력, 선택형 오디오 생성을 갖춘 이미지-투-비디오와 레퍼런스-투-비디오를 제공합니다. 레퍼런스-투-비디오는 한 번의 요청으로 최대 12장의 레퍼런스 이미지와 최대 3개의 레퍼런스 오디오 클립을 받습니다. 프로그래밍 방식으로 호출하거나 위에 링크된 Playground에서 체험해 볼 수 있습니다.
Vidu Q4 API는 어떻게 호출하나요?
WaveSpeedAI 계정을 만들고 /accesskey에서 API 키를 복사한 뒤, 입력을 JSON으로 https://api.wavespeed.ai/api/v3/vidu/q4-preview/image-to-video에 POST하세요. 엔드포인트가 prediction id를 반환합니다. 결과 엔드포인트 폴링은 약 2초마다 시작하고, 오래 걸리는 작업은 간격을 늘리며, 종료 status가 나오면 중단하세요. 운영 환경용 Python / Node.js / cURL 예시는 위에 있습니다.
Vidu Q4 API 요금은 얼마인가요?
Vidu Q4의 가격은 회당 $0.25부터입니다. 정확한 비용은 설정한 파라미터(해상도, 길이, 출력 수, 레퍼런스)에 따라 달라집니다. Playground의 생성 버튼 옆 실시간 비용 미리보기에서 현재 입력 기준의 정확한 가격을 확인할 수 있습니다.
Vidu Q4에는 어떤 변형이 있나요?
WaveSpeedAI에는 라이브 Vidu Q4 엔드포인트가 2개 있습니다: vidu/q4-preview/reference-to-video, vidu/q4-preview/image-to-video. 각 변형에는 고유한 Playground 페이지와 가격이 있습니다.
Vidu Q4 출력물을 상업적으로 사용할 수 있나요?
상업적 사용 권한은 Shengshu 모델 라이선스를 따릅니다. 대부분의 Shengshu 모델은 출력물의 상업적 사용을 허용합니다. 구체적인 라이선스 요약은 각 모델의 Playground 페이지를, 플랫폼 수준의 조건은 WaveSpeedAI 이용약관을 참고하세요.
직접 연동하지 않고 WaveSpeedAI에서 Vidu Q4 모델을 사용하는 이유는 무엇인가요?
API 키 하나와 결제 계정 하나로 Vidu Q4 모델과 다른 제공사의 1,000개 이상의 AI 모델을 모두 사용합니다. 벤더별 SDK 설정도, 별도의 요청 한도 체계도, 벤더마다 연동 코드를 다시 쓸 일도 없습니다. 가격은 대체로 Shengshu의 직접 API와 같거나 더 저렴합니다.
제공사
Shengshu 소개
WaveSpeedAI의 Vidu Q4 및 Shengshu 전체 모델 라인업을 만든 팀.
Shengshu Technology는 칭화대학교에서 분사한 중국 AI 연구소로, Vidu 비디오 생성 모델 패밀리를 만듭니다. 최신 세대인 Vidu Q4는 최대 12장의 레퍼런스 이미지, 최대 3개의 레퍼런스 오디오 클립, 최대 4K 출력을 지원하는 이미지-투-비디오와 레퍼런스-투-비디오를 추가했습니다. Vidu Q3는 Standard, Pro, Turbo 등급에서 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video(두 스틸 사이의 키프레임 보간)를 제공합니다. 일부 변형은 최대 16초 출력을 지원합니다.
WaveSpeedAI에서 Vidu Q4 시작하기
가입 시 무료 스타터 크레딧 제공. Shengshu 및 다른 모든 제공사의 1,000개 이상 AI 모델을 API 키 하나로.