Vidu Q3 API
生数科技 Vidu Q3——文生视频、图生视频、参考生视频(1-4 张参考图像,保持多主体一致性)和首尾帧生视频。三个档位:Standard、Pro、Turbo。部分变体最长可输出 16 秒。
Standard、Pro(1-16 秒输出)和 Turbo(更快)档位。参考生视频接受 1-4 张参考图像,可生成多主体一致的视频,分辨率 360p-1080p,最长 16 秒。首尾帧生视频可衔接两个关键帧(Pro 为 1-16 秒)。image-to-video-pro 变体支持 720p/1080p/2K/4K。
概览
关于 Vidu Q3 API
Vidu Q3 能做什么、它在 Shengshu 模型阵容中的定位,以及团队选择它的原因。
Vidu Q3 是 Shengshu 推出的视频生成模型,可通过 WaveSpeedAI REST API 使用。生数科技 Vidu Q3——文生视频、图生视频、参考生视频(1-4 张参考图像,保持多主体一致性)和首尾帧生视频。三个档位:Standard、Pro、Turbo。部分变体最长可输出 16 秒。
Standard、Pro(1-16 秒输出)和 Turbo(更快)档位。参考生视频接受 1-4 张参考图像,可生成多主体一致的视频,分辨率 360p-1080p,最长 16 秒。首尾帧生视频可衔接两个关键帧(Pro 为 1-16 秒)。image-to-video-pro 变体支持 720p/1080p/2K/4K。
WaveSpeedAI 上的 Vidu Q3 系列提供 13 个 REST 端点,涵盖 Text-To-Video, Image-To-Video, Reference-To-Video 个工作流。每个变体都有各自的定价、参数选项和示例输出——请选择与你的输入模态和生产约束相匹配的那一个,或使用同一个 API 密钥调用多个变体,组合成多步骤流水线。
使用与 WaveSpeedAI 上其他 1,000 多个 AI 模型相同的 API 密钥、账单账户和速率限制来运行 Vidu Q3。无需单独对接供应商,无需各家 SDK,也无需应对各家不同的速率限制——一次集成即可覆盖从文生图、文生视频到音频合成、3D 生成、放大和编辑的全部能力。
端点
全部 Vidu Q3 API 端点
WaveSpeedAI 现已提供 13 个 Vidu Q3 端点——请选择适合你工作流的变体。
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
示例
看看 Vidu Q3 的实际效果
由 Vidu Q3 API 生成的真实输出。悬停在任意视频上即可预览,点击可打开全尺寸查看器。
使用方法
如何使用 Vidu Q3 API
从注册到完成一次生成,只需四步。完整的 Python、Node.js 和 cURL 示例见下方的 API 部分。
- 01
获取 API 密钥
注册 WaveSpeedAI 账号,并从控制台复制你的 API 密钥。新账号附带免费体验额度——足够在开始计费前把 Playground 运行几十次。
- 02
提交预测
把你的输入以 JSON 形式 POST 到 https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video。端点会立即返回预测 ID——生成是异步的,因此推理期间你无需保持连接。
- 03
轮询完成状态
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result。状态为 completed 时返回输出;状态为 failed、cancelled、timeout 或 deleted 时以错误终止;其他任何状态都继续轮询。
- 04
读取输出 URL
状态变为 "completed" 后,从 data.outputs[0] 读取 URL。该 URL 指向 WaveSpeedAI CDN 上你生成的媒体——具体是图片、视频、音频还是 3D 文件,取决于你调用的 Vidu Q3 变体。
应用场景
用 Vidu Q3 可以构建什么
开发者和创作者使用 Vidu Q3 API 的常见工作流。
支持 1-4 个参考的参考生视频
vidu/q3/reference-to-video 根据 1-4 张参考图像和文本提示词引导,生成多主体一致的视频。支持 360p-1080p,最长 16 秒,提供多种画幅比例。适合需要多个参考主体保持连贯的群像场景。
首尾关键帧插值
vidu/q3/start-end-to-video 通过在两个关键帧之间插值来生成视频。Pro 和 Turbo 档位的首尾帧也支持 1-16 秒时长。适合已有起止静态图的动态分镜式故事板。
最长 16 秒的输出
目录中对 Pro 和参考生视频变体的宣称:1-16 秒时长。比许多竞品视频模型 5-8 秒的范围更长——适合在一次生成中完成完整的叙事节拍。
高分辨率图生视频
vidu/q3/image-to-video-pro 支持从图像生成 720p / 1080p / 2K / 4K 的视频。从静态图起步时,无需放大步骤即可得到交付级输出。
Pro 档位(最便宜)
vidu/q3-pro/* 是 Vidu Q3 中最便宜的档位——适合大批量工作。涵盖图生视频、文生视频和首尾帧生视频,输出时长 1-16 秒。
技巧
Vidu Q3 提示词技巧
让 Vidu Q3 输出更好结果的实用建议——总结自生产流水线中各类视频模型都适用的做法。
- 01
多主体场景使用 1-4 张参考图像
vidu/q3/reference-to-video 接受 1-4 张参考图像,并在文本提示词引导下生成多主体一致的视频。适合群像场景、集体产品展示和多主体分镜。
- 02
关键帧工作流使用首尾帧插值
vidu/q3/start-end-to-video 用生成的运动衔接两张静态图。特别适合动态分镜式工作、基于关键姿势的故事板,以及把概念图拼接成动态画面,而无需为每一段重新写提示词。
- 03
有意识地选择档位
Standard 是默认的交付档位;Pro 档位(1-16 秒输出)定位于大批量工作;Turbo 档位优先考虑速度。请查看本页的实时价格表了解各档位当前的单次成本——Vidu Q3 的 Pro 档位竞争力非常突出。
- 04
部分变体最长可输出 16 秒
目录中对 Pro 和参考生视频变体的宣称:1-16 秒时长。比许多竞品视频模型 5-8 秒的范围更长——适合在一次生成中完成完整的叙事节拍。
- 05
image-to-video-pro 用于高分辨率输出
vidu/q3/image-to-video-pro 支持从图像生成 720p / 1080p / 2K / 4K 的视频。从静态图起步时,无需放大步骤即可得到交付级输出。
定价
Vidu Q3 API 定价
按输出计费。最终费用会随你在各变体 Playground 中设置的参数(分辨率、时长、输出数量、参考素材)而变化。
| 端点 | 类型 | 起步价 |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
调用 Vidu Q3 API
在 wavespeed.ai/accesskey 注册并获取 API 密钥,然后通过 REST 提交预测。Playground 可以为任意输入组合生成可直接粘贴的示例代码。
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)对比
Vidu Q3 与其他方案对比
在 WaveSpeedAI 上,何时应选择 Vidu Q3 而不是同类模型。
Vidu Q3 对比 Seedance 2.0
Seedance 2.0 每个变体都带原生音频合成,并有 Turbo 档位。Vidu Q3 明显更便宜,并把首尾帧插值作为一等端点,这是 Seedance 所没有的。
Vidu Q3 对比 Kling 3.0
Kling 3.0 涵盖 Standard、Pro 和 4K,运动控制为子端点。Vidu Q3 大多数档位更便宜,并把首尾帧生视频和参考生视频(1-4 个参考)作为核心变体。
Vidu Q3 对比 Wan 2.7
Wan 2.7 在同一系列中提供参考生视频、视频编辑、视频延长、图像编辑和文生图。Vidu Q3 则专注于视频生成,价格档位更便宜,并有首尾帧插值工作流。
常见问题
Vidu Q3 API — 常见问题
定价、许可、集成——关于在 WaveSpeedAI 上运行 Vidu Q3 的常见问题。
Vidu Q3 API 是什么?
Vidu Q3 是 Shengshu 的视频生成模型,在 WaveSpeedAI 上以 REST API 形式提供。生数科技 Vidu Q3——文生视频、图生视频、参考生视频(1-4 张参考图像,保持多主体一致性)和首尾帧生视频。三个档位:Standard、Pro、Turbo。部分变体最长可输出 16 秒。你可以通过编程方式调用它,也可以在上方链接的 Playground 中试用。
如何调用 Vidu Q3 API?
注册 WaveSpeedAI 账号,从 /accesskey 复制你的 API 密钥,然后把输入以 JSON 形式 POST 到 https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video。端点会返回预测 ID。从大约每 2 秒一次开始轮询结果端点,长耗时任务可适当拉长间隔,并在任何终止状态时停止。上方有面向生产环境的 Python / Node.js / cURL 示例。
Vidu Q3 API 的费用是多少?
Vidu Q3 每次调用 $0.15 起。实际费用会随你设置的参数(分辨率、时长、输出数量、参考素材)而变化。Playground 中“生成”按钮旁的实时费用预览会显示你当前输入对应的准确价格。
有哪些 Vidu Q3 变体可用?
WaveSpeedAI 托管了 13 个已上线的 Vidu Q3 端点:vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video等。每个变体都有自己的 Playground 页面和定价。
Vidu Q3 的输出可以商用吗?
商用权利遵循 Shengshu 的模型许可。大多数 Shengshu 模型允许商用输出;具体许可摘要请查看各模型的 Playground 页面,平台层面的条件请参阅 WaveSpeedAI 的服务条款。
为什么要在 WaveSpeedAI 上使用 Vidu Q3,而不是直接对接?
一个 API 密钥、一个账单账户,即可使用 Vidu Q3 以及来自其他提供方的 1,000 多个 AI 模型。无需逐家配置 SDK,无需应对各自独立的速率限制,也无需为每家重写集成代码。价格通常与 Shengshu 直接提供的 API 持平或更低。
提供方
关于 Shengshu
Vidu Q3 及 WaveSpeedAI 上 Shengshu 更多模型背后的团队。
生数科技是从清华大学孵化出来的中国 AI 实验室,也是 Vidu 系列视频生成模型背后的团队。Vidu Q3 在 Standard、Pro 和 Turbo 档位上提供文生视频、图生视频、参考生视频(1-4 张参考图像,保持多主体一致性)和首尾帧生视频(在两张静态图之间做关键帧插值)。部分变体最长可输出 16 秒。
在 WaveSpeedAI 上用 Vidu Q3 开始构建
注册即送免费体验额度。一个 API 密钥,即可使用来自 Shengshu 及其他所有提供方的 1,000 多个 AI 模型。