Vidu Q3 API
Shengshu の Vidu Q3 は、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video に対応します。Standard、Pro、Turbo の3つの階層があり、一部のバリアントでは最長16秒の出力が可能です。
Standard、Pro(1〜16秒の出力)、Turbo(より高速)の階層があります。リファレンスから動画は、1〜4枚の参照画像を受け付け、複数の被写体の一貫性を保った動画を、360p〜1080p、最長16秒で生成します。start-end-to-video は2つのキーフレームをつなぎます(Pro では1〜16秒)。image-to-video-pro バリアントは、720p/1080p/2K/4Kに対応します。
概要
Vidu Q3 APIについて
Vidu Q3でできること、Shengshuのモデルラインナップにおける位置づけ、そして多くのチームに選ばれる理由。
Vidu Q3はShengshuの動画生成モデルで、WaveSpeedAIのREST APIから利用できます。Shengshu の Vidu Q3 は、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video に対応します。Standard、Pro、Turbo の3つの階層があり、一部のバリアントでは最長16秒の出力が可能です。
Standard、Pro(1〜16秒の出力)、Turbo(より高速)の階層があります。リファレンスから動画は、1〜4枚の参照画像を受け付け、複数の被写体の一貫性を保った動画を、360p〜1080p、最長16秒で生成します。start-end-to-video は2つのキーフレームをつなぎます(Pro では1〜16秒)。image-to-video-pro バリアントは、720p/1080p/2K/4Kに対応します。
WaveSpeedAIのVidu Q3ファミリーには、Text-To-Video, Image-To-Video, Reference-To-Videoのワークフローをカバーする13個のRESTエンドポイントがあります。各バリアントには、それぞれ独自の料金、パラメーター、作例があります。入力の種類と本番環境の制約に合うものを選ぶか、同じAPIキーで複数を呼び出して、多段階のパイプラインを組み立ててください。
WaveSpeedAIの他の1,000以上のAIモデルと同じAPIキー、請求アカウント、レート制限の枠組みでVidu Q3を実行できます。ベンダーごとの設定も、プロバイダーごとのSDKも、ベンダーごとのレート制限も不要です。1つの連携で、テキストから画像、テキストから動画から、音声合成、3D生成、高画質化、編集まで、すべてカバーできます。
エンドポイント
Vidu Q3のAPIエンドポイント一覧
WaveSpeedAIで現在利用可能なVidu Q3のエンドポイントは13個です。ワークフローに合ったバリアントを選んでください。
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
作例
Vidu Q3の実力を見る
Vidu Q3 APIで実際に生成された出力です。動画にカーソルを合わせるとプレビュー、クリックすると原寸のビューアで開きます。
使い方
Vidu Q3 APIの使い方
登録から生成完了まで4ステップ。Python、Node.js、cURLの完全なサンプルは、下のAPIセクションにあります。
- 01
APIキーを取得
WaveSpeedAIのアカウントに登録し、ダッシュボードからAPIキーをコピーします。新規アカウントには無料のスタータークレジットが付くので、課金が始まる前にプレイグラウンドを数十回実行できます。
- 02
予測を送信
入力をJSONとしてhttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-videoにPOSTします。エンドポイントはすぐに予測IDを返します。生成は非同期なので、推論中に接続を開いたままにする必要はありません。
- 03
完了までポーリング
https://api.wavespeed.ai/api/v3/predictions/{request_id}/resultにGETします。completedなら出力を返し、failed、cancelled、timeout、deletedならエラーで停止し、それ以外のステータスの間はポーリングを続けます。
- 04
出力URLを読み取る
ステータスが"completed"になったら、data.outputs[0]からURLを読み取ります。URLは、WaveSpeedAIのCDN上にある生成されたメディアを指します。呼び出したVidu Q3のバリアントに応じて、画像、動画、音声、3Dファイルのいずれかです。
活用例
Vidu Q3で作れるもの
開発者やクリエイターがVidu Q3 APIでよく使うワークフロー。
1〜4枚の参照によるリファレンスから動画
vidu/q3/reference-to-video は、1〜4枚の参照画像とテキストプロンプトのガイドから、複数の被写体の一貫性を保った動画を生成します。360p〜1080p、最長16秒、複数のアスペクト比に対応。複数の参照被写体をまとまりよく保ちたいアンサンブルシーンに便利です。
開始・終了キーフレームの補間
vidu/q3/start-end-to-video は、2つのキーフレームの間を補間して動画を作ります。Pro と Turbo の階層も、1〜16秒の長さで開始・終了に対応しています。開始と終了の静止画がある、アニマティック風のストーリーボード作成に便利です。
最長16秒の出力
カタログ上、Pro とリファレンスから動画のバリアントは、1〜16秒の長さに対応しています。競合する多くの動画モデルの5〜8秒の枠より長く、1回の生成で物語の区切りをまるごと作るのに便利です。
高解像度の画像から動画
vidu/q3/image-to-video-pro は、画像から720p / 1080p / 2K / 4Kに対応しています。静止画から始める場合に、アップスケールの工程なしで、納品に使える出力が得られます。
Pro 階層(最も安価)
vidu/q3-pro/* は、Vidu Q3 で最も安価な階層で、大量処理に便利です。画像から動画、テキストから動画、start-end-to-video を、1〜16秒の出力でカバーします。
コツ
Vidu Q3のプロンプトのコツ
Vidu Q3からより良い出力を得るための実践的なアドバイス。本番のパイプラインで動画モデル全般に通用するパターンに基づいています。
- 01
複数の被写体のシーンに、1〜4枚の参照画像のサポートを使う
vidu/q3/reference-to-video は、1〜4枚の参照画像を受け付け、テキストプロンプトのガイドで、複数の被写体の一貫性を保った動画を作ります。アンサンブルキャストのシーン、複数の商品の紹介、複数の被写体のストーリーボードに便利です。
- 02
キーフレームのワークフローには開始・終了フレームの補間を使う
vidu/q3/start-end-to-video は、2枚の静止画の間を、生成したモーションでつなぎます。アニマティック風の作業、キーポーズ主体のストーリーボード、セグメントごとにプロンプトを書き直さずにコンセプトアートをモーションにつなげる場合にとくに便利です。
- 03
階層を意図して選ぶ
Standard は標準的な納品用の階層で、Pro 階層(1〜16秒の出力)は大量処理向け、Turbo 階層は速度を優先します。階層ごとの現在のコストは、このページの料金表で確認してください。Vidu Q3 の Pro 階層は、とくに競争力があります。
- 04
一部のバリアントでは最長16秒の出力
カタログ上、Pro とリファレンスから動画のバリアントは、1〜16秒の長さに対応しています。競合する多くの動画モデルの5〜8秒の枠より長く、1回の生成で物語の区切りをまるごと作るのに便利です。
- 05
高解像度の出力には image-to-video-pro
vidu/q3/image-to-video-pro は、画像から720p / 1080p / 2K / 4Kの解像度に対応しています。静止画から始める場合に、アップスケールの工程なしで、納品に使える出力が得られます。
料金
Vidu Q3 APIの料金
料金は出力ごとです。最終的な請求額は、各バリアントのプレイグラウンドで設定するパラメーター(解像度、長さ、出力数、参照入力)に応じて変わります。
| エンドポイント | タイプ | 最低料金 |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Vidu Q3 APIを呼び出す
wavespeed.ai/accesskeyでAPIキーに登録し、RESTで予測を送信します。プレイグラウンドでは、入力の組み合わせに応じて、そのまま貼り付けられるサンプルが生成されます。
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)比較
Vidu Q3と他モデルの比較
WaveSpeedAI上の類似モデルではなくVidu Q3を選ぶべきケース。
Vidu Q3 vs Seedance 2.0
Seedance 2.0 は、全バリアントと Turbo 階層でネイティブオーディオの合成を備えています。Vidu Q3 は大幅に安価で、Seedance にはない開始・終了の補間を主要なエンドポイントとして備えています。
Vidu Q3 vs Kling 3.0
Kling 3.0 は、Standard、Pro、4K をカバーし、モーションコントロールをサブエンドポイントとして備えています。Vidu Q3 はほとんどの階層で安価で、start-end-to-video とリファレンスから動画(1〜4参照)を中核のバリアントとして備えています。
Vidu Q3 vs Wan 2.7
Wan 2.7 は、同じファミリーに reference-to-video、video-edit、video-extend、image-edit、text-to-image を備えています。Vidu Q3 は動画生成に集中し、より安価な階層と、開始・終了の補間ワークフローを備えています。
FAQ
Vidu Q3 API — よくある質問
料金、ライセンス、連携など、WaveSpeedAIでVidu Q3を実行する際のよくある質問。
Vidu Q3 APIとは何ですか?
Vidu Q3は、Shengshuの動画生成モデルで、WaveSpeedAI上でREST APIとして提供されています。Shengshu の Vidu Q3 は、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video に対応します。Standard、Pro、Turbo の3つの階層があり、一部のバリアントでは最長16秒の出力が可能です。プログラムから呼び出すことも、上にリンクされたプレイグラウンドで試すこともできます。
Vidu Q3 APIはどう呼び出しますか?
WaveSpeedAIのアカウントに登録し、/accesskeyからAPIキーをコピーして、入力をJSONとしてhttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-videoにPOSTします。エンドポイントは予測IDを返します。結果のエンドポイントを約2秒ごとにポーリングし、長時間かかるタスクでは間隔を広げ、終端ステータスになったら停止してください。本番運用向けのPython / Node.js / cURLのサンプルは上にあります。
Vidu Q3 APIの料金はいくらですか?
Vidu Q3は1回あたり$0.15からです。実際の料金は、設定するパラメーター(解像度、長さ、出力数、参照入力)に応じて変わります。プレイグラウンドの「生成」ボタンの横に表示されるリアルタイムの料金プレビューで、現在の入力での正確な料金を確認できます。
Vidu Q3にはどのバリアントがありますか?
WaveSpeedAIでは、13個のVidu Q3エンドポイントが利用可能です:vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-videoほか。各バリアントには、専用のプレイグラウンドページと料金があります。
Vidu Q3の出力を商用利用できますか?
商用利用の権利は、Shengshuのモデルライセンスに従います。Shengshuのほとんどのモデルは出力の商用利用を認めています。具体的なライセンスの概要は各モデルのプレイグラウンドページで、プラットフォーム全体の条件はWaveSpeedAIの利用規約でご確認ください。
なぜ直接ではなくWaveSpeedAIでVidu Q3を使うのですか?
Vidu Q3と、他のプロバイダーの1,000以上のAIモデルを、1つのAPIキー、1つの請求アカウントで利用できます。ベンダーごとのSDK設定も、個別のレート制限も、ベンダーごとの連携コードの書き直しも不要です。料金は、通常Shengshuの直接のAPIと同等かそれ以下です。
提供元
Shengshuについて
WaveSpeedAIにおけるVidu Q3と、Shengshuのモデルラインナップ全体を手がけるチーム。
Shengshu Technology は、清華大学発の中国のAIラボで、動画生成モデルの Vidu ファミリーを開発しています。Vidu Q3 は、Standard、Pro、Turbo の階層で、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video(2枚の静止画の間のキーフレーム補間)を提供します。一部のバリアントは、最長16秒の出力に対応しています。
WaveSpeedAIでVidu Q3を使った開発を始めよう
登録時に無料のスタータークレジットを進呈。Shengshuをはじめ、あらゆるプロバイダーの1,000以上のAIモデルを、1つのAPIキーで。