Kling 3.0 API
Kuaishou の Kling 3.0 は、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト追従性、ネイティブオーディオを備えた、テキストから動画と画像から動画に対応します。Standard、Pro、4K の3つの階層があります。
Standard 階層は標準的な納品向け、Pro 階層は最高品質向け、4K 階層は、マルチプロンプトと開始/終了フレームの制御を備えた4K納品向けです。別のモーションコントロールエンドポイント(Std / Pro)では、参照動画からモーションを転送します。
概要
Kling 3.0 APIについて
Kling 3.0でできること、Kuaishouのモデルラインナップにおける位置づけ、そして多くのチームに選ばれる理由。
Kling 3.0はKuaishouの動画生成モデルで、WaveSpeedAIのREST APIから利用できます。Kuaishou の Kling 3.0 は、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト追従性、ネイティブオーディオを備えた、テキストから動画と画像から動画に対応します。Standard、Pro、4K の3つの階層があります。
Standard 階層は標準的な納品向け、Pro 階層は最高品質向け、4K 階層は、マルチプロンプトと開始/終了フレームの制御を備えた4K納品向けです。別のモーションコントロールエンドポイント(Std / Pro)では、参照動画からモーションを転送します。
WaveSpeedAIのKling 3.0ファミリーには、Text-To-Video, Motion-Control, Image-To-Videoのワークフローをカバーする8個のRESTエンドポイントがあります。各バリアントには、それぞれ独自の料金、パラメーター、作例があります。入力の種類と本番環境の制約に合うものを選ぶか、同じAPIキーで複数を呼び出して、多段階のパイプラインを組み立ててください。
WaveSpeedAIの他の1,000以上のAIモデルと同じAPIキー、請求アカウント、レート制限の枠組みでKling 3.0を実行できます。ベンダーごとの設定も、プロバイダーごとのSDKも、ベンダーごとのレート制限も不要です。1つの連携で、テキストから画像、テキストから動画から、音声合成、3D生成、高画質化、編集まで、すべてカバーできます。
エンドポイント
Kling 3.0のAPIエンドポイント一覧
WaveSpeedAIで現在利用可能なKling 3.0のエンドポイントは8個です。ワークフローに合ったバリアントを選んでください。
/filters:quality(82)/media/images/1777710010082553282_8zsCLV4e.webp)
Kling v3.0 4k Text To Video
Kling V3.0 4K delivers top-tier 4K text-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and optional audio. Supports flexible aspect ratios, multi-prompt, and element references. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408113003_zrzrvv9r.webp)
Kling v3.0 Pro Text To Video
Kling 3.0 Pro delivers top-tier text-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and native audio for ready-to-share clips. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408113047_z025e0td.webp)
Kling v3.0 Std Text To Video
Kling 3.0 Standard delivers high-quality text-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and native audio for ready-to-share clips. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408113043_9bp6l97o.webp)
Kling v3.0 Std Motion Control
Kling 3.0 Standard Motion Control transfers motion from reference videos to animate still images. Upload a character image and a motion clip (dance, action, gesture), and the model extracts the movement to generate smooth, realistic video. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408113000_4lxan5i2.webp)
Kling v3.0 Pro Motion Control
Kling 3.0 Standard Motion Control transfers motion from reference videos to animate still images. Upload a character image and a motion clip (dance, action, gesture), and the model extracts the movement to generate smooth, realistic video. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1777710020485474221_JjDMV5Z8.webp)
Kling v3.0 4k Image To Video
Kling V3.0 4K delivers top-tier 4K image-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and optional audio. Supports start/end frame control, multi-prompt, and element references. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408112956_u1xy8vi4.webp)
Kling v3.0 Pro Image To Video
Kling 3.0 Pro delivers top-tier image-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and native audio for ready-to-share clips. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/20260408113039_z1f0f3iw.webp)
Kling v3.0 Std Image To Video
Kling 3.0 Standard delivers high-quality image-to-video generation with smooth motion, cinematic visuals, accurate prompt adherence, and native audio for ready-to-share clips. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
作例
Kling 3.0の実力を見る
Kling 3.0 APIで実際に生成された出力です。動画にカーソルを合わせるとプレビュー、クリックすると原寸のビューアで開きます。
使い方
Kling 3.0 APIの使い方
登録から生成完了まで4ステップ。Python、Node.js、cURLの完全なサンプルは、下のAPIセクションにあります。
- 01
APIキーを取得
WaveSpeedAIのアカウントに登録し、ダッシュボードからAPIキーをコピーします。新規アカウントには無料のスタータークレジットが付くので、課金が始まる前にプレイグラウンドを数十回実行できます。
- 02
予測を送信
入力をJSONとしてhttps://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-videoにPOSTします。エンドポイントはすぐに予測IDを返します。生成は非同期なので、推論中に接続を開いたままにする必要はありません。
- 03
完了までポーリング
https://api.wavespeed.ai/api/v3/predictions/{request_id}/resultにGETします。completedなら出力を返し、failed、cancelled、timeout、deletedならエラーで停止し、それ以外のステータスの間はポーリングを続けます。
- 04
出力URLを読み取る
ステータスが"completed"になったら、data.outputs[0]からURLを読み取ります。URLは、WaveSpeedAIのCDN上にある生成されたメディアを指します。呼び出したKling 3.0のバリアントに応じて、画像、動画、音声、3Dファイルのいずれかです。
活用例
Kling 3.0で作れるもの
開発者やクリエイターがKling 3.0 APIでよく使うワークフロー。
ネイティブオーディオ付きのテキストから動画
kwaivgi/kling-v3.0-std/text-to-video は、滑らかなモーション、シネマティックなビジュアル、ネイティブオーディオを備え、すぐ共有できるクリップを作れます。納品作業向けの、Kling の標準的なバリアントです。
画像から動画のアニメーション
kwaivgi/kling-v3.0-std/image-to-video は、テキストから動画のバリアントと同じオーディオとモーションの特性で、静止画をアニメーション化します。
最高品質のための Pro 階層
kwaivgi/kling-v3.0-pro/text-to-video と image-to-video は、最高水準の出力のために Standard に33%上乗せした料金です。Std と Pro で、同じプロンプト形式が使えます。
マルチプロンプトと開始/終了制御を備えた4K階層
kwaivgi/kling-v3.0-4k/text-to-video と image-to-video は、最高水準の4K生成です。開始/終了フレームの制御とマルチプロンプトに対応しています。4K階層のコストは、Standard 階層のおよそ5倍です。
モーションコントロール(別のエンドポイント)
kwaivgi/kling-v3.0-std/motion-control と pro/motion-control は、参照動画からモーションを転送し、静止したキャラクター画像をアニメーション化します。モーションキャプチャなしで、ダンス、アクション、ジェスチャーを再現できます。
全階層でのネイティブオーディオ
sound パラメーターにより、Kling 3.0 は Std、Pro、4K の全階層でネイティブのオーディオ合成を利用できます。別のオーディオモデルを選ぶ代わりに、生成ごとにオン/オフを切り替えられます。オーディオは1回あたりのコストに加算されるため、あとで音声を追加する予定ならオフにしてください。
コツ
Kling 3.0のプロンプトのコツ
Kling 3.0からより良い出力を得るための実践的なアドバイス。本番のパイプラインで動画モデル全般に通用するパターンに基づいています。
- 01
適切な階層(Standard / Pro / 4K)を選ぶ
Standard は、標準的な納品品質の階層です。Pro は、Standard より33%高いプレミアム品質の階層です。4K は最上位の階層で、大幅に高価ですが、下位の階層にはない開始/終了フレームの制御とマルチプロンプトを備えています。
- 02
ネイティブオーディオはオン/オフを切り替えられる
sound パラメーターは、Kling 3.0 のバリアント全体で公開されています。同期された音声つきですぐ共有できるクリップが必要なときはオンに、あとでオーディオを追加するときはオフにしてください。
- 03
4K階層には開始/終了フレームの制御がある
kwaivgi/kling-v3.0-4k/* は、Standard や Pro 階層にはない、開始/終了フレームの制御とマルチプロンプトの機能に対応しています。生成するクリップをキーフレーム単位で制御したいときは、4K を選んでください。
- 04
モーションコントロールは別のサブエンドポイント
参照クリップから特定のモーションを、静止したキャラクター画像に転送したいときは、kwaivgi/kling-v3.0-std/motion-control(または Pro 版)に切り替えます。標準の Kling 3.0 はもっともらしいモーションを生成し、モーションコントロールは参照からその特定のモーションを再現します。
- 05
精密なカメラ表現が必要な作業に Kling は使わない
具体的な撮影用語(anamorphic、crane、jib、dolly-zoom)は、Seedance 2.0 や Veo 3.1 のほうがきれいに反映されます。Kling 3.0 は、品質階層とモーションコントロールのサブエンドポイントのために使い、精密なカメラ制御が必須ならモデルを切り替えてください。
料金
Kling 3.0 APIの料金
料金は出力ごとです。最終的な請求額は、各バリアントのプレイグラウンドで設定するパラメーター(解像度、長さ、出力数、参照入力)に応じて変わります。
| エンドポイント | タイプ | 最低料金 |
|---|---|---|
| kwaivgi/ | text-to-video | $2.10 |
| kwaivgi/ | text-to-video | $0.56 |
| kwaivgi/ | text-to-video | $0.42 |
| kwaivgi/ | motion-control | $0.63 |
| kwaivgi/ | motion-control | $0.84 |
| kwaivgi/ | image-to-video | $2.10 |
| kwaivgi/ | image-to-video | $0.56 |
| kwaivgi/ | image-to-video | $0.42 |
API
Kling 3.0 APIを呼び出す
wavespeed.ai/accesskeyでAPIキーに登録し、RESTで予測を送信します。プレイグラウンドでは、入力の組み合わせに応じて、そのまま貼り付けられるサンプルが生成されます。
POSThttps://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"duration": 5,
"aspect_ratio": "16:9",
"cfg_scale": 0.5,
"shot_type": "customize"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"duration": 5,
"aspect_ratio": "16:9",
"cfg_scale": 0.5,
"shot_type": "customize"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"duration": 5,
"aspect_ratio": "16:9",
"cfg_scale": 0.5,
"shot_type": "customize"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)比較
Kling 3.0と他モデルの比較
WaveSpeedAI上の類似モデルではなくKling 3.0を選ぶべきケース。
Kling 3.0 vs Seedance 2.0
Seedance 2.0 は、全バリアントでのネイティブオーディオ、4k出力、高速な Turbo 階層を備えています。Kling 3.0 は、Seedance にはないマルチプロンプトと開始/終了フレームの制御を加えています。
Kling 3.0 vs Veo 3.1
Veo 3.1 は、人物の顔のフォトリアリズムで評価が高く、全階層でネイティブ1080pに対応します。Kling 3.0 は、ほとんどの階層でより安価で、開始/終了フレームの制御つきの4Kオプションもあります。
Kling 3.0 vs Wan 2.7
Wan 2.7 は、1つのファミリーに reference-to-video、video-edit、video-extend、image-edit のバリアントを備えています。Kling 3.0 は、3つの品質階層(Standard / Pro / 4K)のテキストから動画と画像から動画に集中し、モーションコントロールはサブエンドポイントとして提供しています。
FAQ
Kling 3.0 API — よくある質問
料金、ライセンス、連携など、WaveSpeedAIでKling 3.0を実行する際のよくある質問。
Kling 3.0 APIとは何ですか?
Kling 3.0は、Kuaishouの動画生成モデルで、WaveSpeedAI上でREST APIとして提供されています。Kuaishou の Kling 3.0 は、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト追従性、ネイティブオーディオを備えた、テキストから動画と画像から動画に対応します。Standard、Pro、4K の3つの階層があります。プログラムから呼び出すことも、上にリンクされたプレイグラウンドで試すこともできます。
Kling 3.0 APIはどう呼び出しますか?
WaveSpeedAIのアカウントに登録し、/accesskeyからAPIキーをコピーして、入力をJSONとしてhttps://api.wavespeed.ai/api/v3/kwaivgi/kling-v3.0-std/text-to-videoにPOSTします。エンドポイントは予測IDを返します。結果のエンドポイントを約2秒ごとにポーリングし、長時間かかるタスクでは間隔を広げ、終端ステータスになったら停止してください。本番運用向けのPython / Node.js / cURLのサンプルは上にあります。
Kling 3.0 APIの料金はいくらですか?
Kling 3.0は1回あたり$0.42からです。実際の料金は、設定するパラメーター(解像度、長さ、出力数、参照入力)に応じて変わります。プレイグラウンドの「生成」ボタンの横に表示されるリアルタイムの料金プレビューで、現在の入力での正確な料金を確認できます。
Kling 3.0にはどのバリアントがありますか?
WaveSpeedAIでは、8個のKling 3.0エンドポイントが利用可能です:kwaivgi/kling-v3.0-4k/text-to-video, kwaivgi/kling-v3.0-pro/text-to-video, kwaivgi/kling-v3.0-std/text-to-video, kwaivgi/kling-v3.0-std/motion-control, kwaivgi/kling-v3.0-pro/motion-control, kwaivgi/kling-v3.0-4k/image-to-video, kwaivgi/kling-v3.0-pro/image-to-video, kwaivgi/kling-v3.0-std/image-to-video。各バリアントには、専用のプレイグラウンドページと料金があります。
Kling 3.0の出力を商用利用できますか?
商用利用の権利は、Kuaishouのモデルライセンスに従います。Kuaishouのほとんどのモデルは出力の商用利用を認めています。具体的なライセンスの概要は各モデルのプレイグラウンドページで、プラットフォーム全体の条件はWaveSpeedAIの利用規約でご確認ください。
なぜ直接ではなくWaveSpeedAIでKling 3.0を使うのですか?
Kling 3.0と、他のプロバイダーの1,000以上のAIモデルを、1つのAPIキー、1つの請求アカウントで利用できます。ベンダーごとのSDK設定も、個別のレート制限も、ベンダーごとの連携コードの書き直しも不要です。料金は、通常Kuaishouの直接のAPIと同等かそれ以下です。
提供元
Kuaishouについて
WaveSpeedAIにおけるKling 3.0と、Kuaishouのモデルラインナップ全体を手がけるチーム。
Kuaishou は、中国の大手ショート動画プラットフォームであり、動画生成モデルの Kling ファミリーを開発するチームです。Kling 3.0 は、ネイティブのオーディオ合成(全バリアントに sound パラメーター)を備えた Standard、Pro、4K の階層に加え、参照動画からモーションを転送して静止したキャラクター画像をアニメーション化する、専用のモーションコントロールエンドポイントを提供します。
WaveSpeedAIでKling 3.0を使った開発を始めよう
登録時に無料のスタータークレジットを進呈。Kuaishouをはじめ、あらゆるプロバイダーの1,000以上のAIモデルを、1つのAPIキーで。