Veo 3.1 API
Google Veo 3.1 — teks-ke-video dengan audio native tersinkronisasi pada 1080p. Tiga tingkat (Standard, Fast, Lite) dengan teks-ke-video, gambar-ke-video, referensi-ke-video, dan video-extend, plus start-end-to-video pada tingkat Lite.
Tingkat Standard menghadirkan kualitas penuh Veo; tingkat Fast untuk iterasi; tingkat Lite untuk previz dan pekerjaan volume tinggi. Referensi-ke-video menerima gambar referensi untuk pembuatan yang menjaga identitas; video-extend bekerja dalam langkah 7 detik dan menghasilkan satu klip gabungan.
Ringkasan
Tentang Veo 3.1 API
Apa yang dilakukan Veo 3.1, posisinya dalam jajaran model Google, dan mengapa banyak tim memilihnya.
Veo 3.1 adalah model pembuatan video dari Google, tersedia melalui REST API WaveSpeedAI. Google Veo 3.1 — teks-ke-video dengan audio native tersinkronisasi pada 1080p. Tiga tingkat (Standard, Fast, Lite) dengan teks-ke-video, gambar-ke-video, referensi-ke-video, dan video-extend, plus start-end-to-video pada tingkat Lite.
Tingkat Standard menghadirkan kualitas penuh Veo; tingkat Fast untuk iterasi; tingkat Lite untuk previz dan pekerjaan volume tinggi. Referensi-ke-video menerima gambar referensi untuk pembuatan yang menjaga identitas; video-extend bekerja dalam langkah 7 detik dan menghasilkan satu klip gabungan.
Keluarga Veo 3.1 di WaveSpeedAI menyediakan 11 endpoint REST yang mencakup alur kerja Text-To-Video, Video-Extend, Reference-To-Video, Image-To-Video. Setiap varian memiliki harga, parameter, dan contoh output sendiri — pilih yang sesuai dengan modalitas input dan kebutuhan produksi Anda, atau panggil beberapa sekaligus dengan satu API key untuk menyusun pipeline multi-langkah.
Jalankan Veo 3.1 dengan API key, akun penagihan, dan batas laju yang sama dengan yang Anda pakai untuk 1.000+ model AI lainnya di WaveSpeedAI. Tanpa penyiapan vendor terpisah, tanpa SDK per penyedia, tanpa batas laju per vendor — satu integrasi mencakup semuanya, dari text-to-image dan text-to-video hingga sintesis audio, pembuatan 3D, upscaling, dan pengeditan.
Endpoint
Semua endpoint API Veo 3.1
11 endpoint Veo 3.1 tersedia sekarang di WaveSpeedAI — pilih varian yang sesuai dengan alur kerja Anda.
/filters:quality(82)/media/images/20260408104718_8uxbq2i4.webp)
Veo3.1 Lite Text To Video
Google Veo 3.1 Lite Text-to-Video generates high-fidelity 720p or 1080p videos with natively generated audio from text prompts. Lightweight variant optimized for cost efficiency. Supports landscape and portrait aspect ratios, dialogue with lip-sync, and customizable duration. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104740_drl8tu9l.webp)
Veo3.1 Video Extend
Extend and continue Veo 3.1 videos with smooth motion, preserved style, and strong scene coherence. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778749312530573096_makufpyI.webp)
Veo3.1 Fast Reference To Video
Google Veo 3.1 Fast Reference to Video is a fast AI reference-to-video generation model that creates 8-second videos from up to three reference images using the official Veo predictLongRunning endpoint with referenceImages assets. Ready-to-use REST inference API for product videos, character consistency, branded visual storytelling, social media clips, advertising creatives, and professional reference-based video generation workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/20260408104757_ct9o5p9o.webp)
Veo3.1 Fast Video Extend
Extend Veo 3.1 videos in 7-second steps with the Fast endpoint—quick, coherent continuation that preserves style and motion, output as a single merged clip. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104805_tr00kyv7.webp)
Veo3.1 Fast Text To Video
Google Veo 3.1 Fast creates text-to-video with native 1080p and synchronized audio, delivering high-quality videos for creators. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104748_nwaixdpw.webp)
Veo3.1 Reference To Video
Google Veo3.1 Reference-to-Video performs image-to-video generation that preserves a specific subject's appearance and identity from provided reference images, enabling consistent character or product motion across frames. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104714_ut4h5kku.webp)
Veo3.1 Lite Start End To Video
Google Veo 3.1 Lite Start-End-to-Video generates high-fidelity videos by interpolating between a start image and an optional end image. Supports 720p and 1080p resolutions, landscape and portrait aspect ratios, and native audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104752_1voe0l4b.webp)
Veo3.1 Text To Video
Google Veo 3.1 converts text prompts into videos with synchronized audio at native 1080p for high-quality outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104708_dmnbefn0.webp)
Veo3.1 Lite Image To Video
Google Veo 3.1 Lite Image-to-Video transforms static images into high-fidelity 720p or 1080p videos with natively generated audio. Supports many interpolation use cases, landscape and portrait aspect ratios, and customizable duration. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104802_aaez2mmf.webp)
Veo3.1 Fast Image To Video
Google Veo 3.1 Fast is an Image-to-Video model with native 1080p output for high-detail videos from images and fast performance. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104744_xfvl07s5.webp)
Veo3.1 Image To Video
Google Veo 3.1 is an Image-to-Video model that converts images into high-quality videos with native 1080P output for enhanced detail and creative flexibility. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Contoh
Lihat Veo 3.1 beraksi
Output nyata yang dihasilkan oleh API Veo 3.1. Arahkan kursor ke video mana pun untuk pratinjau, klik untuk membuka penampil ukuran penuh.
Cara pakai
Cara menggunakan API Veo 3.1
Empat langkah dari pendaftaran hingga hasil jadi. Contoh lengkap Python, Node.js, dan cURL ada di bagian API di bawah.
- 01
Dapatkan API key
Daftar akun WaveSpeedAI dan salin API key Anda dari dasbor. Akun baru mendapat kredit awal gratis — cukup untuk menjalankan playground beberapa puluh kali sebelum penagihan dimulai.
- 02
Kirim prediksi
POST input Anda sebagai JSON ke https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video. Endpoint langsung mengembalikan id prediksi — proses generasi bersifat asinkron sehingga Anda tidak perlu menahan koneksi terbuka selama inferensi.
- 03
Polling hingga selesai
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Ambil output saat completed; hentikan dengan error saat failed, cancelled, timeout, atau deleted; lanjutkan polling untuk status lainnya.
- 04
Baca URL output
Setelah status "completed", baca URL dari data.outputs[0]. URL tersebut mengarah ke media hasil generasi Anda di CDN WaveSpeedAI — file gambar, video, audio, atau 3D tergantung varian Veo 3.1 yang Anda panggil.
Kasus penggunaan
Apa yang bisa Anda bangun dengan Veo 3.1
Alur kerja umum yang dipakai pengembang dan kreator dengan API Veo 3.1.
Teks-ke-video dengan audio 1080p native
google/veo3.1/text-to-video mengubah prompt teks menjadi video dengan audio tersinkronisasi pada 1080p native — resolusi siap kirim tanpa tahap upscaling. Format prompt yang sama berlaku di tingkat Standard, Fast, dan Lite.
Referensi-ke-video untuk menjaga identitas
google/veo3.1/reference-to-video melakukan gambar-ke-video sambil mempertahankan tampilan subjek tertentu dari gambar referensi yang diberikan. Referensi-ke-video tingkat Fast memakai endpoint predictLongRunning resmi Veo dan mendukung hingga tiga gambar referensi untuk output 8 detik.
Harga bertingkat: Standard / Fast / Lite
Standard untuk hasil akhir, Fast untuk iterasi, Lite untuk previz dan pekerjaan volume tinggi. Lite mengorbankan sebagian kualitas; ganti tingkat lewat URL endpoint tanpa menulis ulang prompt.
Video-extend dalam langkah 7 detik
google/veo3.1/video-extend melanjutkan klip Veo yang ada dengan gerakan mulus dan gaya yang terjaga — output berupa satu klip gabungan, bukan segmen terpisah yang harus disambung. Video-extend tingkat Fast (/extension) adalah opsi lebih murah untuk perpanjangan berulang.
Interpolasi awal-akhir (tingkat Lite)
google/veo3.1-lite/start-end-to-video melakukan interpolasi antara gambar awal dan gambar akhir opsional untuk menghasilkan gerakan penghubung. Mendukung 720p dan 1080p, rasio aspek lanskap dan potret. Berguna untuk alur kerja animatic dan berbasis keyframe dengan harga tingkat Lite.
Gambar-ke-video pada 1080p native
google/veo3.1/image-to-video mengubah gambar menjadi video 1080p dengan detail yang ditingkatkan dan fleksibilitas kreatif — pilihan tepat saat memulai dari still kunci, bukan brief teks saja.
Tips
Tips menulis prompt untuk Veo 3.1
Saran praktis untuk mendapatkan output yang lebih baik dari Veo 3.1 — diambil dari pola yang berhasil pada model video di pipeline produksi.
- 01
Output 1080p native di semua tingkat
Klaim katalog: "1080p native untuk output berkualitas tinggi." Semua varian Veo 3.1 menghasilkan langsung pada 1080p — tanpa tahap upscaling sebelum pengiriman. Tingkat Lite juga mendukung 720p saat bandwidth lebih penting.
- 02
Iterasi di Lite, sempurnakan di Fast, hasil akhir di Standard
Format prompt yang sama berlaku di Standard, Fast, dan Lite — ganti URL endpoint tanpa menulis ulang. Iterasi di Lite untuk arah prompt, sempurnakan di Fast untuk kualitas lebih tinggi, hasil akhir di Standard saat fidelitas puncak penting.
- 03
Referensi-ke-video untuk menjaga identitas
google/veo3.1/reference-to-video menjaga tampilan subjek tertentu dari gambar referensi. Versi tingkat Fast mendukung hingga 3 gambar referensi per pembuatan. Berguna untuk video presenter, karakter merek, dan konten berseri.
- 04
Video-extend bekerja dalam langkah 7 detik
google/veo3.1-fast/video-extend memperpanjang video Veo 3.1 dalam langkah 7 detik dengan gerakan koheren dan gaya terjaga — outputnya satu klip gabungan, bukan segmen terpisah yang harus Anda sambung saat pascaproduksi.
- 05
Interpolasi awal-akhir hanya di Lite
google/veo3.1-lite/start-end-to-video menginterpolasi antara gambar awal dan gambar akhir opsional. Mendukung 720p / 1080p, lanskap dan potret. Hanya untuk Lite — tidak tersedia di Standard atau Fast.
- 06
Matikan audio untuk footage tanpa suara
Parameter generate_audio tersedia pada endpoint teks-ke-video Standard. Matikan untuk B-roll, postingan sosial, dan klip yang audionya toh akan Anda ganti saat pascaproduksi.
Harga
Harga API Veo 3.1
Harga dihitung per output. Biaya akhir menyesuaikan parameter yang Anda atur di playground setiap varian (resolusi, durasi, jumlah output, referensi).
| Endpoint | Jenis | Harga mulai dari |
|---|---|---|
| google/ | text-to-video | $0.30 |
| google/ | video-extend | $3.20 |
| google/ | reference-to-video | $0.64 |
| google/ | video-extend | $1.20 |
| google/ | text-to-video | $1.20 |
| google/ | reference-to-video | $3.20 |
| google/ | image-to-video | $0.40 |
| google/ | text-to-video | $3.20 |
| google/ | image-to-video | $0.30 |
| google/ | image-to-video | $1.20 |
| google/ | image-to-video | $3.20 |
API
Panggil API Veo 3.1
Daftar untuk mendapatkan API key di wavespeed.ai/accesskey, lalu kirim prediksi melalui REST. Playground menghasilkan contoh siap tempel untuk kombinasi input apa pun.
POSThttps://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Perbandingan
Veo 3.1 vs alternatif
Kapan memilih Veo 3.1 dibanding model serupa di WaveSpeedAI.
Veo 3.1 vs Seedance 2.0
Seedance 2.0 menyertakan audio native di setiap tingkat dan tingkat Turbo yang cepat. Veo 3.1 lebih mahal di tingkat teratas, tetapi tingkat Lite kompetitif dari sisi biaya, dan reputasi fotorealisme Veo lebih kuat untuk wajah manusia.
Veo 3.1 vs Kling 3.0
Kling 3.0 memiliki tingkat Pro dan 4K serta endpoint motion-control. Veo 3.1 menyediakan tiga tingkat harga (Standard / Fast / Lite) dengan referensi-ke-video dan interpolasi awal-akhir sebagai endpoint utama — cakupan fitur yang berbeda.
Veo 3.1 vs Wan 2.7
Wan 2.7 memiliki varian referensi-ke-video, image-edit, dan teks-ke-gambar dalam satu keluarga — perangkat lintas modalitas yang lebih luas. Tingkat Standard Veo 3.1 mencakup optimasi biaya bertingkat (Lite hingga Standard) dan video-extend 7 detik yang ditangani Wan dengan cara berbeda.
FAQ
Veo 3.1 API — Pertanyaan yang sering diajukan
Harga, lisensi, integrasi — pertanyaan umum tentang menjalankan Veo 3.1 di WaveSpeedAI.
Apa itu API Veo 3.1?
Veo 3.1 adalah model pembuatan video dari Google yang tersedia sebagai REST API di WaveSpeedAI. Google Veo 3.1 — teks-ke-video dengan audio native tersinkronisasi pada 1080p. Tiga tingkat (Standard, Fast, Lite) dengan teks-ke-video, gambar-ke-video, referensi-ke-video, dan video-extend, plus start-end-to-video pada tingkat Lite. Anda dapat memanggilnya secara terprogram atau mencobanya dari playground yang ditautkan di atas.
Bagaimana cara memanggil API Veo 3.1?
Daftar akun WaveSpeedAI, salin API key Anda dari /accesskey, lalu POST ke https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video dengan input Anda sebagai JSON. Endpoint mengembalikan id prediksi. Lakukan polling pada endpoint hasil dengan interval sekitar 2 detik, perpanjang interval untuk tugas yang berjalan lama, dan berhenti pada status akhir apa pun. Contoh Python / Node.js / cURL untuk produksi ada di atas.
Berapa biaya API Veo 3.1?
Veo 3.1 mulai dari $0.30 per run. Biaya pastinya menyesuaikan parameter yang Anda atur (resolusi, durasi, jumlah output, referensi). Pratinjau biaya langsung di samping tombol Generate di playground menampilkan harga pasti untuk input Anda saat ini.
Varian Veo 3.1 apa saja yang tersedia?
WaveSpeedAI menyediakan 11 endpoint Veo 3.1 aktif: google/veo3.1-lite/text-to-video, google/veo3.1/video-extend, google/veo3.1-fast/reference-to-video, google/veo3.1-fast/video-extend, google/veo3.1-fast/text-to-video, google/veo3.1/reference-to-video, google/veo3.1-lite/start-end-to-video, google/veo3.1/text-to-video, dan lainnya. Setiap varian memiliki halaman playground dan harga sendiri.
Bisakah output Veo 3.1 dipakai secara komersial?
Hak penggunaan komersial mengikuti lisensi model Google. Sebagian besar model Google mengizinkan penggunaan output secara komersial; lihat halaman playground tiap model untuk ringkasan lisensinya, dan Ketentuan Layanan WaveSpeedAI untuk ketentuan tingkat platform.
Mengapa memakai Veo 3.1 di WaveSpeedAI dan bukan langsung?
Satu API key + satu akun penagihan untuk Veo 3.1 DAN 1.000+ model AI lain dari penyedia lain. Tanpa penyiapan SDK per vendor, tanpa batas laju terpisah, tanpa menulis ulang kode integrasi untuk tiap vendor. Harganya umumnya setara atau di bawah API langsung dari Google.
Penyedia
Tentang Google
Tim di balik Veo 3.1 dan jajaran model Google lainnya di WaveSpeedAI.
Karya AI Google terutama dikerjakan di Google DeepMind dan Google Research. Model gambar dan videonya — Imagen, Veo, dan model multimodal keluarga Gemini seperti Nano Banana (Gemini 3 Image) — berbagi arsitektur dan infrastruktur pelatihan dengan lini Gemini yang lebih luas. Hasilnya dikenal dengan render teks yang akurat, cakupan gaya yang luas, dan lisensi kelas komersial.
Mulai membangun dengan Veo 3.1 di WaveSpeedAI
Kredit awal gratis saat mendaftar. Satu API key untuk 1.000+ model AI dari Google dan semua penyedia lainnya.