Veo 3.1 API
Google Veo 3.1 — texte vers vidéo avec audio natif synchronisé en 1080p. Trois niveaux (Standard, Fast, Lite) avec texte vers vidéo, image vers vidéo, référence vers vidéo et video-extend, plus start-end-to-video sur le niveau Lite.
Le niveau Standard offre toute la qualité de Veo ; Fast pour l'itération ; Lite pour la prévisualisation et le gros volume. Référence vers vidéo accepte des images de référence pour une génération qui préserve l'identité ; video-extend fonctionne par pas de 7 secondes et produit un seul clip fusionné.
Présentation
À propos de Veo 3.1 API
Ce que fait Veo 3.1, sa place dans la gamme de modèles Google, et pourquoi les équipes l’adoptent.
Veo 3.1 est un modèle de génération vidéo proposé par Google, disponible via l’API REST de WaveSpeedAI. Google Veo 3.1 — texte vers vidéo avec audio natif synchronisé en 1080p. Trois niveaux (Standard, Fast, Lite) avec texte vers vidéo, image vers vidéo, référence vers vidéo et video-extend, plus start-end-to-video sur le niveau Lite.
Le niveau Standard offre toute la qualité de Veo ; Fast pour l'itération ; Lite pour la prévisualisation et le gros volume. Référence vers vidéo accepte des images de référence pour une génération qui préserve l'identité ; video-extend fonctionne par pas de 7 secondes et produit un seul clip fusionné.
La famille Veo 3.1 sur WaveSpeedAI propose 11 points d’accès REST couvrant les workflows Text-To-Video, Video-Extend, Reference-To-Video, Image-To-Video. Chaque variante a ses propres tarifs, paramètres et exemples de résultats — choisissez celle qui correspond à votre type d’entrée et à vos contraintes de production, ou appelez-en plusieurs avec la même clé API pour composer des pipelines en plusieurs étapes.
Exécutez Veo 3.1 avec la même clé API, le même compte de facturation et les mêmes limites de débit que pour les plus de 1 000 autres modèles IA de WaveSpeedAI. Pas de configuration fournisseur distincte, pas de SDK par fournisseur, pas de limites de débit par fournisseur — une seule intégration couvre tout, du texte vers image et du texte vers vidéo à la synthèse audio, la génération 3D, l’agrandissement et l’édition.
Points d’accès
Tous les points d’accès de l’API Veo 3.1
11 points d’accès Veo 3.1 disponibles dès maintenant sur WaveSpeedAI — choisissez la variante qui correspond à votre workflow.
/filters:quality(82)/media/images/20260408104718_8uxbq2i4.webp)
Veo3.1 Lite Text To Video
Google Veo 3.1 Lite Text-to-Video generates high-fidelity 720p or 1080p videos with natively generated audio from text prompts. Lightweight variant optimized for cost efficiency. Supports landscape and portrait aspect ratios, dialogue with lip-sync, and customizable duration. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104740_drl8tu9l.webp)
Veo3.1 Video Extend
Extend and continue Veo 3.1 videos with smooth motion, preserved style, and strong scene coherence. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778749312530573096_makufpyI.webp)
Veo3.1 Fast Reference To Video
Google Veo 3.1 Fast Reference to Video is a fast AI reference-to-video generation model that creates 8-second videos from up to three reference images using the official Veo predictLongRunning endpoint with referenceImages assets. Ready-to-use REST inference API for product videos, character consistency, branded visual storytelling, social media clips, advertising creatives, and professional reference-based video generation workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/20260408104757_ct9o5p9o.webp)
Veo3.1 Fast Video Extend
Extend Veo 3.1 videos in 7-second steps with the Fast endpoint—quick, coherent continuation that preserves style and motion, output as a single merged clip. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104805_tr00kyv7.webp)
Veo3.1 Fast Text To Video
Google Veo 3.1 Fast creates text-to-video with native 1080p and synchronized audio, delivering high-quality videos for creators. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104748_nwaixdpw.webp)
Veo3.1 Reference To Video
Google Veo3.1 Reference-to-Video performs image-to-video generation that preserves a specific subject's appearance and identity from provided reference images, enabling consistent character or product motion across frames. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104714_ut4h5kku.webp)
Veo3.1 Lite Start End To Video
Google Veo 3.1 Lite Start-End-to-Video generates high-fidelity videos by interpolating between a start image and an optional end image. Supports 720p and 1080p resolutions, landscape and portrait aspect ratios, and native audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104752_1voe0l4b.webp)
Veo3.1 Text To Video
Google Veo 3.1 converts text prompts into videos with synchronized audio at native 1080p for high-quality outputs. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104708_dmnbefn0.webp)
Veo3.1 Lite Image To Video
Google Veo 3.1 Lite Image-to-Video transforms static images into high-fidelity 720p or 1080p videos with natively generated audio. Supports many interpolation use cases, landscape and portrait aspect ratios, and customizable duration. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104802_aaez2mmf.webp)
Veo3.1 Fast Image To Video
Google Veo 3.1 Fast is an Image-to-Video model with native 1080p output for high-detail videos from images and fast performance. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408104744_xfvl07s5.webp)
Veo3.1 Image To Video
Google Veo 3.1 is an Image-to-Video model that converts images into high-quality videos with native 1080P output for enhanced detail and creative flexibility. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemples
Veo 3.1 en action
De vrais résultats générés par l’API Veo 3.1. Survolez une vidéo pour la prévisualiser, cliquez pour ouvrir la visionneuse en taille réelle.
Mode d’emploi
Comment utiliser l’API Veo 3.1
Quatre étapes de l’inscription à une génération terminée. Des exemples complets en Python, Node.js et cURL se trouvent dans la section API ci-dessous.
- 01
Obtenez une clé API
Créez un compte WaveSpeedAI et copiez votre clé API depuis le tableau de bord. Les nouveaux comptes reçoivent des crédits de démarrage gratuits — de quoi utiliser le playground quelques dizaines de fois avant le début de la facturation.
- 02
Soumettez une prédiction
Envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video. Le point d’accès renvoie immédiatement un identifiant de prédiction — les générations sont asynchrones, vous ne gardez donc pas de connexion ouverte pendant l’inférence.
- 03
Interrogez jusqu’à la fin
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retournez les outputs sur completed ; arrêtez avec une erreur sur failed, cancelled, timeout ou deleted ; continuez d’interroger pour tout autre statut.
- 04
Lisez l’URL du résultat
Une fois le statut "completed", lisez l’URL dans data.outputs[0]. Elle pointe vers votre média généré sur le CDN de WaveSpeedAI — fichier image, vidéo, audio ou 3D selon la variante Veo 3.1 appelée.
Cas d’usage
Ce que vous pouvez créer avec Veo 3.1
Les workflows courants pour lesquels développeurs et créateurs utilisent l’API Veo 3.1.
Texte vers vidéo avec audio natif en 1080p
google/veo3.1/text-to-video convertit des prompts en vidéos avec audio synchronisé en 1080p natif — une résolution prête à livrer, sans passe d'upscale. Le même format de prompt fonctionne sur les niveaux Standard, Fast et Lite.
Référence vers vidéo pour préserver l'identité
google/veo3.1/reference-to-video réalise de l'image vers vidéo en préservant l'apparence d'un sujet précis à partir des images de référence fournies. Le référence vers vidéo du niveau Fast utilise l'endpoint officiel predictLongRunning de Veo et accepte jusqu'à trois images de référence pour des sorties de 8 secondes.
Tarification par niveaux : Standard / Fast / Lite
Standard pour la livraison, Fast pour l'itération, Lite pour la prévisualisation et le gros volume. Lite implique des compromis de qualité ; changez de niveau via l'URL de l'endpoint sans réécrire vos prompts.
Video-extend par pas de 7 secondes
google/veo3.1/video-extend prolonge des clips Veo existants avec un mouvement fluide et un style préservé — le résultat est un seul clip fusionné plutôt que des segments séparés à assembler. Le video-extend du niveau Fast (/extension) est l'option la moins chère pour une extension itérative.
Interpolation début-fin (niveau Lite)
google/veo3.1-lite/start-end-to-video interpole entre une image de début et une image de fin facultative pour générer le mouvement qui les relie. Prend en charge le 720p et le 1080p, en formats paysage et portrait. Utile pour les animatiques et les workflows pilotés par images clés au tarif Lite.
Image vers vidéo en 1080p natif
google/veo3.1/image-to-video convertit des images en vidéos 1080p avec davantage de détails et de flexibilité créative — le bon choix lorsque vous partez d'une image clé plutôt que d'un brief textuel.
Conseils
Conseils pour rédiger vos prompts avec Veo 3.1
Des conseils pratiques pour obtenir de meilleurs résultats avec Veo 3.1 — tirés des pratiques qui fonctionnent sur les modèles vidéo dans les pipelines de production.
- 01
Sortie 1080p native à tous les niveaux
Affirmation du catalogue : « 1080p natif pour des sorties de haute qualité ». Toutes les variantes de Veo 3.1 génèrent directement en 1080p — aucune passe d'upscale n'est nécessaire avant la livraison. Le niveau Lite prend aussi en charge le 720p lorsque la bande passante compte davantage.
- 02
Itérez en Lite, affinez en Fast, livrez en Standard
Le même format de prompt fonctionne sur Standard, Fast et Lite — changez l'URL de l'endpoint sans réécrire. Itérez en Lite pour la direction du prompt, affinez en Fast pour une meilleure qualité, livrez en Standard lorsque la fidélité maximale compte.
- 03
Référence vers vidéo pour préserver l'identité
google/veo3.1/reference-to-video préserve l'apparence d'un sujet précis à partir d'images de référence. La version du niveau Fast prend en charge jusqu'à 3 images de référence par génération. Utile pour les vidéos de présentateurs, les personnages de marque et les contenus en série.
- 04
Video-extend fonctionne par pas de 7 secondes
google/veo3.1-fast/video-extend prolonge des vidéos Veo 3.1 par pas de 7 secondes avec un mouvement cohérent et un style préservé — le résultat est un seul clip fusionné plutôt que des segments séparés à assembler en post-production.
- 05
Interpolation début-fin uniquement sur Lite
google/veo3.1-lite/start-end-to-video interpole entre une image de début et une image de fin facultative. Prend en charge 720p / 1080p, paysage et portrait. Réservé à Lite — non disponible en Standard ni en Fast.
- 06
Désactivez l'audio pour les séquences muettes
Le paramètre generate_audio est exposé sur l'endpoint texte vers vidéo Standard. Désactivez-le pour le B-roll, les publications sociales et les clips dont vous remplaceriez de toute façon l'audio en post-production.
Tarifs
Tarifs de l’API Veo 3.1
La tarification se fait par résultat. Le montant final dépend des paramètres définis dans le playground de chaque variante (résolution, durée, nombre de résultats, références).
| Point d’accès | Type | Prix de départ |
|---|---|---|
| google/ | text-to-video | $0.30 |
| google/ | video-extend | $3.20 |
| google/ | reference-to-video | $0.64 |
| google/ | video-extend | $1.20 |
| google/ | text-to-video | $1.20 |
| google/ | reference-to-video | $3.20 |
| google/ | image-to-video | $0.40 |
| google/ | text-to-video | $3.20 |
| google/ | image-to-video | $0.30 |
| google/ | image-to-video | $1.20 |
| google/ | image-to-video | $3.20 |
API
Appelez l’API Veo 3.1
Obtenez une clé API sur wavespeed.ai/accesskey, puis soumettez une prédiction via REST. Le playground génère des exemples prêts à copier pour toute combinaison d’entrées.
POSThttps://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"duration": 8,
"resolution": "1080p",
"generate_audio": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparer
Veo 3.1 face aux alternatives
Quand choisir Veo 3.1 plutôt que des modèles similaires sur WaveSpeedAI.
Veo 3.1 vs Seedance 2.0
Seedance 2.0 propose l'audio natif à tous les niveaux et un niveau Turbo rapide. Veo 3.1 est plus cher au niveau supérieur, mais le niveau Lite est compétitif sur le coût, et la réputation de photoréalisme de Veo est plus solide pour les visages humains.
Veo 3.1 vs Kling 3.0
Kling 3.0 propose des niveaux Pro et 4K ainsi qu'un endpoint de contrôle du mouvement. Veo 3.1 offre trois niveaux de prix (Standard / Fast / Lite) avec référence vers vidéo et interpolation début-fin comme endpoints à part entière — un éventail de fonctionnalités différent.
Veo 3.1 vs Wan 2.7
Wan 2.7 réunit référence vers vidéo, édition d'image et texte vers image dans une seule famille — une boîte à outils intermodale plus large. Le niveau Standard de Veo 3.1 couvre l'optimisation des coûts par niveaux (de Lite à Standard) et un video-extend de 7 secondes que Wan gère différemment.
FAQ
Veo 3.1 API — Questions fréquentes
Tarifs, licence, intégration — les questions courantes sur l’utilisation de Veo 3.1 sur WaveSpeedAI.
Qu’est-ce que l’API Veo 3.1 ?
Veo 3.1 est un modèle Google de génération vidéo exposé sous forme d’API REST sur WaveSpeedAI. Google Veo 3.1 — texte vers vidéo avec audio natif synchronisé en 1080p. Trois niveaux (Standard, Fast, Lite) avec texte vers vidéo, image vers vidéo, référence vers vidéo et video-extend, plus start-end-to-video sur le niveau Lite. Vous pouvez l’appeler par programmation ou l’essayer depuis le playground indiqué ci-dessus.
Comment appeler l’API Veo 3.1 ?
Créez un compte WaveSpeedAI, copiez votre clé API depuis /accesskey, puis envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/google/veo3.1/text-to-video. Le point d’accès renvoie un identifiant de prédiction. Interrogez le point d’accès de résultat environ toutes les 2 secondes, augmentez l’intervalle pour les tâches longues et arrêtez-vous à tout statut final. Des exemples Python / Node.js / cURL orientés production figurent ci-dessus.
Combien coûte l’API Veo 3.1 ?
Veo 3.1 démarre à $0.30 par exécution. Le coût exact dépend des paramètres définis (résolution, durée, nombre de résultats, références). L’estimation en direct à côté du bouton Générer dans le playground affiche le prix exact pour votre saisie actuelle.
Quelles variantes de Veo 3.1 sont disponibles ?
WaveSpeedAI héberge 11 points d’accès Veo 3.1 actifs : google/veo3.1-lite/text-to-video, google/veo3.1/video-extend, google/veo3.1-fast/reference-to-video, google/veo3.1-fast/video-extend, google/veo3.1-fast/text-to-video, google/veo3.1/reference-to-video, google/veo3.1-lite/start-end-to-video, google/veo3.1/text-to-video, et d’autres. Chaque variante a sa propre page playground et ses propres tarifs.
Puis-je utiliser commercialement les résultats de Veo 3.1 ?
Les droits d’usage commercial suivent la licence du modèle Google. La plupart des modèles Google autorisent l’usage commercial des résultats ; consultez la page playground de chaque modèle pour le résumé de sa licence, et les Conditions d’utilisation de WaveSpeedAI pour les conditions au niveau de la plateforme.
Pourquoi utiliser Veo 3.1 sur WaveSpeedAI plutôt qu’en direct ?
Une seule clé API et un seul compte de facturation pour Veo 3.1 ET plus de 1 000 autres modèles IA d’autres fournisseurs. Pas de configuration de SDK par fournisseur, pas de limites de débit distinctes, pas de code d’intégration à réécrire pour chaque fournisseur. Les tarifs sont généralement au niveau de l’API directe de Google, ou en dessous.
Fournisseur
À propos de Google
L’équipe derrière Veo 3.1 et la gamme plus large de modèles Google sur WaveSpeedAI.
Le travail de Google sur l'IA se fait principalement chez Google DeepMind et Google Research. Ses modèles d'image et de vidéo — Imagen, Veo et les modèles multimodaux de la famille Gemini comme Nano Banana (Gemini 3 Image) — partagent leur architecture et leur infrastructure d'entraînement avec l'ensemble de la gamme Gemini. Leurs résultats sont reconnus pour un rendu précis du texte, une large couverture stylistique et des licences de qualité commerciale.
Commencez à créer avec Veo 3.1 sur WaveSpeedAI
Crédits de démarrage gratuits à l’inscription. Une seule clé API pour plus de 1 000 modèles IA de Google et de tous les autres fournisseurs.