Nano Banana 2.1 EN LIGNE — Le dernier de Google | Essayer →
OpenAIAPI image$0.06/exécutionÀ partir de $0.057/exécution-5 %

GPT Image 2 API

OpenAI GPT Image 2 — endpoints texte vers image et édition de haute qualité à partir de prompts en langage naturel. Des niveaux de qualité (low / medium / high) et une mise à l'échelle de la résolution permettent d'arbitrer entre coût et fidélité à chaque appel.

Endpoints texte vers image et édition avec niveaux de qualité (low / medium / high) et mise à l'échelle de la résolution (base, 2K, 4K). L'endpoint d'édition accepte une ou plusieurs images de référence pour des modifications en langage naturel.

Exemple de résultat de GPT Image 2

Présentation

À propos de GPT Image 2 API

Ce que fait GPT Image 2, sa place dans la gamme de modèles OpenAI, et pourquoi les équipes l’adoptent.

GPT Image 2 est un modèle de génération et édition d’images proposé par OpenAI, disponible via l’API REST de WaveSpeedAI. OpenAI GPT Image 2 — endpoints texte vers image et édition de haute qualité à partir de prompts en langage naturel. Des niveaux de qualité (low / medium / high) et une mise à l'échelle de la résolution permettent d'arbitrer entre coût et fidélité à chaque appel.

Endpoints texte vers image et édition avec niveaux de qualité (low / medium / high) et mise à l'échelle de la résolution (base, 2K, 4K). L'endpoint d'édition accepte une ou plusieurs images de référence pour des modifications en langage naturel.

La famille GPT Image 2 sur WaveSpeedAI propose 2 points d’accès REST couvrant les workflows Text-To-Image, Image-To-Image. Chaque variante a ses propres tarifs, paramètres et exemples de résultats — choisissez celle qui correspond à votre type d’entrée et à vos contraintes de production, ou appelez-en plusieurs avec la même clé API pour composer des pipelines en plusieurs étapes.

Exécutez GPT Image 2 avec la même clé API, le même compte de facturation et les mêmes limites de débit que pour les plus de 1 000 autres modèles IA de WaveSpeedAI. Pas de configuration fournisseur distincte, pas de SDK par fournisseur, pas de limites de débit par fournisseur — une seule intégration couvre tout, du texte vers image et du texte vers vidéo à la synthèse audio, la génération 3D, l’agrandissement et l’édition.

Points d’accès

Tous les points d’accès de l’API GPT Image 2

2 points d’accès GPT Image 2 disponibles dès maintenant sur WaveSpeedAI — choisissez la variante qui correspond à votre workflow.

Exemples

GPT Image 2 en action

De vrais résultats générés par l’API GPT Image 2. Survolez une vidéo pour la prévisualiser, cliquez pour ouvrir la visionneuse en taille réelle.

Mode d’emploi

Comment utiliser l’API GPT Image 2

Quatre étapes de l’inscription à une génération terminée. Des exemples complets en Python, Node.js et cURL se trouvent dans la section API ci-dessous.

  1. 01

    Obtenez une clé API

    Créez un compte WaveSpeedAI et copiez votre clé API depuis le tableau de bord. Les nouveaux comptes reçoivent des crédits de démarrage gratuits — de quoi utiliser le playground quelques dizaines de fois avant le début de la facturation.

  2. 02

    Soumettez une prédiction

    Envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. Le point d’accès renvoie immédiatement un identifiant de prédiction — les générations sont asynchrones, vous ne gardez donc pas de connexion ouverte pendant l’inférence.

  3. 03

    Interrogez jusqu’à la fin

    GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retournez les outputs sur completed ; arrêtez avec une erreur sur failed, cancelled, timeout ou deleted ; continuez d’interroger pour tout autre statut.

  4. 04

    Lisez l’URL du résultat

    Une fois le statut "completed", lisez l’URL dans data.outputs[0]. Elle pointe vers votre média généré sur le CDN de WaveSpeedAI — fichier image, vidéo, audio ou 3D selon la variante GPT Image 2 appelée.

Cas d’usage

Ce que vous pouvez créer avec GPT Image 2

Les workflows courants pour lesquels développeurs et créateurs utilisent l’API GPT Image 2.

01

Texte vers image avec niveaux de qualité

openai/gpt-image-2/text-to-image génère des images de haute qualité à partir de prompts en langage naturel. Le paramètre quality (low / medium / high) permet de choisir le compromis coût-qualité à chaque appel sans changer d'endpoint.

text-to-imagequalitytiered
02

Édition avec images de référence

openai/gpt-image-2/edit permet l'édition d'image à partir d'instructions en langage naturel, avec une ou plusieurs images de référence. Utile pour des retouches pilotées par prompt et ancrées dans une source précise.

editreferenceinstruction
03

Mise à l'échelle de la résolution pour la livraison

Le paramètre de résolution couvre base, 2K et 4K. Choisissez la plus petite taille qui répond à la livraison et ne montez en échelle que si nécessaire. Même format de prompt à toutes les résolutions.

resolution4kdelivery
04

Itérer en qualité low / medium

Qualité low pour itérer sur la direction du prompt ; medium pour une sortie de qualité livrable ; high quand la fidélité maximale est la priorité.

iterationcostquality
05

Workflows d'édition en langage naturel

L'endpoint d'édition prend une image source + un texte d'instruction, avec éventuellement des images de référence supplémentaires. Plus léger que les workflows à masques ; particulièrement utile pour les retouches stylistiques (« rends ça plus chaud », « ajoute une tasse de café », « supprime le filigrane »).

editnatural-languageworkflow

Conseils

Conseils pour rédiger vos prompts avec GPT Image 2

Des conseils pratiques pour obtenir de meilleurs résultats avec GPT Image 2 — tirés des pratiques qui fonctionnent sur les modèles image dans les pipelines de production.

  1. 01

    Utilisez le paramètre quality à bon escient

    GPT Image 2 expose un paramètre quality avec les niveaux low / medium / high. Itérez en low pour la direction du prompt, affinez en medium (par défaut), réservez high aux visuels principaux / de livraison où la fidélité maximale compte.

  2. 02

    Utilisez l'endpoint Edit avec des images de référence

    openai/gpt-image-2/edit accepte une image source plus une instruction textuelle, avec éventuellement des images de référence supplémentaires. Plus léger que les workflows à masques — particulièrement utile pour les retouches stylistiques (« rends ça plus chaud », « ajoute une tasse de café »).

  3. 03

    Choisissez la plus petite résolution qui convient à la livraison

    Le paramètre resolution de GPT Image 2 prend en charge base, 2K et 4K. Ne générez pas en 4K quand la 2K suffit — le même format de prompt fonctionne à toutes les résolutions et les plus grandes tailles sont plus lentes.

  4. 04

    Rédigez des prompts précis et structurés

    Sujet + scène + éclairage + langage de caméra exploitent le mieux l'entraînement du modèle. « A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens » l'emporte largement sur « a cat ».

  5. 05

    Utilisez des descripteurs de style plutôt que des noms d'artistes

    « In the style of editorial photography » ou « studio product lighting » valent mieux que de citer des artistes vivants — cela évite les questions de licence commerciale et tend à produire des résultats plus exploitables.

Tarifs

Tarifs de l’API GPT Image 2

La tarification se fait par résultat. Le montant final dépend des paramètres définis dans le playground de chaque variante (résolution, durée, nombre de résultats, références).

Prix de départ

$0.057/ exécution

$0.06-5 %

2 points d’accès · GPT Image 2

Ouvrir le Playground
Point d’accèsTypePrix de départ
openai/gpt-image-2/text-to-imagetext-to-image-5 %$0.06$0.057
openai/gpt-image-2/editimage-to-image-5 %$0.07$0.0665

API

Appelez l’API GPT Image 2

Obtenez une clé API sur wavespeed.ai/accesskey, puis soumettez une prédiction via REST. Le playground génère des exemples prêts à copier pour toute combinaison d’entrées.

POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "aspect_ratio": "1:1",
    "resolution": "1k",
    "quality": "medium",
    "output_format": "png"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Comparer

GPT Image 2 face aux alternatives

Quand choisir GPT Image 2 plutôt que des modèles similaires sur WaveSpeedAI.

GPT Image 2 vs Nano Banana Pro

Nano Banana Pro couvre le texte vers image 4K, le niveau Ultra et des variantes Multi pour le travail par lots. GPT Image 2 est moins cher en qualité medium, avec des niveaux de qualité explicites (low/medium/high) et un endpoint d'édition piloté par images de référence.

GPT Image 2 vs Seedream 4.5

Seedream 4.5 met l'accent sur la typographie et propose des variantes Sequential pour la cohérence multi-images. GPT Image 2 offre le paramètre de qualité et un workflow d'édition en langage naturel avec référence, que Seedream gère différemment.

GPT Image 2 vs Nano Banana 2

Nano Banana 2 offre la cohérence multi-personnages (jusqu'à 5) et un ancrage par recherche web facultatif. GPT Image 2 couvre des niveaux de qualité explicites et l'endpoint d'édition par image de référence, avec une mise à l'échelle de résolution plus large (base / 2K / 4K).

GPT Image 2 vs GPT Image 2.5

GPT Image 2.5 en est le successeur : deux niveaux (Flare pour la vitesse, Sunburst pour la fidélité), cinq niveaux de qualité au lieu de trois et des prix par image plus bas. GPT Image 2 reste disponible pour les pipelines dont les prompts ont déjà été réglés dessus ; la migration se limite à changer l'ID du modèle. Voir /gpt-image-2-5-api.

FAQ

GPT Image 2 API — Questions fréquentes

Tarifs, licence, intégration — les questions courantes sur l’utilisation de GPT Image 2 sur WaveSpeedAI.

Qu’est-ce que l’API GPT Image 2 ?

GPT Image 2 est un modèle OpenAI de génération d’images exposé sous forme d’API REST sur WaveSpeedAI. OpenAI GPT Image 2 — endpoints texte vers image et édition de haute qualité à partir de prompts en langage naturel. Des niveaux de qualité (low / medium / high) et une mise à l'échelle de la résolution permettent d'arbitrer entre coût et fidélité à chaque appel. Vous pouvez l’appeler par programmation ou l’essayer depuis le playground indiqué ci-dessus.

Comment appeler l’API GPT Image 2 ?

Créez un compte WaveSpeedAI, copiez votre clé API depuis /accesskey, puis envoyez votre entrée en JSON par POST à https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. Le point d’accès renvoie un identifiant de prédiction. Interrogez le point d’accès de résultat environ toutes les 2 secondes, augmentez l’intervalle pour les tâches longues et arrêtez-vous à tout statut final. Des exemples Python / Node.js / cURL orientés production figurent ci-dessus.

Combien coûte l’API GPT Image 2 ?

GPT Image 2 démarre à $0.057 par exécution. Le coût exact dépend des paramètres définis (résolution, durée, nombre de résultats, références). L’estimation en direct à côté du bouton Générer dans le playground affiche le prix exact pour votre saisie actuelle.

Quelles variantes de GPT Image 2 sont disponibles ?

WaveSpeedAI héberge 2 points d’accès GPT Image 2 actifs : openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Chaque variante a sa propre page playground et ses propres tarifs.

Puis-je utiliser commercialement les résultats de GPT Image 2 ?

Les droits d’usage commercial suivent la licence du modèle OpenAI. La plupart des modèles OpenAI autorisent l’usage commercial des résultats ; consultez la page playground de chaque modèle pour le résumé de sa licence, et les Conditions d’utilisation de WaveSpeedAI pour les conditions au niveau de la plateforme.

Pourquoi utiliser GPT Image 2 sur WaveSpeedAI plutôt qu’en direct ?

Une seule clé API et un seul compte de facturation pour GPT Image 2 ET plus de 1 000 autres modèles IA d’autres fournisseurs. Pas de configuration de SDK par fournisseur, pas de limites de débit distinctes, pas de code d’intégration à réécrire pour chaque fournisseur. Les tarifs sont généralement au niveau de l’API directe de OpenAI, ou en dessous.

Fournisseur

À propos de OpenAI

L’équipe derrière GPT Image 2 et la gamme plus large de modèles OpenAI sur WaveSpeedAI.

OpenAI est le laboratoire derrière ChatGPT, GPT-4 et GPT-5, DALL·E, Sora et Whisper. Ses modèles d'image et de vidéo sont largement déployés dans les applications grand public et d'entreprise, avec un accent sur le respect des instructions, le photoréalisme et des garde-fous de sécurité prudents. L'API d'image est un choix fréquent pour les usages marketing et éditoriaux qui exigent une clarté stricte sur l'usage commercial.

Commencez à créer avec GPT Image 2 sur WaveSpeedAI

Crédits de démarrage gratuits à l’inscription. Une seule clé API pour plus de 1 000 modèles IA de OpenAI et de tous les autres fournisseurs.