GPT Image 2 API
OpenAI GPT Image 2 — endpoint text-to-image ed edit di alta qualità a partire da prompt in linguaggio naturale. Livelli di qualità (low / medium / high) e scalatura della risoluzione permettono di bilanciare costo e fedeltà a ogni chiamata.
Endpoint text-to-image ed edit con livelli di qualità (low / medium / high) e scalatura della risoluzione (base, 2K, 4K). L'endpoint edit accetta una o più immagini di riferimento per modifiche in linguaggio naturale.
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
Panoramica
Informazioni su GPT Image 2 API
Cosa fa GPT Image 2, come si inserisce nella gamma di modelli di OpenAI e perché i team lo scelgono.
GPT Image 2 è un modello di generazione e modifica di immagini di OpenAI, disponibile tramite l'API REST di WaveSpeedAI. OpenAI GPT Image 2 — endpoint text-to-image ed edit di alta qualità a partire da prompt in linguaggio naturale. Livelli di qualità (low / medium / high) e scalatura della risoluzione permettono di bilanciare costo e fedeltà a ogni chiamata.
Endpoint text-to-image ed edit con livelli di qualità (low / medium / high) e scalatura della risoluzione (base, 2K, 4K). L'endpoint edit accetta una o più immagini di riferimento per modifiche in linguaggio naturale.
La famiglia GPT Image 2 su WaveSpeedAI offre 2 endpoint REST che coprono i flussi di lavoro Text-To-Image, Image-To-Image. Ogni variante ha il suo prezzo, i suoi parametri e i suoi esempi di output: scegli quella più adatta alla tua modalità di input e ai tuoi vincoli di produzione, oppure richiamane diverse con la stessa chiave API per comporre pipeline in più passaggi.
Usa GPT Image 2 con la stessa chiave API, lo stesso account di fatturazione e gli stessi limiti di frequenza che usi per gli altri oltre 1.000 modelli AI di WaveSpeedAI. Nessuna configurazione separata per fornitore, nessun SDK per provider, nessun limite di frequenza per fornitore: un'unica integrazione copre tutto, dal text-to-image e text-to-video alla sintesi audio, alla generazione 3D, all'upscaling e all'editing.
Endpoint
Tutti gli endpoint API GPT Image 2
2 endpoint GPT Image 2 disponibili ora su WaveSpeedAI: scegli la variante più adatta al tuo flusso di lavoro.
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Esempi
GPT Image 2 in azione
Output reali generati dall'API GPT Image 2. Passa il mouse su un video per l'anteprima, clicca per aprire il visualizzatore a schermo intero.
Guida
Come usare l'API GPT Image 2
Quattro passaggi dalla registrazione alla generazione completata. Esempi completi in Python, Node.js e cURL sono nella sezione API qui sotto.
- 01
Ottieni una chiave API
Registrati su WaveSpeedAI e copia la tua chiave API dalla dashboard. I nuovi account includono crediti gratuiti di benvenuto: bastano per usare il playground qualche decina di volte prima che inizi la fatturazione.
- 02
Invia una predizione
Invia con POST il tuo input in formato JSON a https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. L'endpoint restituisce subito un id di predizione: le generazioni sono asincrone, quindi non devi tenere una connessione aperta durante l'inferenza.
- 03
Controlla il completamento
Fai GET su https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Restituisci gli output con completed; interrompi con un errore con failed, cancelled, timeout o deleted; continua il polling per ogni altro stato.
- 04
Leggi l'URL dell'output
Quando lo stato è "completed", leggi l'URL da data.outputs[0]. L'URL punta al tuo contenuto generato sulla CDN di WaveSpeedAI: immagine, video, audio o file 3D a seconda della variante di GPT Image 2 che hai richiamato.
Casi d'uso
Cosa puoi creare con GPT Image 2
I flussi di lavoro più comuni per cui sviluppatori e creator usano l'API GPT Image 2.
Text-to-image con livelli di qualità
openai/gpt-image-2/text-to-image genera immagini di alta qualità da prompt in linguaggio naturale. Il parametro quality (low / medium / high) permette di scegliere il compromesso tra costo e qualità a ogni chiamata senza cambiare endpoint.
Edit con immagini di riferimento
openai/gpt-image-2/edit consente di modificare le immagini con istruzioni in linguaggio naturale, fornendo una o più immagini di riferimento. Utile per rifiniture guidate dal prompt e ancorate a una sorgente specifica.
Scalatura della risoluzione per la consegna
Il parametro resolution copre base, 2K e 4K. Scegli la dimensione più piccola che soddisfa la consegna e ingrandisci solo quando serve. Stesso formato di prompt a tutte le risoluzioni.
Iterare con qualità low / medium
Qualità low per iterare sulla direzione del prompt; medium per output da consegna; high quando la priorità è la massima fedeltà.
Workflow di edit in linguaggio naturale
L'endpoint edit riceve un'immagine sorgente + un testo di istruzioni, con eventuali immagini di riferimento aggiuntive. Più leggero dei workflow con maschere; particolarmente utile per rifiniture stilistiche («rendila più calda», «aggiungi una tazza di caffè», «rimuovi la filigrana»).
Consigli
Consigli per scrivere i prompt per GPT Image 2
Consigli pratici per ottenere output migliori da GPT Image 2, ricavati dagli schemi che funzionano con i modelli immagini nelle pipeline di produzione.
- 01
Usa il parametro quality in modo consapevole
GPT Image 2 espone un parametro quality con livelli low / medium / high. Itera su low per la direzione del prompt, rifinisci su medium (predefinito), riserva high all'output hero / di consegna in cui conta la massima fedeltà.
- 02
Usa l'endpoint Edit con immagini di riferimento
openai/gpt-image-2/edit accetta un'immagine sorgente più un'istruzione testuale, con eventuali immagini di riferimento aggiuntive. Più leggero dei workflow con maschere — particolarmente utile per rifiniture stilistiche («rendila più calda», «aggiungi una tazza di caffè»).
- 03
Scegli la risoluzione più piccola che soddisfa la consegna
Il parametro resolution di GPT Image 2 supporta base, 2K e 4K. Non generare in 4K quando basta 2K — lo stesso formato di prompt funziona a tutte le risoluzioni e le dimensioni maggiori sono più lente.
- 04
Scrivi prompt specifici e strutturati
Soggetto + scena + illuminazione + linguaggio di camera attingono alla parte più solida dell'addestramento del modello. «Un gatto tigrato seduto su un davanzale, luce pomeridiana, profondità di campo ridotta, obiettivo 50mm» batte «un gatto» con ampio margine.
- 05
Usa descrittori di stile anziché nomi di artisti
«Nello stile della fotografia editoriale» o «illuminazione da prodotto in studio» è meglio che nominare artisti viventi — evita problemi di licenza commerciale e tende a produrre output più utilizzabili.
Prezzi
Prezzi dell'API GPT Image 2
Il prezzo è per output. L'addebito finale dipende dai parametri impostati nel playground di ciascuna variante (risoluzione, durata, numero di output, riferimenti).
| Endpoint | Tipo | Prezzo di partenza |
|---|---|---|
| openai/ | text-to-image | -5%$0.06$0.057 |
| openai/ | image-to-image | -5%$0.07$0.0665 |
API
Richiama l'API GPT Image 2
Ottieni una chiave API su wavespeed.ai/accesskey, poi invia una predizione tramite REST. Il playground genera esempi pronti da incollare per qualsiasi combinazione di input.
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Confronto
GPT Image 2 a confronto con le alternative
Quando scegliere GPT Image 2 rispetto a modelli simili su WaveSpeedAI.
GPT Image 2 vs Nano Banana Pro
Nano Banana Pro copre text-to-image 4K, livello Ultra e varianti Multi per il lavoro in batch. GPT Image 2 costa meno a qualità medium, con livelli di qualità espliciti (low/medium/high) e un endpoint edit guidato da immagini di riferimento.
GPT Image 2 vs Seedream 4.5
Seedream 4.5 punta sulla tipografia e offre varianti Sequential per la coerenza tra più immagini, mentre GPT Image 2 ha il parametro di qualità e il workflow di edit in linguaggio naturale con riferimento, che Seedream gestisce in modo diverso.
GPT Image 2 vs Nano Banana 2
Nano Banana 2 offre coerenza multi-personaggio (fino a 5) e un ancoraggio opzionale alla ricerca web. GPT Image 2 copre livelli di qualità espliciti e l'endpoint di edit con immagini di riferimento, con una scalatura della risoluzione più ampia (base / 2K / 4K).
GPT Image 2 vs GPT Image 2.5
GPT Image 2.5 è il successore: due livelli (Flare per la velocità, Sunburst per la fedeltà), cinque livelli di qualità anziché tre e prezzi per immagine più bassi. GPT Image 2 resta disponibile per le pipeline che hanno già ottimizzato i prompt su di esso; la migrazione consiste nel cambiare l'ID del modello. Vedi /gpt-image-2-5-api.
FAQ
GPT Image 2 API — Domande frequenti
Prezzi, licenza, integrazione: le domande più comuni sull'uso di GPT Image 2 su WaveSpeedAI.
Che cos'è l'API GPT Image 2?
GPT Image 2 è un modello di generazione di immagini di OpenAI reso disponibile come API REST su WaveSpeedAI. OpenAI GPT Image 2 — endpoint text-to-image ed edit di alta qualità a partire da prompt in linguaggio naturale. Livelli di qualità (low / medium / high) e scalatura della risoluzione permettono di bilanciare costo e fedeltà a ogni chiamata. Puoi richiamarlo da codice o provarlo dal playground collegato qui sopra.
Come richiamo l'API GPT Image 2?
Registrati su WaveSpeedAI, copia la tua chiave API da /accesskey, poi invia con POST a https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image il tuo input in formato JSON. L'endpoint restituisce un id di predizione. Fai polling sull'endpoint dei risultati circa ogni 2 secondi, aumenta l'intervallo per le attività di lunga durata e fermati a qualsiasi stato terminale. Gli esempi in Python / Node.js / cURL orientati alla produzione sono qui sopra.
Quanto costa l'API GPT Image 2?
GPT Image 2 parte da $0.057 per esecuzione. Il costo esatto dipende dai parametri impostati (risoluzione, durata, numero di output, riferimenti). L'anteprima del costo in tempo reale accanto al pulsante Genera nel playground mostra il prezzo esatto per il tuo input attuale.
Quali varianti di GPT Image 2 sono disponibili?
WaveSpeedAI offre 2 endpoint GPT Image 2 attivi: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Ogni variante ha la sua pagina playground e i suoi prezzi.
Posso usare gli output di GPT Image 2 a fini commerciali?
I diritti di uso commerciale seguono la licenza del modello di OpenAI. La maggior parte dei modelli di OpenAI consente l'uso commerciale degli output; consulta la pagina playground di ciascun modello per il riepilogo della licenza e i Termini di servizio di WaveSpeedAI per le condizioni a livello di piattaforma.
Perché usare GPT Image 2 su WaveSpeedAI invece di rivolgersi direttamente al fornitore?
Una sola chiave API e un solo account di fatturazione per GPT Image 2 E per oltre 1.000 altri modelli AI di altri provider. Nessuna configurazione di SDK per fornitore, nessun limite di frequenza separato, nessun codice di integrazione da riscrivere per ogni fornitore. I prezzi sono in genere in linea o inferiori a quelli dell'API diretta di OpenAI.
Provider
Informazioni su OpenAI
Il team dietro GPT Image 2 e dietro l'intera gamma di modelli di OpenAI su WaveSpeedAI.
OpenAI è il laboratorio dietro ChatGPT, GPT-4 e GPT-5, DALL·E, Sora e Whisper. I suoi modelli di immagini e video sono diffusi in applicazioni consumer ed enterprise, con un'attenzione a aderenza alle istruzioni, fotorealismo e tutele di sicurezza prudenti. L'API per le immagini è una scelta frequente per usi di marketing ed editoriali che richiedono estrema chiarezza sull'uso commerciale.
Inizia a creare con GPT Image 2 su WaveSpeedAI
Crediti gratuiti di benvenuto alla registrazione. Una sola chiave API per oltre 1.000 modelli AI di OpenAI e di ogni altro provider.
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)