GPT Image 2 API
OpenAI GPT Image 2 — wysokiej jakości endpointy tekst na obraz i edycji z promptów w języku naturalnym. Poziomy jakości (low / medium / high) i skalowanie rozdzielczości pozwalają w każdym wywołaniu wymieniać koszt na wierność.
Endpointy tekst na obraz i edycji z poziomami jakości (low / medium / high) i skalowaniem rozdzielczości (baza, 2K, 4K). Endpoint edycji przyjmuje jeden lub więcej obrazów referencyjnych do edycji w języku naturalnym.
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
Przegląd
O modelu GPT Image 2 API
Co robi GPT Image 2, jakie miejsce zajmuje w linii modeli OpenAI i dlaczego zespoły po niego sięgają.
GPT Image 2 to model generowania i edycji obrazów od OpenAI, dostępny przez REST API WaveSpeedAI. OpenAI GPT Image 2 — wysokiej jakości endpointy tekst na obraz i edycji z promptów w języku naturalnym. Poziomy jakości (low / medium / high) i skalowanie rozdzielczości pozwalają w każdym wywołaniu wymieniać koszt na wierność.
Endpointy tekst na obraz i edycji z poziomami jakości (low / medium / high) i skalowaniem rozdzielczości (baza, 2K, 4K). Endpoint edycji przyjmuje jeden lub więcej obrazów referencyjnych do edycji w języku naturalnym.
Rodzina GPT Image 2 w WaveSpeedAI zawiera 2 endpointy REST obejmujące workflowy: Text-To-Image, Image-To-Image. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.
Uruchamiaj GPT Image 2 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.
Endpointy
Wszystkie endpointy API GPT Image 2
2 endpointy GPT Image 2 dostępne teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Przykłady
GPT Image 2 w akcji
Prawdziwe wyniki wygenerowane przez API GPT Image 2. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.
Jak zacząć
Jak korzystać z API GPT Image 2
Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.
- 01
Uzyskaj klucz API
Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.
- 02
Wyślij predykcję
Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.
- 03
Sprawdzaj ukończenie
Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.
- 04
Odczytaj adres wyniku
Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu GPT Image 2.
Zastosowania
Co możesz zbudować z GPT Image 2
Typowe workflowy, do których deweloperzy i twórcy używają API GPT Image 2.
Tekst na obraz z poziomami jakości
openai/gpt-image-2/text-to-image generuje wysokiej jakości obrazy z promptów w języku naturalnym. Parametr quality (low / medium / high) pozwala wybrać kompromis między kosztem a jakością w każdym wywołaniu bez zmiany endpointu.
Edycja z obrazami referencyjnymi
openai/gpt-image-2/edit umożliwia edycję obrazów na podstawie instrukcji w języku naturalnym z jednym lub kilkoma dostarczonymi obrazami referencyjnymi. Przydatne przy poprawkach sterowanych promptem, opartych na konkretnym źródle.
Skalowanie rozdzielczości do dostawy
Parametr rozdzielczości obejmuje bazę, 2K i 4K. Wybierz najmniejszy rozmiar, który spełnia wymagania dostawy, i skaluj w górę tylko w razie potrzeby. Ten sam format promptu we wszystkich rozdzielczościach.
Iteracja na jakości low / medium
Jakość low do iteracji kierunku promptu; medium do wyjścia klasy dostawy; high, gdy priorytetem jest maksymalna wierność.
Workflow edycji w języku naturalnym
Endpoint edycji przyjmuje obraz źródłowy i tekst instrukcji, opcjonalnie z dodatkowymi obrazami referencyjnymi. Jest lżejszy niż workflow z maskowaniem; szczególnie przydatny przy poprawkach stylistycznych („make this warmer”, „add a coffee cup”, „remove the watermark”).
Wskazówki
Wskazówki do promptów dla GPT Image 2
Praktyczne rady, jak uzyskiwać lepsze wyniki z GPT Image 2 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli obrazu.
- 01
Używaj parametru quality świadomie
GPT Image 2 udostępnia parametr quality z poziomami low / medium / high. Iteruj na low dla kierunku promptu, dopracowuj na medium (domyślnie), a high zachowaj dla materiałów głównych / dostawy, gdzie liczy się maksymalna wierność.
- 02
Używaj endpointu Edit z obrazami referencyjnymi
openai/gpt-image-2/edit przyjmuje obraz źródłowy oraz instrukcję tekstową, opcjonalnie z dodatkowymi obrazami referencyjnymi. Lżejszy niż workflow z maskowaniem — szczególnie przydatny przy poprawkach stylistycznych („make this warmer”, „add a coffee cup”).
- 03
Wybierz najmniejszą rozdzielczość spełniającą wymagania dostawy
Parametr rozdzielczości GPT Image 2 obsługuje bazę, 2K i 4K. Nie generuj w 4K, gdy wystarczy 2K — ten sam format promptu działa we wszystkich rozdzielczościach, a większe rozmiary są wolniejsze.
- 04
Pisz konkretne, ustrukturyzowane prompty
Bohater + scena + oświetlenie + język kamery korzysta z najmocniejszej części treningu modelu. „A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens” wygrywa z „a cat” z dużą przewagą.
- 05
Używaj opisów stylu zamiast nazwisk artystów
„In the style of editorial photography” lub „studio product lighting” działa lepiej niż wymienianie żyjących artystów — omija problemy z licencjami komercyjnymi i zwykle daje bardziej użyteczne wyniki.
Cennik
Cennik API GPT Image 2
Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).
| Endpoint | Typ | Cena początkowa |
|---|---|---|
| openai/ | text-to-image | -5%$0.06$0.057 |
| openai/ | image-to-image | -5%$0.07$0.0665 |
API
Wywołaj API GPT Image 2
Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Porównanie
GPT Image 2 a alternatywy
Kiedy wybrać GPT Image 2 zamiast podobnych modeli w WaveSpeedAI.
GPT Image 2 a Nano Banana Pro
Nano Banana Pro obejmuje tekst na obraz w 4K, poziom Ultra i warianty Multi do pracy wsadowej. GPT Image 2 jest tańszy w jakości medium, z jawnymi poziomami jakości (low/medium/high) i endpointem edycji sterowanym obrazem referencyjnym.
GPT Image 2 a Seedream 4.5
Seedream 4.5 kładzie nacisk na typografię i oferuje warianty Sequential dla spójności wielu obrazów, natomiast GPT Image 2 ma pokrętło parametru quality i workflow edycji z referencją w języku naturalnym, które Seedream realizuje inaczej.
GPT Image 2 a Nano Banana 2
Nano Banana 2 oferuje spójność wielu postaci (do 5) i opcjonalne oparcie na wyszukiwaniu w sieci. GPT Image 2 obejmuje jawne poziomy jakości i endpoint edycji z obrazem referencyjnym, z szerszym skalowaniem rozdzielczości (baza / 2K / 4K).
GPT Image 2 a GPT Image 2.5
GPT Image 2.5 jest następcą: dwa poziomy (Flare dla szybkości, Sunburst dla wierności), pięć poziomów jakości zamiast trzech i niższe ceny za obraz. GPT Image 2 pozostaje dostępny dla potoków, które już dostroiły prompty pod ten model; migracja polega na zmianie identyfikatora modelu. Zobacz /gpt-image-2-5-api.
FAQ
GPT Image 2 API — najczęściej zadawane pytania
Cennik, licencja, integracja — typowe pytania o uruchamianie GPT Image 2 w WaveSpeedAI.
Czym jest API GPT Image 2?
GPT Image 2 to model generowania obrazów od OpenAI, udostępniony jako REST API w WaveSpeedAI. OpenAI GPT Image 2 — wysokiej jakości endpointy tekst na obraz i edycji z promptów w języku naturalnym. Poziomy jakości (low / medium / high) i skalowanie rozdzielczości pozwalają w każdym wywołaniu wymieniać koszt na wierność. Możesz wywoływać go programowo lub wypróbować w playground, do którego prowadzi link powyżej.
Jak wywołać API GPT Image 2?
Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.
Ile kosztuje API GPT Image 2?
GPT Image 2 zaczyna się od $0.057 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.
Jakie warianty GPT Image 2 są dostępne?
WaveSpeedAI udostępnia 2 aktywnych endpointów GPT Image 2: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Każdy wariant ma własną stronę playground i cennik.
Czy mogę używać wyników GPT Image 2 komercyjnie?
Prawa do komercyjnego użycia wynikają z licencji modelu OpenAI. Większość modeli OpenAI zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.
Dlaczego korzystać z GPT Image 2 w WaveSpeedAI zamiast bezpośrednio?
Jeden klucz API i jedno konto rozliczeniowe dla GPT Image 2 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API OpenAI lub niższe.
Dostawca
O OpenAI
Zespół stojący za GPT Image 2 i szerszą linią modeli OpenAI w WaveSpeedAI.
OpenAI to laboratorium stojące za ChatGPT, GPT-4 i GPT-5, DALL·E, Sora i Whisper. Jego modele obrazu i wideo są szeroko wdrażane w aplikacjach konsumenckich i firmowych, z naciskiem na wykonywanie instrukcji, fotorealizm i ostrożne zabezpieczenia. API obrazów to częsty wybór w zastosowaniach marketingowych i redakcyjnych, które wymagają jasnych zasad użytku komercyjnego.
Zacznij budować z GPT Image 2 w WaveSpeedAI
Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od OpenAI i wszystkich innych dostawców.
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)