GPT Image 2 API
OpenAI GPT Image 2 — सामान्य भाषा के प्रॉम्प्ट से उच्च-गुणवत्ता वाले text-to-image और एडिट एंडपॉइंट। क्वालिटी टियर (low / medium / high) और रिज़ॉल्यूशन स्केलिंग से आप हर कॉल पर लागत और फ़िडेलिटी के बीच संतुलन चुन सकते हैं।
क्वालिटी टियर (low / medium / high) और रिज़ॉल्यूशन स्केलिंग (बेस, 2K, 4K) वाले text-to-image और एडिट एंडपॉइंट। एडिट एंडपॉइंट सामान्य भाषा के एडिट के लिए एक या अधिक रेफ़रेंस इमेज स्वीकार करता है।
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
अवलोकन
GPT Image 2 API के बारे में
GPT Image 2 क्या करता है, OpenAI की मॉडल श्रृंखला में इसकी जगह क्या है, और टीमें इसे क्यों चुनती हैं।
GPT Image 2, OpenAI का इमेज जनरेशन और एडिटिंग मॉडल है, जो WaveSpeedAI REST API के ज़रिए उपलब्ध है। OpenAI GPT Image 2 — सामान्य भाषा के प्रॉम्प्ट से उच्च-गुणवत्ता वाले text-to-image और एडिट एंडपॉइंट। क्वालिटी टियर (low / medium / high) और रिज़ॉल्यूशन स्केलिंग से आप हर कॉल पर लागत और फ़िडेलिटी के बीच संतुलन चुन सकते हैं।
क्वालिटी टियर (low / medium / high) और रिज़ॉल्यूशन स्केलिंग (बेस, 2K, 4K) वाले text-to-image और एडिट एंडपॉइंट। एडिट एंडपॉइंट सामान्य भाषा के एडिट के लिए एक या अधिक रेफ़रेंस इमेज स्वीकार करता है।
WaveSpeedAI पर GPT Image 2 परिवार में Text-To-Image, Image-To-Image वर्कफ़्लो को कवर करने वाले 2 REST एंडपॉइंट हैं। हर वेरिएंट की अपनी प्राइसिंग, पैरामीटर और उदाहरण आउटपुट हैं — अपने इनपुट मोडैलिटी और प्रोडक्शन ज़रूरतों के अनुसार चुनें, या एक ही API कुंजी से कई वेरिएंट कॉल करके मल्टी-स्टेप पाइपलाइन बनाएं।
GPT Image 2 को उसी API कुंजी, बिलिंग अकाउंट और रेट-लिमिट के साथ चलाएं जिसका उपयोग आप WaveSpeedAI के अन्य 1,000+ AI मॉडल के लिए करते हैं। अलग वेंडर सेटअप नहीं, प्रति-प्रदाता SDK नहीं, प्रति-वेंडर रेट-लिमिट नहीं — एक ही इंटीग्रेशन टेक्स्ट-टू-इमेज और टेक्स्ट-टू-वीडियो से लेकर ऑडियो सिंथेसिस, 3D जनरेशन, अपस्केलिंग और एडिटिंग तक सब कुछ कवर करता है।
एंडपॉइंट
सभी GPT Image 2 API एंडपॉइंट
WaveSpeedAI पर अभी 2 GPT Image 2 एंडपॉइंट उपलब्ध हैं — अपने वर्कफ़्लो के अनुकूल वेरिएंट चुनें।
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
उदाहरण
GPT Image 2 को काम करते देखें
GPT Image 2 API से बनाए गए असली आउटपुट। किसी भी वीडियो पर होवर करके प्रीव्यू देखें, पूर्ण आकार का व्यूअर खोलने के लिए क्लिक करें।
कैसे करें
GPT Image 2 API का उपयोग कैसे करें
साइनअप से तैयार जनरेशन तक चार चरण। पूरे Python, Node.js और cURL उदाहरण नीचे API सेक्शन में हैं।
- 01
API कुंजी प्राप्त करें
WaveSpeedAI अकाउंट बनाएं और डैशबोर्ड से अपनी API कुंजी कॉपी करें। नए अकाउंट के साथ मुफ़्त शुरुआती क्रेडिट मिलते हैं — बिलिंग शुरू होने से पहले प्लेग्राउंड को कई दर्जन बार चलाने के लिए पर्याप्त।
- 02
prediction सबमिट करें
अपना इनपुट JSON के रूप में https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image पर POST करें। एंडपॉइंट तुरंत एक prediction id लौटाता है — जनरेशन असिंक्रोनस होते हैं, इसलिए इनफ़रेंस के दौरान आपको कनेक्शन खुला नहीं रखना पड़ता।
- 03
पूर्ण होने तक पोल करें
https://api.wavespeed.ai/api/v3/predictions/{request_id}/result पर GET करें। completed पर आउटपुट लौटाएं; failed, cancelled, timeout या deleted पर त्रुटि के साथ रुकें; बाकी हर status पर पोलिंग जारी रखें।
- 04
आउटपुट URL पढ़ें
status "completed" होने पर data.outputs[0] से URL पढ़ें। यह URL WaveSpeedAI CDN पर आपके बनाए मीडिया की ओर इशारा करता है — आपके कॉल किए गए GPT Image 2 वेरिएंट के अनुसार इमेज, वीडियो, ऑडियो या 3D फ़ाइल।
उपयोग के मामले
GPT Image 2 से आप क्या बना सकते हैं
आम वर्कफ़्लो जिनके लिए डेवलपर और क्रिएटर GPT Image 2 API का उपयोग करते हैं।
क्वालिटी टियरिंग के साथ Text-to-image
openai/gpt-image-2/text-to-image सामान्य भाषा के प्रॉम्प्ट से उच्च-गुणवत्ता वाली इमेज बनाता है। quality पैरामीटर (low / medium / high) एंडपॉइंट बदले बिना हर कॉल पर लागत-क्वालिटी का संतुलन चुनने देता है।
रेफ़रेंस इमेज के साथ एडिट
openai/gpt-image-2/edit एक या अधिक रेफ़रेंस इमेज देकर सामान्य भाषा के निर्देशों से इमेज एडिटिंग करता है। किसी खास सोर्स पर आधारित प्रॉम्प्ट-निर्देशित सुधारों के लिए उपयोगी।
डिलीवरी के लिए रिज़ॉल्यूशन स्केलिंग
Resolution पैरामीटर बेस, 2K और 4K कवर करता है। डिलीवरी पूरी करने वाला सबसे छोटा साइज़ चुनें, ज़रूरत होने पर ही बड़ा करें। सभी रिज़ॉल्यूशन पर वही प्रॉम्प्ट फ़ॉर्मेट।
Low / medium क्वालिटी पर इटरेशन
प्रॉम्प्ट की दिशा के इटरेशन के लिए Low क्वालिटी; डिलीवरी-ग्रेड आउटपुट के लिए medium; और जब सर्वोच्च फ़िडेलिटी प्राथमिकता हो तब high।
सामान्य भाषा के एडिट वर्कफ़्लो
एडिट एंडपॉइंट सोर्स इमेज + निर्देश टेक्स्ट लेता है, वैकल्पिक रूप से अतिरिक्त रेफ़रेंस इमेज के साथ। मास्किंग वर्कफ़्लो से हल्का; खास तौर पर स्टाइल संबंधी सुधारों के लिए उपयोगी ("इसे ज़्यादा गर्म बनाओ", "कॉफ़ी कप जोड़ो", "वॉटरमार्क हटाओ")।
सुझाव
GPT Image 2 के लिए प्रॉम्प्ट लिखने के सुझाव
GPT Image 2 से बेहतर आउटपुट पाने के व्यावहारिक सुझाव — प्रोडक्शन पाइपलाइन में इमेज मॉडल पर काम करने वाले पैटर्न से लिए गए।
- 01
quality पैरामीटर को सोच-समझकर इस्तेमाल करें
GPT Image 2 में low / medium / high टियर वाला quality पैरामीटर है। प्रॉम्प्ट की दिशा के लिए low पर इटरेट करें, medium (डिफ़ॉल्ट) पर निखारें, और हीरो / डिलीवरी आउटपुट के लिए high रखें जहाँ सर्वोच्च फ़िडेलिटी मायने रखती है।
- 02
रेफ़रेंस इमेज के साथ Edit एंडपॉइंट इस्तेमाल करें
openai/gpt-image-2/edit सोर्स इमेज के साथ टेक्स्ट निर्देश स्वीकार करता है, वैकल्पिक रूप से अतिरिक्त रेफ़रेंस इमेज के साथ। मास्किंग वर्कफ़्लो से हल्का — खास तौर पर स्टाइल संबंधी सुधारों के लिए उपयोगी ("इसे ज़्यादा गर्म बनाओ", "कॉफ़ी कप जोड़ो")।
- 03
डिलीवरी पूरी करने वाला सबसे छोटा रिज़ॉल्यूशन चुनें
GPT Image 2 का resolution पैरामीटर बेस, 2K और 4K सपोर्ट करता है। जब 2K काफ़ी हो तो 4K जनरेट न करें — वही प्रॉम्प्ट फ़ॉर्मेट सभी रिज़ॉल्यूशन पर काम करता है और बड़े साइज़ धीमे होते हैं।
- 04
विशिष्ट, संरचित प्रॉम्प्ट लिखें
विषय + सीन + लाइटिंग + कैमरा भाषा मॉडल की ट्रेनिंग के सबसे मज़बूत हिस्से से खींचती है। 'A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens' 'a cat' से कहीं बेहतर है।
- 05
कलाकारों के नामों की जगह स्टाइल डिस्क्रिप्टर इस्तेमाल करें
"In the style of editorial photography" या "studio product lighting" जीवित कलाकारों का नाम लेने से बेहतर है — इससे व्यावसायिक लाइसेंसिंग की चिंताएं भी टलती हैं और ज़्यादा उपयोगी आउटपुट मिलता है।
प्राइसिंग
GPT Image 2 API प्राइसिंग
प्राइसिंग प्रति आउटपुट है। अंतिम शुल्क उन पैरामीटर के अनुसार बदलता है जो आप हर वेरिएंट के प्लेग्राउंड में सेट करते हैं (रिज़ॉल्यूशन, अवधि, आउटपुट संख्या, रेफरेंस)।
| एंडपॉइंट | प्रकार | शुरुआती कीमत |
|---|---|---|
| openai/ | text-to-image | 5% की छूट$0.06$0.057 |
| openai/ | image-to-image | 5% की छूट$0.07$0.0665 |
API
GPT Image 2 API कॉल करें
wavespeed.ai/accesskey पर API कुंजी बनाएं, फिर REST के ज़रिए prediction सबमिट करें। प्लेग्राउंड इनपुट के किसी भी संयोजन के लिए सीधे पेस्ट करने योग्य नमूने तैयार करता है।
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)तुलना
GPT Image 2 बनाम विकल्प
WaveSpeedAI पर समान मॉडल की तुलना में GPT Image 2 कब चुनें।
GPT Image 2 बनाम Nano Banana Pro
Nano Banana Pro 4K text-to-image, Ultra टियर और बैच कार्य के लिए Multi वेरिएंट कवर करता है। GPT Image 2 medium क्वालिटी के लिए सस्ता है, जिसमें स्पष्ट क्वालिटी टियर (low/medium/high) और रेफ़रेंस-इमेज-आधारित एडिट एंडपॉइंट है।
GPT Image 2 बनाम Seedream 4.5
Seedream 4.5 टाइपोग्राफ़ी पर ज़ोर देता है और मल्टी-इमेज निरंतरता के लिए Sequential वेरिएंट देता है, जबकि GPT Image 2 में quality-पैरामीटर नॉब और सामान्य भाषा में रेफ़रेंस के साथ एडिट वर्कफ़्लो है, जिसे Seedream अलग तरह से संभालता है।
GPT Image 2 बनाम Nano Banana 2
Nano Banana 2 मल्टी-कैरेक्टर निरंतरता (5 तक) और वैकल्पिक वेब-सर्च ग्राउंडिंग देता है। GPT Image 2 स्पष्ट क्वालिटी टियर और रेफ़रेंस-इमेज एडिट एंडपॉइंट कवर करता है, साथ में ज़्यादा व्यापक रिज़ॉल्यूशन स्केलिंग (बेस / 2K / 4K)।
GPT Image 2 बनाम GPT Image 2.5
GPT Image 2.5 उत्तराधिकारी है: दो टियर (गति के लिए Flare, फ़िडेलिटी के लिए Sunburst), तीन की जगह पांच क्वालिटी स्तर, और प्रति इमेज कम कीमतें। जिन पाइपलाइन ने GPT Image 2 के हिसाब से प्रॉम्प्ट ट्यून कर लिए हैं, उनके लिए यह उपलब्ध रहता है; माइग्रेशन सिर्फ़ मॉडल-ID बदलना है। देखें /gpt-image-2-5-api।
FAQ
GPT Image 2 API — अक्सर पूछे जाने वाले प्रश्न
प्राइसिंग, लाइसेंस, इंटीग्रेशन — WaveSpeedAI पर GPT Image 2 चलाने के बारे में आम सवाल।
GPT Image 2 API क्या है?
GPT Image 2, OpenAI का इमेज जनरेशन मॉडल है, जो WaveSpeedAI पर REST API के रूप में उपलब्ध है। OpenAI GPT Image 2 — सामान्य भाषा के प्रॉम्प्ट से उच्च-गुणवत्ता वाले text-to-image और एडिट एंडपॉइंट। क्वालिटी टियर (low / medium / high) और रिज़ॉल्यूशन स्केलिंग से आप हर कॉल पर लागत और फ़िडेलिटी के बीच संतुलन चुन सकते हैं। आप इसे प्रोग्रामेटिक रूप से कॉल कर सकते हैं या ऊपर दिए प्लेग्राउंड से आज़मा सकते हैं।
GPT Image 2 API को कैसे कॉल करें?
WaveSpeedAI अकाउंट बनाएं, /accesskey से अपनी API कुंजी कॉपी करें, फिर अपना इनपुट JSON के रूप में https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image पर POST करें। एंडपॉइंट एक prediction id लौटाता है। रिज़ल्ट एंडपॉइंट को लगभग हर 2 सेकंड पर पोल करना शुरू करें, लंबे टास्क के लिए अंतराल बढ़ाएं, और किसी भी अंतिम status पर रुक जाएं। प्रोडक्शन-उन्मुख Python / Node.js / cURL उदाहरण ऊपर हैं।
GPT Image 2 API की कीमत कितनी है?
GPT Image 2 $0.057 प्रति रन से शुरू होता है। सटीक लागत आपके सेट किए पैरामीटर (रिज़ॉल्यूशन, अवधि, आउटपुट संख्या, रेफरेंस) के अनुसार बदलती है। प्लेग्राउंड में Generate बटन के पास लाइव कॉस्ट प्रीव्यू आपके वर्तमान इनपुट की सटीक कीमत दिखाता है।
GPT Image 2 के कौन-से वेरिएंट उपलब्ध हैं?
WaveSpeedAI पर 2 लाइव GPT Image 2 एंडपॉइंट हैं: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit। हर वेरिएंट का अपना प्लेग्राउंड पेज और प्राइसिंग है।
क्या मैं GPT Image 2 के आउटपुट का व्यावसायिक उपयोग कर सकता हूँ?
व्यावसायिक उपयोग के अधिकार OpenAI मॉडल लाइसेंस के अनुसार होते हैं। अधिकांश OpenAI मॉडल आउटपुट के व्यावसायिक उपयोग की अनुमति देते हैं; विशिष्ट लाइसेंस सारांश के लिए हर मॉडल का प्लेग्राउंड पेज और प्लेटफ़ॉर्म-स्तर की शर्तों के लिए WaveSpeedAI की सेवा की शर्तें देखें।
सीधे जाने के बजाय WaveSpeedAI पर GPT Image 2 क्यों इस्तेमाल करें?
एक API कुंजी + एक बिलिंग अकाउंट, GPT Image 2 और अन्य प्रदाताओं के 1,000+ दूसरे AI मॉडल के लिए। प्रति-वेंडर SDK सेटअप नहीं, अलग रेट-लिमिट नहीं, हर वेंडर के लिए इंटीग्रेशन कोड दोबारा लिखना नहीं। प्राइसिंग आमतौर पर OpenAI के सीधे API के बराबर या उससे कम होती है।
प्रदाता
OpenAI के बारे में
WaveSpeedAI पर GPT Image 2 और OpenAI की व्यापक मॉडल श्रृंखला के पीछे की टीम।
OpenAI वह लैब है जो ChatGPT, GPT-4 और GPT-5, DALL·E, Sora और Whisper के पीछे है। इसके इमेज और वीडियो मॉडल कंज़्यूमर और एंटरप्राइज़ एप्लिकेशन में व्यापक रूप से तैनात हैं, जिनका फ़ोकस निर्देश-पालन, फ़ोटोरियलिज़्म और रूढ़िवादी सुरक्षा गार्डरेल पर है। जिन मार्केटिंग और एडिटोरियल उपयोगों को व्यावसायिक उपयोग की सख़्त स्पष्टता चाहिए, उनके लिए इमेज API अक्सर पहली पसंद होती है।
WaveSpeedAI पर GPT Image 2 के साथ बनाना शुरू करें
साइनअप पर मुफ़्त शुरुआती क्रेडिट। OpenAI और हर अन्य प्रदाता के 1,000+ AI मॉडल के लिए एक API कुंजी।
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)