GPT Image 2 API
GPT Image 2 от OpenAI — качественные конечные точки text-to-image и edit по промптам на естественном языке. Уровни качества (low / medium / high) и масштабирование разрешения позволяют в каждом вызове выбирать между ценой и детализацией.
Конечные точки text-to-image и edit с уровнями качества (low / medium / high) и масштабированием разрешения (базовое, 2K, 4K). Конечная точка edit принимает одно или несколько референсных изображений для правок на естественном языке.
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
Обзор
О модели GPT Image 2 API
Что делает GPT Image 2, какое место занимает в линейке моделей OpenAI и почему её выбирают команды.
GPT Image 2 — модель генерации и редактирования изображений от OpenAI, доступная через REST API WaveSpeedAI. GPT Image 2 от OpenAI — качественные конечные точки text-to-image и edit по промптам на естественном языке. Уровни качества (low / medium / high) и масштабирование разрешения позволяют в каждом вызове выбирать между ценой и детализацией.
Конечные точки text-to-image и edit с уровнями качества (low / medium / high) и масштабированием разрешения (базовое, 2K, 4K). Конечная точка edit принимает одно или несколько референсных изображений для правок на естественном языке.
Семейство GPT Image 2 в WaveSpeedAI включает 2 REST-эндпоинта для сценариев: Text-To-Image, Image-To-Image. У каждого варианта свои цены, параметры и примеры результатов — выберите тот, что подходит под ваш тип входных данных и требования продакшена, или вызывайте несколько с одним API-ключом и собирайте многошаговые пайплайны.
Запускайте GPT Image 2 с тем же API-ключом, платёжным аккаунтом и лимитами, что и остальные 1000+ ИИ-моделей WaveSpeedAI. Без отдельной регистрации у вендора, без SDK для каждого провайдера, без разных лимитов у каждого поставщика — одна интеграция охватывает всё: от текста в изображение и текста в видео до синтеза аудио, 3D-генерации, апскейлинга и редактирования.
Эндпоинты
Все эндпоинты API GPT Image 2
Сейчас в WaveSpeedAI доступно эндпоинтов GPT Image 2: 2 — выберите вариант под ваш сценарий.
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Примеры
GPT Image 2 в деле
Реальные результаты, созданные через API GPT Image 2. Наведите курсор на видео для предпросмотра, нажмите, чтобы открыть в полном размере.
Как использовать
Как использовать API GPT Image 2
Четыре шага от регистрации до готовой генерации. Полные примеры на Python, Node.js и cURL — в разделе API ниже.
- 01
Получите API-ключ
Создайте аккаунт WaveSpeedAI и скопируйте API-ключ на панели управления. Новые аккаунты получают бесплатные стартовые кредиты — их хватит, чтобы несколько десятков раз запустить playground до начала списаний.
- 02
Отправьте предсказание
Отправьте входные данные в формате JSON методом POST на https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. Эндпоинт сразу возвращает id предсказания — генерация асинхронная, поэтому соединение не нужно держать открытым на время инференса.
- 03
Опрашивайте до завершения
Выполняйте GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. При статусе completed забирайте результат; при failed, cancelled, timeout или deleted остановитесь с ошибкой; при любом другом статусе продолжайте опрос.
- 04
Получите URL результата
Когда статус станет "completed", возьмите URL из data.outputs[0]. Он указывает на созданный файл в CDN WaveSpeedAI — изображение, видео, аудио или 3D-файл, в зависимости от вызванного варианта GPT Image 2.
Сценарии применения
Что можно создать с GPT Image 2
Типичные сценарии, для которых разработчики и авторы используют API GPT Image 2.
Text-to-image с уровнями качества
openai/gpt-image-2/text-to-image создаёт качественные изображения по промптам на естественном языке. Параметр quality (low / medium / high) позволяет выбирать баланс цены и качества в каждом вызове, не переключая конечные точки.
Редактирование по референсным изображениям
openai/gpt-image-2/edit позволяет редактировать изображения по инструкциям на естественном языке с одним или несколькими референсными изображениями. Полезно для доработок по промпту с опорой на конкретный исходник.
Масштабирование разрешения для выдачи
Параметр resolution охватывает базовое разрешение, 2K и 4K. Выбирайте наименьший размер, который подходит для выдачи, и увеличивайте только при необходимости. Формат промпта одинаков для всех разрешений.
Итерации на low / medium
Low — для подбора направления промпта; medium — для результата, пригодного к выдаче; high — когда приоритетом служит максимальная детализация.
Процессы редактирования на естественном языке
Конечная точка edit принимает исходное изображение и текст инструкции, при желании с дополнительными референсными изображениями. Проще, чем процессы с масками; особенно полезно для стилистических правок («сделай теплее», «добавь чашку кофе», «убери водяной знак»).
Советы
Советы по написанию запросов для GPT Image 2
Практические советы, как получать лучшие результаты от GPT Image 2, — на основе приёмов, которые работают в продакшен-пайплайнах для моделей изображений.
- 01
Используйте параметр quality осознанно
В GPT Image 2 есть параметр quality с уровнями low / medium / high. Подбирайте направление промпта на low, дорабатывайте на medium (по умолчанию), high оставьте для главных материалов и выдачи, где важна максимальная детализация.
- 02
Используйте конечную точку Edit с референсными изображениями
openai/gpt-image-2/edit принимает исходное изображение и текстовую инструкцию, при желании с дополнительными референсными изображениями. Проще, чем процессы с масками — особенно полезно для стилистических правок («сделай теплее», «добавь чашку кофе»).
- 03
Выбирайте наименьшее разрешение, подходящее для выдачи
Параметр resolution в GPT Image 2 поддерживает базовое разрешение, 2K и 4K. Не создавайте 4K, если хватает 2K — формат промпта одинаков для всех разрешений, а большие размеры работают медленнее.
- 04
Пишите конкретные структурированные промпты
Герой + сцена + освещение + язык камеры опираются на самую сильную часть обучения модели. «A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens» намного лучше, чем «a cat».
- 05
Используйте описания стиля вместо имён художников
«In the style of editorial photography» или «studio product lighting» лучше, чем имена живых художников: это снимает вопросы коммерческого лицензирования и обычно даёт более пригодный результат.
Цены
Цены на API GPT Image 2
Оплата — за каждый результат. Итоговая стоимость зависит от параметров, заданных в playground каждого варианта (разрешение, длительность, количество результатов, референсы).
| Эндпоинт | Тип | Цена от |
|---|---|---|
| openai/ | text-to-image | −5%$0.06$0.057 |
| openai/ | image-to-image | −5%$0.07$0.0665 |
API
Вызов API GPT Image 2
Получите API-ключ на wavespeed.ai/accesskey, затем отправьте предсказание через REST. Playground генерирует готовые к вставке примеры для любой комбинации входных данных.
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Сравнение
GPT Image 2 и альтернативы
Когда стоит выбрать GPT Image 2, а не похожие модели в WaveSpeedAI.
GPT Image 2 и Nano Banana Pro
Nano Banana Pro покрывает text-to-image в 4K, уровень Ultra и варианты Multi для пакетной работы. GPT Image 2 дешевле при среднем качестве, с явными уровнями качества (low/medium/high) и конечной точкой edit на основе референсных изображений.
GPT Image 2 и Seedream 4.5
Seedream 4.5 делает упор на типографику и предлагает варианты Sequential для согласованности нескольких изображений. У GPT Image 2 есть ручка параметра качества и процесс редактирования на естественном языке по референсу, которые Seedream решает иначе.
GPT Image 2 и Nano Banana 2
Nano Banana 2 даёт согласованность нескольких персонажей (до 5) и необязательную опору на веб-поиск. GPT Image 2 предлагает явные уровни качества и конечную точку edit по референсным изображениям, с более широким масштабированием разрешения (базовое / 2K / 4K).
GPT Image 2 и GPT Image 2.5
GPT Image 2.5 — преемник: два уровня (Flare — для скорости, Sunburst — для детализации), пять уровней качества вместо трёх и более низкие цены за изображение. GPT Image 2 остаётся доступным для конвейеров, где промпты уже подобраны под него; миграция сводится к смене идентификатора модели. См. /gpt-image-2-5-api.
FAQ
GPT Image 2 API — часто задаваемые вопросы
Цены, лицензия, интеграция — частые вопросы о запуске GPT Image 2 в WaveSpeedAI.
Что такое API GPT Image 2?
GPT Image 2 — модель генерации изображений от OpenAI, доступная как REST API в WaveSpeedAI. GPT Image 2 от OpenAI — качественные конечные точки text-to-image и edit по промптам на естественном языке. Уровни качества (low / medium / high) и масштабирование разрешения позволяют в каждом вызове выбирать между ценой и детализацией. Её можно вызывать программно или попробовать в playground по ссылке выше.
Как вызывать API GPT Image 2?
Создайте аккаунт WaveSpeedAI, скопируйте API-ключ на странице /accesskey и отправьте POST на https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image с входными данными в JSON. Эндпоинт вернёт id предсказания. Опрашивайте эндпоинт результата примерно раз в 2 секунды, для долгих задач увеличивайте интервал и останавливайтесь на любом финальном статусе. Примеры для продакшена на Python / Node.js / cURL — выше.
Сколько стоит API GPT Image 2?
GPT Image 2 стоит от $0.057 за запуск. Точная стоимость зависит от заданных параметров (разрешение, длительность, количество результатов, референсы). Предпросмотр стоимости рядом с кнопкой «Сгенерировать» в playground показывает точную цену для ваших текущих данных.
Какие варианты GPT Image 2 доступны?
В WaveSpeedAI доступно рабочих эндпоинтов GPT Image 2: 2 — openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. У каждого варианта своя страница playground и свои цены.
Можно ли использовать результаты GPT Image 2 в коммерческих целях?
Права на коммерческое использование определяются лицензией модели OpenAI. Большинство моделей OpenAI разрешают коммерческое использование результатов; краткое описание лицензии смотрите на странице playground каждой модели, а условия платформы — в Условиях использования WaveSpeedAI.
Зачем использовать GPT Image 2 в WaveSpeedAI, а не напрямую?
Один API-ключ и один платёжный аккаунт для GPT Image 2 И для 1000+ других ИИ-моделей от разных провайдеров. Без настройки SDK для каждого вендора, без отдельных лимитов, без переписывания интеграционного кода под каждого поставщика. Цены, как правило, на уровне прямого API OpenAI или ниже.
Разработчик
О OpenAI
Команда, стоящая за GPT Image 2 и всей линейкой моделей OpenAI в WaveSpeedAI.
OpenAI — лаборатория, создавшая ChatGPT, GPT-4 и GPT-5, DALL·E, Sora и Whisper. Её модели изображений и видео широко применяются в потребительских и корпоративных приложениях, с упором на следование инструкциям, фотореализм и консервативные ограничения безопасности. API изображений часто выбирают для маркетинговых и редакционных задач, где нужна строгая ясность условий коммерческого использования.
Начните создавать с GPT Image 2 в WaveSpeedAI
Бесплатные стартовые кредиты при регистрации. Один API-ключ для 1000+ ИИ-моделей от OpenAI и всех остальных провайдеров.
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)