GPT Image 2 API
OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada.
Endpoints de texto para imagem e edição com níveis de qualidade (low / medium / high) e escala de resolução (base, 2K, 4K). O endpoint de edição aceita uma ou mais imagens de referência para edições em linguagem natural.
/filters:quality(82)/examples/bdc87732ca150d74d58327357a20ecdd/1783683931539388653_vcluDNzJ.webp)
Visão geral
Sobre o GPT Image 2 API
O que o GPT Image 2 faz, como ele se encaixa na linha de modelos da OpenAI e por que as equipes o escolhem.
GPT Image 2 é um modelo de geração e edição de imagens da OpenAI, disponível pela API REST da WaveSpeedAI. OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada.
Endpoints de texto para imagem e edição com níveis de qualidade (low / medium / high) e escala de resolução (base, 2K, 4K). O endpoint de edição aceita uma ou mais imagens de referência para edições em linguagem natural.
A família GPT Image 2 na WaveSpeedAI traz 2 endpoints REST cobrindo os fluxos de Text-To-Image, Image-To-Image. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.
Execute o GPT Image 2 com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.
Endpoints
Todos os endpoints da API de GPT Image 2
2 endpoints de GPT Image 2 disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.
/filters:quality(82)/media/images/1782721508918099909_oCMW3dT2.webp)
Gpt Image 2 Text To Image
OpenAI's GPT Image 2 Text-to-Image generates high-quality images from natural-language prompts. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782721434327650196_n8i8hqAK.webp)
Gpt Image 2 Edit
OpenAI's GPT Image 2 Edit enables image editing from natural-language instructions with one or more reference images. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Exemplos
Veja o GPT Image 2 em ação
Resultados reais gerados pela API do GPT Image 2. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.
Como usar
Como usar a API do GPT Image 2
Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.
- 01
Obtenha uma chave de API
Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.
- 02
Envie uma predição
Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.
- 03
Consulte até concluir
Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.
- 04
Leia a URL do resultado
Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do GPT Image 2 que você chamou.
Casos de uso
O que você pode criar com o GPT Image 2
Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do GPT Image 2.
Texto para imagem com níveis de qualidade
openai/gpt-image-2/text-to-image gera imagens de alta qualidade a partir de prompts em linguagem natural. O parâmetro quality (low / medium / high) permite escolher o equilíbrio entre custo e qualidade a cada chamada, sem trocar de endpoint.
Edição com imagens de referência
openai/gpt-image-2/edit permite editar imagens a partir de instruções em linguagem natural, com uma ou mais imagens de referência. Útil para refinamentos guiados por prompt e baseados em uma origem específica.
Escala de resolução para entrega
O parâmetro de resolução cobre base, 2K e 4K. Escolha o menor tamanho que atenda à entrega e aumente só quando necessário. O mesmo formato de prompt em todas as resoluções.
Itere em qualidade low / medium
Qualidade low para iterar na direção do prompt; medium para saída de nível de entrega; high quando a fidelidade máxima é a prioridade.
Workflows de edição em linguagem natural
O endpoint de edição recebe uma imagem de origem e um texto de instrução, opcionalmente com imagens de referência extras. Mais leve que workflows com máscara; especialmente útil para refinamentos de estilo ("deixe mais quente", "adicione uma xícara de café", "remova a marca d'água").
Dicas
Dicas de prompt para o GPT Image 2
Conselhos práticos para obter melhores resultados com o GPT Image 2 — extraídos dos padrões que funcionam em modelos de imagem em pipelines de produção.
- 01
Use o parâmetro quality de forma deliberada
O GPT Image 2 expõe um parâmetro quality com níveis low / medium / high. Itere em low para definir a direção do prompt, refine em medium (padrão) e reserve o high para saídas de destaque / entrega em que a fidelidade máxima importa.
- 02
Use o endpoint Edit com imagens de referência
openai/gpt-image-2/edit aceita uma imagem de origem mais uma instrução em texto, opcionalmente com imagens de referência extras. Mais leve que workflows com máscara — especialmente útil para refinamentos de estilo ("deixe mais quente", "adicione uma xícara de café").
- 03
Escolha a menor resolução que atenda à entrega
O parâmetro de resolução do GPT Image 2 suporta base, 2K e 4K. Não gere em 4K quando 2K bastar — o mesmo formato de prompt funciona em todas as resoluções e os tamanhos maiores são mais lentos.
- 04
Escreva prompts específicos e estruturados
Sujeito + cena + iluminação + linguagem de câmera aproveitam a parte mais forte do treinamento do modelo. "A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens" supera "a cat" por uma ampla margem.
- 05
Use descritores de estilo em vez de nomes de artistas
"No estilo de fotografia editorial" ou "iluminação de estúdio para produtos" é melhor do que citar artistas vivos — evita questões de licenciamento comercial e tende a produzir uma saída mais utilizável.
Preços
Preços da API de GPT Image 2
O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).
| Endpoint | Tipo | Preço inicial |
|---|---|---|
| openai/ | text-to-image | 5% OFF$0.06$0.057 |
| openai/ | image-to-image | 5% OFF$0.07$0.0665 |
API
Chame a API de GPT Image 2
Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.
POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "1:1",
"resolution": "1k",
"quality": "medium",
"output_format": "png"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Comparar
GPT Image 2 vs alternativas
Quando escolher o GPT Image 2 em vez de modelos semelhantes na WaveSpeedAI.
GPT Image 2 vs Nano Banana Pro
O Nano Banana Pro cobre texto para imagem em 4K, nível Ultra e variantes Multi para trabalho em lote. O GPT Image 2 é mais barato na qualidade medium, com níveis de qualidade explícitos (low/medium/high) e um endpoint de edição guiado por imagens de referência.
GPT Image 2 vs Seedream 4.5
O Seedream 4.5 dá ênfase à tipografia e traz variantes Sequential para consistência entre várias imagens; o GPT Image 2 tem o controle do parâmetro quality e o workflow de edição em linguagem natural com referência, que o Seedream trata de outra forma.
GPT Image 2 vs Nano Banana 2
O Nano Banana 2 traz consistência de vários personagens (até 5) e busca na web opcional como base de geração. O GPT Image 2 cobre níveis de qualidade explícitos e o endpoint de edição com imagem de referência, com escala de resolução mais ampla (base / 2K / 4K).
GPT Image 2 vs GPT Image 2.5
O GPT Image 2.5 é o sucessor: dois níveis (Flare para velocidade, Sunburst para fidelidade), cinco níveis de qualidade em vez de três e preços menores por imagem. O GPT Image 2 continua disponível para pipelines que já ajustaram prompts para ele; a migração é uma troca de ID de modelo. Veja /gpt-image-2-5-api.
FAQ
GPT Image 2 API — Perguntas frequentes
Preços, licença, integração — perguntas comuns sobre executar o GPT Image 2 na WaveSpeedAI.
O que é a API do GPT Image 2?
GPT Image 2 é um modelo de geração de imagens da OpenAI disponibilizado como API REST na WaveSpeedAI. OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada. Você pode chamá-lo por código ou testá-lo no playground indicado acima.
Como chamo a API do GPT Image 2?
Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.
Quanto custa a API do GPT Image 2?
O GPT Image 2 começa em $0.057 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.
Quais variantes do GPT Image 2 estão disponíveis?
A WaveSpeedAI hospeda 2 endpoints de GPT Image 2 ativos: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Cada variante tem sua própria página de playground e seu preço.
Posso usar os resultados do GPT Image 2 comercialmente?
Os direitos de uso comercial seguem a licença do modelo da OpenAI. A maioria dos modelos da OpenAI permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.
Por que usar o GPT Image 2 na WaveSpeedAI em vez de ir direto à fonte?
Uma chave de API e uma conta de cobrança para o GPT Image 2 E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da OpenAI.
Provedor
Sobre a OpenAI
A equipe por trás do GPT Image 2 e de toda a linha de modelos da OpenAI na WaveSpeedAI.
A OpenAI é o laboratório por trás do ChatGPT, do GPT-4 e do GPT-5, do DALL·E, do Sora e do Whisper. Seus modelos de imagem e vídeo são amplamente usados em aplicações de consumo e corporativas, com foco em seguimento de instruções, fotorrealismo e proteções de segurança conservadoras. A API de imagem é uma escolha frequente em marketing e editorial, onde é preciso clareza rigorosa sobre o uso comercial.
Comece a criar com o GPT Image 2 na WaveSpeedAI
Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da OpenAI e de todos os outros provedores.
/filters:quality(82)/examples/874ce526dc7b45f758856a297ebe3554/1783683932960323788_1NW4enxG.webp)
/filters:quality(82)/examples/109ce7033b5441fb1eff58b63d16863b/1783683934369707528_qazInwFP.webp)
/filters:quality(82)/examples/8c270f7907b063ff49eabce65b002171/1783683935824334487_V58ZZaju.webp)
/filters:quality(82)/examples/05380da16689443ee6dc4544b1744b71/1783683937583622712_z9xxqlg6.webp)