Nano Banana 2.1 DISPONÍVEL — O mais novo do Google | Experimente →
OpenAIAPI de imagem$0.06/execuçãoA partir de $0.057/execução5% OFF

GPT Image 2 API

OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada.

Endpoints de texto para imagem e edição com níveis de qualidade (low / medium / high) e escala de resolução (base, 2K, 4K). O endpoint de edição aceita uma ou mais imagens de referência para edições em linguagem natural.

Exemplo de resultado do GPT Image 2

Visão geral

Sobre o GPT Image 2 API

O que o GPT Image 2 faz, como ele se encaixa na linha de modelos da OpenAI e por que as equipes o escolhem.

GPT Image 2 é um modelo de geração e edição de imagens da OpenAI, disponível pela API REST da WaveSpeedAI. OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada.

Endpoints de texto para imagem e edição com níveis de qualidade (low / medium / high) e escala de resolução (base, 2K, 4K). O endpoint de edição aceita uma ou mais imagens de referência para edições em linguagem natural.

A família GPT Image 2 na WaveSpeedAI traz 2 endpoints REST cobrindo os fluxos de Text-To-Image, Image-To-Image. Cada variante tem seu próprio preço, parâmetros e exemplos de resultado — escolha a que combina com sua modalidade de entrada e suas restrições de produção, ou chame várias com a mesma chave de API para montar pipelines de várias etapas.

Execute o GPT Image 2 com a mesma chave de API, a mesma conta de cobrança e os mesmos limites de taxa que você usa nos outros mais de 1.000 modelos de IA da WaveSpeedAI. Sem configuração separada por fornecedor, sem SDKs por provedor, sem limites de taxa por fornecedor — uma única integração cobre tudo, de texto para imagem e texto para vídeo até síntese de áudio, geração 3D, ampliação e edição.

Endpoints

Todos os endpoints da API de GPT Image 2

2 endpoints de GPT Image 2 disponíveis agora na WaveSpeedAI — escolha a variante que combina com seu fluxo de trabalho.

Exemplos

Veja o GPT Image 2 em ação

Resultados reais gerados pela API do GPT Image 2. Passe o mouse sobre qualquer vídeo para pré-visualizar e clique para abrir o visualizador em tamanho real.

Como usar

Como usar a API do GPT Image 2

Quatro passos do cadastro até uma geração concluída. Exemplos completos em Python, Node.js e cURL estão na seção de API abaixo.

  1. 01

    Obtenha uma chave de API

    Crie uma conta na WaveSpeedAI e copie sua chave de API no painel. Contas novas recebem créditos iniciais grátis — o suficiente para usar o playground algumas dezenas de vezes antes de a cobrança começar.

  2. 02

    Envie uma predição

    Faça POST da sua entrada em JSON para https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image. O endpoint devolve um id de predição imediatamente — as gerações são assíncronas, então você não mantém uma conexão aberta durante a inferência.

  3. 03

    Consulte até concluir

    Faça GET em https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Retorne os resultados quando o status for completed; pare com erro em failed, cancelled, timeout ou deleted; continue consultando em qualquer outro status.

  4. 04

    Leia a URL do resultado

    Quando o status for "completed", leia a URL em data.outputs[0]. A URL aponta para a mídia gerada na CDN da WaveSpeedAI — imagem, vídeo, áudio ou arquivo 3D, conforme a variante do GPT Image 2 que você chamou.

Casos de uso

O que você pode criar com o GPT Image 2

Fluxos de trabalho comuns para os quais desenvolvedores e criadores usam a API do GPT Image 2.

01

Texto para imagem com níveis de qualidade

openai/gpt-image-2/text-to-image gera imagens de alta qualidade a partir de prompts em linguagem natural. O parâmetro quality (low / medium / high) permite escolher o equilíbrio entre custo e qualidade a cada chamada, sem trocar de endpoint.

text-to-imagequalitytiered
02

Edição com imagens de referência

openai/gpt-image-2/edit permite editar imagens a partir de instruções em linguagem natural, com uma ou mais imagens de referência. Útil para refinamentos guiados por prompt e baseados em uma origem específica.

editreferenceinstruction
03

Escala de resolução para entrega

O parâmetro de resolução cobre base, 2K e 4K. Escolha o menor tamanho que atenda à entrega e aumente só quando necessário. O mesmo formato de prompt em todas as resoluções.

resolution4kdelivery
04

Itere em qualidade low / medium

Qualidade low para iterar na direção do prompt; medium para saída de nível de entrega; high quando a fidelidade máxima é a prioridade.

iterationcostquality
05

Workflows de edição em linguagem natural

O endpoint de edição recebe uma imagem de origem e um texto de instrução, opcionalmente com imagens de referência extras. Mais leve que workflows com máscara; especialmente útil para refinamentos de estilo ("deixe mais quente", "adicione uma xícara de café", "remova a marca d'água").

editnatural-languageworkflow

Dicas

Dicas de prompt para o GPT Image 2

Conselhos práticos para obter melhores resultados com o GPT Image 2 — extraídos dos padrões que funcionam em modelos de imagem em pipelines de produção.

  1. 01

    Use o parâmetro quality de forma deliberada

    O GPT Image 2 expõe um parâmetro quality com níveis low / medium / high. Itere em low para definir a direção do prompt, refine em medium (padrão) e reserve o high para saídas de destaque / entrega em que a fidelidade máxima importa.

  2. 02

    Use o endpoint Edit com imagens de referência

    openai/gpt-image-2/edit aceita uma imagem de origem mais uma instrução em texto, opcionalmente com imagens de referência extras. Mais leve que workflows com máscara — especialmente útil para refinamentos de estilo ("deixe mais quente", "adicione uma xícara de café").

  3. 03

    Escolha a menor resolução que atenda à entrega

    O parâmetro de resolução do GPT Image 2 suporta base, 2K e 4K. Não gere em 4K quando 2K bastar — o mesmo formato de prompt funciona em todas as resoluções e os tamanhos maiores são mais lentos.

  4. 04

    Escreva prompts específicos e estruturados

    Sujeito + cena + iluminação + linguagem de câmera aproveitam a parte mais forte do treinamento do modelo. "A tabby cat sitting on a windowsill, afternoon light, shallow depth of field, 50mm lens" supera "a cat" por uma ampla margem.

  5. 05

    Use descritores de estilo em vez de nomes de artistas

    "No estilo de fotografia editorial" ou "iluminação de estúdio para produtos" é melhor do que citar artistas vivos — evita questões de licenciamento comercial e tende a produzir uma saída mais utilizável.

Preços

Preços da API de GPT Image 2

O preço é por resultado. O valor final varia conforme os parâmetros definidos no playground de cada variante (resolução, duração, quantidade de resultados, referências).

Preço inicial

$0.057/ execução

$0.065% OFF

2 endpoints · GPT Image 2

Abrir Playground
EndpointTipoPreço inicial
openai/gpt-image-2/text-to-imagetext-to-image5% OFF$0.06$0.057
openai/gpt-image-2/editimage-to-image5% OFF$0.07$0.0665

API

Chame a API de GPT Image 2

Crie uma chave de API em wavespeed.ai/accesskey e envie uma predição via REST. O playground gera exemplos prontos para colar para qualquer combinação de entradas.

POSThttps://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "aspect_ratio": "1:1",
    "resolution": "1k",
    "quality": "medium",
    "output_format": "png"
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Comparar

GPT Image 2 vs alternativas

Quando escolher o GPT Image 2 em vez de modelos semelhantes na WaveSpeedAI.

GPT Image 2 vs Nano Banana Pro

O Nano Banana Pro cobre texto para imagem em 4K, nível Ultra e variantes Multi para trabalho em lote. O GPT Image 2 é mais barato na qualidade medium, com níveis de qualidade explícitos (low/medium/high) e um endpoint de edição guiado por imagens de referência.

GPT Image 2 vs Seedream 4.5

O Seedream 4.5 dá ênfase à tipografia e traz variantes Sequential para consistência entre várias imagens; o GPT Image 2 tem o controle do parâmetro quality e o workflow de edição em linguagem natural com referência, que o Seedream trata de outra forma.

GPT Image 2 vs Nano Banana 2

O Nano Banana 2 traz consistência de vários personagens (até 5) e busca na web opcional como base de geração. O GPT Image 2 cobre níveis de qualidade explícitos e o endpoint de edição com imagem de referência, com escala de resolução mais ampla (base / 2K / 4K).

GPT Image 2 vs GPT Image 2.5

O GPT Image 2.5 é o sucessor: dois níveis (Flare para velocidade, Sunburst para fidelidade), cinco níveis de qualidade em vez de três e preços menores por imagem. O GPT Image 2 continua disponível para pipelines que já ajustaram prompts para ele; a migração é uma troca de ID de modelo. Veja /gpt-image-2-5-api.

FAQ

GPT Image 2 API — Perguntas frequentes

Preços, licença, integração — perguntas comuns sobre executar o GPT Image 2 na WaveSpeedAI.

O que é a API do GPT Image 2?

GPT Image 2 é um modelo de geração de imagens da OpenAI disponibilizado como API REST na WaveSpeedAI. OpenAI GPT Image 2 — endpoints de texto para imagem e edição de alta qualidade a partir de prompts em linguagem natural. Níveis de qualidade (low / medium / high) e escala de resolução permitem trocar custo por fidelidade a cada chamada. Você pode chamá-lo por código ou testá-lo no playground indicado acima.

Como chamo a API do GPT Image 2?

Crie uma conta na WaveSpeedAI, copie sua chave de API em /accesskey e faça POST para https://api.wavespeed.ai/api/v3/openai/gpt-image-2/text-to-image com sua entrada em JSON. O endpoint devolve um id de predição. Consulte o endpoint de resultado a cada 2 segundos, aproximadamente, aumente o intervalo em tarefas longas e pare em qualquer status final. Exemplos prontos para produção em Python / Node.js / cURL estão acima.

Quanto custa a API do GPT Image 2?

O GPT Image 2 começa em $0.057 por execução. O custo exato varia conforme os parâmetros definidos (resolução, duração, quantidade de resultados, referências). A prévia de custo ao vivo ao lado do botão Gerar no playground mostra o preço exato da sua entrada atual.

Quais variantes do GPT Image 2 estão disponíveis?

A WaveSpeedAI hospeda 2 endpoints de GPT Image 2 ativos: openai/gpt-image-2/text-to-image, openai/gpt-image-2/edit. Cada variante tem sua própria página de playground e seu preço.

Posso usar os resultados do GPT Image 2 comercialmente?

Os direitos de uso comercial seguem a licença do modelo da OpenAI. A maioria dos modelos da OpenAI permite o uso comercial dos resultados; veja o resumo da licença na página do playground de cada modelo e os Termos de Serviço da WaveSpeedAI para as condições da plataforma.

Por que usar o GPT Image 2 na WaveSpeedAI em vez de ir direto à fonte?

Uma chave de API e uma conta de cobrança para o GPT Image 2 E mais de 1.000 outros modelos de IA de outros provedores. Sem configuração de SDK por fornecedor, sem limites de taxa separados, sem reescrever o código de integração a cada fornecedor. Os preços costumam ser iguais ou menores que os da API direta da OpenAI.

Provedor

Sobre a OpenAI

A equipe por trás do GPT Image 2 e de toda a linha de modelos da OpenAI na WaveSpeedAI.

A OpenAI é o laboratório por trás do ChatGPT, do GPT-4 e do GPT-5, do DALL·E, do Sora e do Whisper. Seus modelos de imagem e vídeo são amplamente usados em aplicações de consumo e corporativas, com foco em seguimento de instruções, fotorrealismo e proteções de segurança conservadoras. A API de imagem é uma escolha frequente em marketing e editorial, onde é preciso clareza rigorosa sobre o uso comercial.

Comece a criar com o GPT Image 2 na WaveSpeedAI

Créditos iniciais grátis no cadastro. Uma chave de API para mais de 1.000 modelos de IA da OpenAI e de todos os outros provedores.