Skip to Content
ModelosGPT ImageVisão geral

Família GPT Image

Os modelos de geração de imagens da OpenAI: gpt-image-2.5-flare, gpt-image-2.5-sunburst e gpt-image-2. Os três são chamados pela API compatível com OpenAI.

Todas as informações destas páginas foram medidas na API em produção, e cada exemplo de código foi executado sem alterações. Última verificação: 2026-09-30.

O que você deseja fazer?

A estrutura de requisição e os campos de resposta comuns a esses endpoints estão em Images API.

Qual modelo usar

gpt-image-2.5-flareTexto para imagem
  • Geração cotidiana e em lote; rápido
  • 6 níveis de qualidade: low a max
Azure · OpenAI
gpt-image-2.5-sunburstEdição
  • Edição e combinação de imagens; maior fidelidade
  • 6 níveis de qualidade: low a max
Azure · OpenAI
gpt-image-2Geração anterior
  • Adequado para projetos existentes
  • 4 níveis de qualidade; sem xhigh nem max
Azure · OpenAI

Ao migrar de gpt-image-2 para 2.5, escolha novamente o nível de qualidade — consulte Qualidade e preço abaixo. Os dois provedores atendem texto para imagem e edição, e o gateway roteia as requisições automaticamente.

IDs de modelo (copie exatamente)
Texto para imagemopenai/gpt-image-2.5-flareGeração cotidiana e em lote; rápido
Ediçãoopenai/gpt-image-2.5-sunburstEdição e combinação de imagens; maior fidelidade
Geração anterioropenai/gpt-image-2Sem os níveis xhigh e max

Qualidade (quality) e preço

quality é o que mais influencia o preço. Níveis mais altos custam mais e demoram mais.

Preços oficiais de referência da OpenAI (por imagem, somente a imagem de saída; prompt e imagens de referência não incluídos):

Nívelgpt-image-2 · 1024×1024gpt-image-2 · 1024×1536 ou 1536×1024
low$0.006$0.005
medium$0.053$0.041
high$0.211$0.165

A OpenAI não publicou uma tabela de preço por imagem para os dois modelos 2.5. Em vez disso, informa preços unitários: $30 por milhão de tokens de imagem de saída, $8 por milhão de tokens de entrada de imagens de referência e $5 por milhão de tokens de entrada de texto. Exemplo de cálculo da OpenAI: uma imagem de 1024×1024 em low gera 196 tokens de saída, cerca de $0.00588. Para outros níveis e tamanhos, faça a estimativa com a calculadora oficial .

Esses são os valores oficiais da OpenAI; a cobrança efetiva segue o usage de cada resposta. Os preços atuais da OfoxAI (incluindo descontos) estão na página do modelo .

Níveis suportados por cada modelo:

Nível2.5 (flare, sunburst)gpt-image-2
low / medium / highSuportadoSuportado
xhigh / maxSuportadoNão suportado; retorna 400
auto ou omitidoO modelo decide — não é o mesmo que medium; defina explicitamenteIdem

standard e hd (valores antigos do DALL·E) não são suportados e retornam 400.

Latência e timeouts (timeout)

A API é síncrona: a resposta só é retornada quando a imagem termina de ser gerada. Se o cliente desconectar antes, a imagem é perdida, mas a requisição é cobrada mesmo assim.

Requisição enviadaGerando — pode levar vários minutosImagem retornada
60 / 120 s padrões comuns: a conexão cai durante a geração, a imagem é perdida e ainda assim cobrada
600 s recomendado: aguarda até a imagem ser retornada

Defina o timeout do cliente em 600 segundos. A latência varia conforme o modelo, a qualidade e o tamanho; requisições de alta qualidade, tamanho grande e edição podem levar vários minutos, e os timeouts padrão comuns de 60 ou 120 segundos não são suficientes.

Tamanho (size)

size aceita um WIDTHxHEIGHT personalizado, desde que as quatro regras abaixo sejam atendidas; violar qualquer uma delas retorna 400.

Múltiplos de 16
  • Largura e altura divisíveis por 16
✗ 1000x1000
Maior lado ≤ 3840
  • Nenhum lado ultrapassa 3840
✗ 4096x4096
Proporção ≤ 3:1
  • Entre 1:3 e 3:1
✗ 3200x1024
Pixels ≥ 655.360
  • No mínimo 655.360 pixels no total
✗ 768x768 → ✓ 1024x768

Omitido ou auto: o modelo escolhe o tamanho. Não há garantia de que seja 1024×1024 nem de que corresponda à sua imagem de referência. Em nossos testes, tanto texto para imagem quanto edição retornaram 1254×1254. Informe o tamanho explicitamente quando precisar de um tamanho fixo.

O máximo documentado é 3840×2160; qualquer valor acima de 2560×1440 é marcado como experimental.

Especificações técnicas

ItemEspecificação
RespostaSíncrona; a imagem vem em base64 puro em data[0].b64_json
Tamanho de saídaLargura e altura personalizadas dentro das quatro restrições; até 3840×2160
Níveis de qualidadeConsulte Qualidade e preço
Formato de saídapng (padrão), jpeg, webp
Imagens por requisição1–10, padrão 1
Imagens de referência≤ 15 MB cada, ≤ 50 MB por requisição — consulte Limites de upload
TimeoutDefina o timeout do cliente em 600 segundos — consulte Latência e timeouts

Selecionar um provedor

Normalmente não é necessário. Selecione um quando houver requisitos de moderação de conteúdo: os provedores aplicam limiares de moderação diferentes; por exemplo, gpt-image-2 é mais rígido no Azure e comparativamente mais permissivo na OpenAI.

Não selecionado (recomendado)
Requisição→Gateway OfoxAI→AzureOpenAI

O gateway escolhe automaticamente um provedor disponível entre Azure e OpenAI.

Provedor selecionado
Requisiçãoopenai→Gateway OfoxAI→AzureOpenAI

As requisições vão somente para esse provedor; se ele estiver indisponível, não haverá fallback para outro provedor.

Como selecionar um provedor
CabeçalhoX-OfoxAI-Provider-Type: openaiFunciona em texto para imagem e em edição; valores: azure_foundry, openai
Corpo da requisição"extra_body": { "provider": { "type": "openai" } }Somente texto para imagem; a edição é um upload multipart e aceita apenas o cabeçalho

Detalhes completos: Roteamento de provedores.

Erros comuns

ErroCausaSolução
moderation_blocked (Your request was rejected by the safety system)O prompt ou a imagem de referência foi bloqueado pelo sistema de segurança do provedor upstreamAltere o prompt ou a imagem de referência e tente novamente; repetir sem alterações produz o mesmo resultado. Se houver requisitos de moderação, considere selecionar um provedor
Timeout, 504, 524, Request timed outO cliente ou um proxy intermediário (Nginx, Vercel, Cloudflare etc.) atinge o timeout antes de a geração terminarDefina os timeouts do cliente e do proxy em 600 segundos — consulte Latência e timeouts
404 model_not_foundID do modelo com erro de digitação ou de maiúsculas/minúsculas, por exemplo GPT-Image-2Copie o ID do modelo desta página, todo em minúsculas
provider_type_unavailableO provedor fixado manualmente não atende este modeloRemova o parâmetro de provedor e deixe o gateway rotear
unknown provider typeNome do provedor no cabeçalho digitado incorretamenteVerifique a grafia
Invalid sizeO tamanho viola uma das quatro regrasConsulte Tamanho
does not support quality 'xhigh'xhigh ou max enviado para gpt-image-2Use high ou mude para 2.5
Invalid value: 'standard'quality definido como standard ou hdUse de low a max
Invalid image file or modeA imagem de referência ou a máscara está em formato incorretoExporte novamente como PNG ou JPEG padrão
Invalid file 'image[0]': unsupported mimetypeO arquivo enviado não é uma imagemEnvie uma imagem PNG, JPEG ou WebP
does not support the 'input_fidelity' parameterUma requisição de edição incluiu input_fidelityRemova-o. Os modelos 2.5 e gpt-image-2 sempre processam imagens de referência em alta fidelidade
Transparent background is not supported for JPEG output formatFundo transparente solicitado com saída jpegUse png ou webp
Unknown parameterParâmetro não suportado por esta famíliaRemova-o
429 rate_limit_exceededMais de 100 requisições por minuto (por equipe)Tente novamente mais tarde. Mais chaves não aumentam o limite

Referência completa de erros: Tratamento de erros.

Mensagens de erro exatas

As mensagens completas que medimos, para que você possa pesquisá-las ou compará-las:

Invalid size '1000x1000'. Width and height must both be divisible by 16. Invalid size '4096x4096'. The longest edge must be less than or equal to 3840. Invalid size '3200x1024'. The maximum supported aspect ratio is 3:1. Invalid size '768x768'. Requested resolution is below the current minimum pixel budget. The model 'gpt-image-2' does not support quality 'xhigh'. Invalid value: 'standard'. Supported values are: 'low', 'medium', 'high', and 'auto'. Invalid 'n': integer above maximum value. Expected a value <= 10, but got 11 instead. Unknown parameter: 'style'. The model 'gpt-image-2.5-sunburst' does not support the 'input_fidelity' parameter. Transparent background is not supported for JPEG output format Invalid file 'image[0]': unsupported mimetype ('text/plain; charset=utf-8'). Supported file formats are 'image/jpeg', 'image/png', and 'image/webp'. unknown provider type in X-OfoxAI-Provider-Type header Model 'GPT-Image-2' not found Invalid image file or mode for image 1

Observe que a lista de valores suportados em Invalid value: 'standard' está incompleta: os modelos 2.5 também aceitam xhigh e max. Considere a tabela de níveis desta página.

Parâmetros sem efeito

Estes parâmetros não causam erro, mas não têm efeito nesta família. A requisição é bem-sucedida e cobrada normalmente:

ParâmetroMotivo
mask (em texto para imagem)Só funciona no endpoint de edição
response_formatParâmetro antigo do DALL·E; esta família sempre retorna base64 (b64_json). Chamando a OpenAI diretamente, retorna Unknown parameter: 'response_format'; pela OfoxAI, é ignorado
input_fidelity (em texto para imagem)Pertence ao gpt-image-1.5. Observação: enviado ao endpoint de edição, retorna 400
input_imagesPertence à família de imagens Qwen

Ausência de erro não significa que o parâmetro funcionou: style, por exemplo, é rejeitado de imediato, enquanto os parâmetros acima são ignorados silenciosamente.

Documentação oficial

A documentação da OpenAI descreve o comportamento ao chamar a OpenAI diretamente. Ao chamar pela OfoxAI, os resultados medidos nestas páginas prevalecem. Por exemplo, o preço segue o usage da resposta e as páginas de modelo.

Perguntas frequentes

O GPT Image 2.5 aceita qualquer tamanho?

Aceita tamanhos personalizados desde que quatro regras sejam atendidas: largura e altura divisíveis por 16, maior lado de no máximo 3840, proporção entre 1:3 e 3:1 e no mínimo 655.360 pixels no total. Violar qualquer regra retorna 400. Por exemplo, 768x768 tem pixels insuficientes e é rejeitado, enquanto 1024x768 funciona.

Qual tamanho recebo se omitir size?

O modelo decide. Não é necessariamente 1024x1024 nem corresponde necessariamente à imagem de referência. Em nossos testes, tanto texto para imagem quanto edição retornaram 1254x1254. Informe o tamanho explicitamente se precisar de um tamanho fixo.

O gpt-image-2 suporta as qualidades xhigh e max?

Não, ambas retornam 400. xhigh e max são suportadas apenas por gpt-image-2.5-flare e gpt-image-2.5-sunburst. O gpt-image-2 aceita low, medium, high e auto.

A qualidade do GPT Image 2.5 pode ser hd ou standard?

Não, esses valores retornam 400. Os valores válidos são low, medium, high, xhigh, max e auto. Se omitida, o modelo escolhe o nível por conta própria (low em nossos testes); defina-a explicitamente para obter qualidade consistente.

Qual timeout devo configurar para a API do gpt-image-2 / GPT Image 2.5?

Defina o timeout do cliente em 600 segundos. A latência varia conforme o modelo, a qualidade e o tamanho; requisições de alta qualidade, tamanho grande e edição podem levar vários minutos.

Como corrigir o erro moderation_blocked (Your request was rejected by the safety system) do GPT Image?

O prompt ou a imagem de referência foi bloqueado pelo sistema de segurança do provedor upstream, normalmente por envolver pessoas reais, personagens protegidos por direitos autorais ou conteúdo sensível. Altere o prompt ou a imagem de referência e tente novamente; repetir sem alterações produz o mesmo resultado. O campo error.moderation_details da resposta indica se o bloqueio ocorreu na etapa de entrada ou de saída. Os provedores aplicam limiares de moderação diferentes; portanto, considere selecionar um provedor se houver requisitos de moderação.

Como corrigir o erro Unknown parameter: response_format do GPT Image?

response_format é um parâmetro antigo do DALL·E. O GPT Image retorna somente base64 (data[0].b64_json) e não fornece URLs de imagem. Remova response_format e use output_format para escolher png, jpeg ou webp. Pela OfoxAI, o parâmetro é ignorado e não causa erro.

O que fazer diante de "Your organization must be verified" ao chamar o gpt-image?

Essa é a verificação de organização exigida pela OpenAI para acesso direto. Pela OfoxAI, não é necessário verificar uma organização por conta própria: uma chave de API da OfoxAI pode chamar gpt-image-2.5-flare, gpt-image-2.5-sunburst e gpt-image-2.

O que fazer quando requisições ao GPT Image atingem o timeout ou retornam 504 ou 524?

A API é síncrona, e requisições de alta qualidade, tamanho grande e edição podem levar vários minutos. Defina o timeout do cliente em 600 segundos e verifique os timeouts de proxies intermediários como Nginx, Vercel ou Cloudflare, cujos padrões costumam ser de apenas 60 a 100 segundos.

Como corrigir o erro does not support the input_fidelity parameter do GPT Image?

O GPT Image 2.5 e o gpt-image-2 sempre processam imagens de referência em alta fidelidade, por isso o endpoint de edição não aceita input_fidelity. Remova-o; o parâmetro se aplica apenas ao gpt-image-1.5.

Como corrigir o erro Invalid size do GPT Image?

O tamanho viola uma das quatro regras, e a mensagem indica qual: divisible by 16 significa que a largura ou a altura não é múltiplo de 16; longest edge significa que o maior lado ultrapassa 3840; aspect ratio significa que a proporção excede 3:1; minimum pixel budget significa menos de 655.360 pixels, por exemplo 768x768. Use um tamanho que atenda às quatro regras, como 1024x768, 1024x1024 ou 1536x1024.

Quanto custa uma imagem com o GPT Image?

A cobrança é por token, e o nível de qualidade é o fator mais importante. Preços oficiais de referência da OpenAI para uma imagem de 1024x1024 com gpt-image-2: cerca de $0.006 em low, $0.053 em medium e $0.211 em high. Para os dois modelos 2.5, os tokens de imagem de saída custam $30 por milhão, de modo que 1024x1024 em low custa cerca de $0.006. O valor efetivamente cobrado é o usage da resposta; os preços atuais da OfoxAI estão nas páginas de modelo.

Preciso fixar um provedor ao editar com o GPT Image 2.5?

Não. Tanto o Azure quanto a OpenAI atendem o endpoint de edição do 2.5, e o gateway roteia as requisições automaticamente.

Last updated on