Família GPT Image
Os modelos de geração de imagens da OpenAI: gpt-image-2.5-flare, gpt-image-2.5-sunburst e gpt-image-2. Os três são chamados pela API compatível com OpenAI.
Todas as informações destas páginas foram medidas na API em produção, e cada exemplo de código foi executado sem alterações. Última verificação: 2026-09-30.
O que você deseja fazer?
A estrutura de requisição e os campos de resposta comuns a esses endpoints estão em Images API.
Qual modelo usar
- Geração cotidiana e em lote; rápido
- 6 níveis de qualidade: low a max
- Edição e combinação de imagens; maior fidelidade
- 6 níveis de qualidade: low a max
- Adequado para projetos existentes
- 4 níveis de qualidade; sem xhigh nem max
Ao migrar de gpt-image-2 para 2.5, escolha novamente o nível de qualidade — consulte Qualidade e preço abaixo. Os dois provedores atendem texto para imagem e edição, e o gateway roteia as requisições automaticamente.
openai/gpt-image-2.5-flareGeração cotidiana e em lote; rápidoopenai/gpt-image-2.5-sunburstEdição e combinação de imagens; maior fidelidadeopenai/gpt-image-2Sem os níveis xhigh e maxQualidade (quality) e preço
quality é o que mais influencia o preço. Níveis mais altos custam mais e demoram mais.
Preços oficiais de referência da OpenAI (por imagem, somente a imagem de saída; prompt e imagens de referência não incluídos):
A OpenAI não publicou uma tabela de preço por imagem para os dois modelos 2.5. Em vez disso, informa preços unitários: $30 por milhão de tokens de imagem de saída, $8 por milhão de tokens de entrada de imagens de referência e $5 por milhão de tokens de entrada de texto. Exemplo de cálculo da OpenAI: uma imagem de 1024×1024 em low gera 196 tokens de saída, cerca de $0.00588. Para outros níveis e tamanhos, faça a estimativa com a calculadora oficial .
Esses são os valores oficiais da OpenAI; a cobrança efetiva segue o usage de cada resposta. Os preços atuais da OfoxAI (incluindo descontos) estão na página do modelo .
Níveis suportados por cada modelo:
standard e hd (valores antigos do DALL·E) não são suportados e retornam 400.
Latência e timeouts (timeout)
A API é síncrona: a resposta só é retornada quando a imagem termina de ser gerada. Se o cliente desconectar antes, a imagem é perdida, mas a requisição é cobrada mesmo assim.
Defina o timeout do cliente em 600 segundos. A latência varia conforme o modelo, a qualidade e o tamanho; requisições de alta qualidade, tamanho grande e edição podem levar vários minutos, e os timeouts padrão comuns de 60 ou 120 segundos não são suficientes.
Tamanho (size)
size aceita um WIDTHxHEIGHT personalizado, desde que as quatro regras abaixo sejam atendidas; violar qualquer uma delas retorna 400.
- Largura e altura divisíveis por 16
- Nenhum lado ultrapassa 3840
- Entre 1:3 e 3:1
- No mínimo 655.360 pixels no total
Omitido ou auto: o modelo escolhe o tamanho. Não há garantia de que seja 1024×1024 nem de que corresponda à sua imagem de referência. Em nossos testes, tanto texto para imagem quanto edição retornaram 1254×1254. Informe o tamanho explicitamente quando precisar de um tamanho fixo.
O máximo documentado é 3840×2160; qualquer valor acima de 2560×1440 é marcado como experimental.
Especificações técnicas
Selecionar um provedor
Normalmente não é necessário. Selecione um quando houver requisitos de moderação de conteúdo: os provedores aplicam limiares de moderação diferentes; por exemplo, gpt-image-2 é mais rígido no Azure e comparativamente mais permissivo na OpenAI.
O gateway escolhe automaticamente um provedor disponível entre Azure e OpenAI.
As requisições vão somente para esse provedor; se ele estiver indisponível, não haverá fallback para outro provedor.
X-OfoxAI-Provider-Type: openaiFunciona em texto para imagem e em edição; valores: azure_foundry, openai"extra_body": { "provider": { "type": "openai" } }Somente texto para imagem; a edição é um upload multipart e aceita apenas o cabeçalhoDetalhes completos: Roteamento de provedores.
Erros comuns
Referência completa de erros: Tratamento de erros.
Mensagens de erro exatas
As mensagens completas que medimos, para que você possa pesquisá-las ou compará-las:
Invalid size '1000x1000'. Width and height must both be divisible by 16.
Invalid size '4096x4096'. The longest edge must be less than or equal to 3840.
Invalid size '3200x1024'. The maximum supported aspect ratio is 3:1.
Invalid size '768x768'. Requested resolution is below the current minimum pixel budget.
The model 'gpt-image-2' does not support quality 'xhigh'.
Invalid value: 'standard'. Supported values are: 'low', 'medium', 'high', and 'auto'.
Invalid 'n': integer above maximum value. Expected a value <= 10, but got 11 instead.
Unknown parameter: 'style'.
The model 'gpt-image-2.5-sunburst' does not support the 'input_fidelity' parameter.
Transparent background is not supported for JPEG output format
Invalid file 'image[0]': unsupported mimetype ('text/plain; charset=utf-8'). Supported file formats are 'image/jpeg', 'image/png', and 'image/webp'.
unknown provider type in X-OfoxAI-Provider-Type header
Model 'GPT-Image-2' not found
Invalid image file or mode for image 1Observe que a lista de valores suportados em Invalid value: 'standard' está incompleta: os modelos 2.5 também aceitam xhigh e max. Considere a tabela de níveis desta página.
Parâmetros sem efeito
Estes parâmetros não causam erro, mas não têm efeito nesta família. A requisição é bem-sucedida e cobrada normalmente:
Ausência de erro não significa que o parâmetro funcionou: style, por exemplo, é rejeitado de imediato, enquanto os parâmetros acima são ignorados silenciosamente.
Documentação oficial
A documentação da OpenAI descreve o comportamento ao chamar a OpenAI diretamente. Ao chamar pela OfoxAI, os resultados medidos nestas páginas prevalecem. Por exemplo, o preço segue o usage da resposta e as páginas de modelo.
- Guia de geração de imagens da OpenAI
- Guia de geração de imagens da OpenAI · Limitations
- Referência da OpenAI Images API
- Página do modelo na OpenAI: gpt-image-2.5-flare
- Página do modelo na OpenAI: gpt-image-2.5-sunburst
- Página do modelo na OpenAI: gpt-image-2
Perguntas frequentes
O GPT Image 2.5 aceita qualquer tamanho?
Aceita tamanhos personalizados desde que quatro regras sejam atendidas: largura e altura divisíveis por 16, maior lado de no máximo 3840, proporção entre 1:3 e 3:1 e no mínimo 655.360 pixels no total. Violar qualquer regra retorna 400. Por exemplo, 768x768 tem pixels insuficientes e é rejeitado, enquanto 1024x768 funciona.
Qual tamanho recebo se omitir size?
O modelo decide. Não é necessariamente 1024x1024 nem corresponde necessariamente à imagem de referência. Em nossos testes, tanto texto para imagem quanto edição retornaram 1254x1254. Informe o tamanho explicitamente se precisar de um tamanho fixo.
O gpt-image-2 suporta as qualidades xhigh e max?
Não, ambas retornam 400. xhigh e max são suportadas apenas por gpt-image-2.5-flare e gpt-image-2.5-sunburst. O gpt-image-2 aceita low, medium, high e auto.
A qualidade do GPT Image 2.5 pode ser hd ou standard?
Não, esses valores retornam 400. Os valores válidos são low, medium, high, xhigh, max e auto. Se omitida, o modelo escolhe o nível por conta própria (low em nossos testes); defina-a explicitamente para obter qualidade consistente.
Qual timeout devo configurar para a API do gpt-image-2 / GPT Image 2.5?
Defina o timeout do cliente em 600 segundos. A latência varia conforme o modelo, a qualidade e o tamanho; requisições de alta qualidade, tamanho grande e edição podem levar vários minutos.
Como corrigir o erro moderation_blocked (Your request was rejected by the safety system) do GPT Image?
O prompt ou a imagem de referência foi bloqueado pelo sistema de segurança do provedor upstream, normalmente por envolver pessoas reais, personagens protegidos por direitos autorais ou conteúdo sensível. Altere o prompt ou a imagem de referência e tente novamente; repetir sem alterações produz o mesmo resultado. O campo error.moderation_details da resposta indica se o bloqueio ocorreu na etapa de entrada ou de saída. Os provedores aplicam limiares de moderação diferentes; portanto, considere selecionar um provedor se houver requisitos de moderação.
Como corrigir o erro Unknown parameter: response_format do GPT Image?
response_format é um parâmetro antigo do DALL·E. O GPT Image retorna somente base64 (data[0].b64_json) e não fornece URLs de imagem. Remova response_format e use output_format para escolher png, jpeg ou webp. Pela OfoxAI, o parâmetro é ignorado e não causa erro.
O que fazer diante de "Your organization must be verified" ao chamar o gpt-image?
Essa é a verificação de organização exigida pela OpenAI para acesso direto. Pela OfoxAI, não é necessário verificar uma organização por conta própria: uma chave de API da OfoxAI pode chamar gpt-image-2.5-flare, gpt-image-2.5-sunburst e gpt-image-2.
O que fazer quando requisições ao GPT Image atingem o timeout ou retornam 504 ou 524?
A API é síncrona, e requisições de alta qualidade, tamanho grande e edição podem levar vários minutos. Defina o timeout do cliente em 600 segundos e verifique os timeouts de proxies intermediários como Nginx, Vercel ou Cloudflare, cujos padrões costumam ser de apenas 60 a 100 segundos.
Como corrigir o erro does not support the input_fidelity parameter do GPT Image?
O GPT Image 2.5 e o gpt-image-2 sempre processam imagens de referência em alta fidelidade, por isso o endpoint de edição não aceita input_fidelity. Remova-o; o parâmetro se aplica apenas ao gpt-image-1.5.
Como corrigir o erro Invalid size do GPT Image?
O tamanho viola uma das quatro regras, e a mensagem indica qual: divisible by 16 significa que a largura ou a altura não é múltiplo de 16; longest edge significa que o maior lado ultrapassa 3840; aspect ratio significa que a proporção excede 3:1; minimum pixel budget significa menos de 655.360 pixels, por exemplo 768x768. Use um tamanho que atenda às quatro regras, como 1024x768, 1024x1024 ou 1536x1024.
Quanto custa uma imagem com o GPT Image?
A cobrança é por token, e o nível de qualidade é o fator mais importante. Preços oficiais de referência da OpenAI para uma imagem de 1024x1024 com gpt-image-2: cerca de $0.006 em low, $0.053 em medium e $0.211 em high. Para os dois modelos 2.5, os tokens de imagem de saída custam $30 por milhão, de modo que 1024x1024 em low custa cerca de $0.006. O valor efetivamente cobrado é o usage da resposta; os preços atuais da OfoxAI estão nas páginas de modelo.
Preciso fixar um provedor ao editar com o GPT Image 2.5?
Não. Tanto o Azure quanto a OpenAI atendem o endpoint de edição do 2.5, e o gateway roteia as requisições automaticamente.