gpt-image-2 é o modelo de geração e edição de imagens da OpenAI, lançado em 21 de abril de 2026 como sucessor do gpt-image-1 (abril de 2025) e do gpt-image-1.5 (dezembro de 2025). Ele é nativamente multimodal — a geração de imagens faz parte do modelo principal, em vez de ser um modelo de difusão acoplado a um modelo de linguagem — e é por isso que ele segue prompts longos e com várias partes e renderiza texto legível na imagem de forma mais confiável do que os geradores da era DALL-E.
Duas coisas diferenciam o modelo no nível da API. Primeiro, uma passagem agêntica de 'pensamento': para prompts complexos, ele planeja a composição e raciocina sobre as restrições antes de gerar, o que aumenta as taxas de sucesso em infográficos, layouts com vários painéis e materiais de marketing com muito texto. Segundo, um endpoint de edição que aceita máscaras de imagem para inpainting e outpainting precisos, além de até 16 imagens de referência por chamada para consistência de identidade e estilo. A saída é PNG em resolução nativa de até 2K, com cor neutra que corrige o tom quente em gpt-image-1.5.
No GPTProto, você chama o mesmo gpt-image-2 ID do modelo usando o formato de requisição padrão compatível com a OpenAI — sem conta OpenAI separada, sem etapa de verificação de organização e com um único saldo que também cobre Nano Banana Pro, Seedream, Flux e mais de 200 outros modelos.
Especificações do GPT Image 2
| Especificação |
GPT Image 2 |
| ID do modelo |
gpt-image-2 |
| Lançamento |
21 de abril de 2026 |
| Tipo |
Texto para imagem + edição de imagem (inpaint / outpaint) |
| Formato de saída |
PNG (raster) |
| Resolução máxima |
2K nativo (2048px); variantes de alta resolução até ~4K |
| Texto na imagem |
Latim + CJK (chinês / japonês / coreano), layouts densos |
| Raciocínio |
Modo de 'pensamento' agêntico (planeja antes de renderizar) |
| Imagens de referência |
Até 16 por chamada |
| Edição |
Inpaint / outpaint baseado em máscara; pixels não editados preservados |
| Modalidade de entrada |
Texto (+ imagens de referência) |
| Preço de tabela da OpenAI |
$8 / $30 por 1M de tokens (entrada / saída) |
| Preço no GPTProto |
$6.4 / $24 por 1M de tokens (20% abaixo da tabela) |
| Acesso |
Uma chave GPTProto, sem verificação de organização da OpenAI |
GPT Image 2 vs Nano Banana Pro (e gpt-image-1.5)
| |
GPT Image 2 |
Nano Banana Pro |
GPT Image 1.5 |
| ID do modelo |
gpt-image-2 |
gemini-3-pro-image-preview |
gpt-image-1.5 |
| Fornecedor |
OpenAI |
Google |
OpenAI |
| Lançamento |
Abr 2026 |
Nov 2025 |
Dez 2025 |
| Resolução máxima |
2K nativo (variantes ~4K ) |
até 4K (4096px) |
2K |
| Texto na imagem |
Latim + CJK |
multilíngue, passagens longas |
melhorado em relação ao gpt-image-1 |
| Raciocínio |
pensamento agêntico |
Raciocínio do Gemini 3 + Search grounding |
nenhum |
| Entradas de referência |
até 16 imagens |
múltiplas imagens, identidade de ~5 assuntos |
menos |
| Preço de tabela OpenAI/Google |
$8 / $30 por 1M |
$2 / $12 por 1M |
$8 / $32 por 1M |
| Preço no GPTProto |
$6.4 / $24 por 1M |
$ 0.0804/ por vez |
$ 5.6 / $ 22.4 por 1M
|
| No GPTProto |
✓ |
✓ |
✓ |
Qual escolher (honestamente): Nano Banana Pro tem a menor tarifa por token, 4K nativo e geração fundamentada em busca — use-o quando custo, infográficos em 4K ou visuais com base no mundo real forem mais importantes. O GPT Image 2 se destaca no planejamento de layout agêntico, com até 16 imagens de referência e compatibilidade direta com o SDK da OpenAI — use-o para trabalhos de produto/embalagem com muitas referências que já estejam conectados à OpenAI. Como ambos usam o mesmo saldo no GPTProto, você pode compará-los com seus próprios prompts sem abrir uma segunda conta.
Migrando da API oficial da OpenAI
Se você já chama gpt-image-2 na OpenAI, migrar para o GPTProto é uma troca de URL base — o ID do modelo e o formato da requisição continuam os mesmos:
- Mantenha
model: "gpt-image-2" e o corpo da sua requisição images.generate / edit existente.
- Aponte o cliente para a URL base do GPTProto compatível com a OpenAI
https://gptproto.com/v1 e use sua chave GPTProto.
- Ignore a etapa de verificação de organização da OpenAI que protege a família GPT Image e dispense uma segunda conta de faturamento — o mesmo saldo cobre 200+ modelos.