GPT Image é a família de modelos de geração e edição de imagem da OpenAI que substituiu o DALL·E. O modelo atual é o gpt-image-2, lançado em 21 de abril de 2026, e a troca não foi incremental: enquanto o DALL·E 3 usava uma arquitetura de difusão isolada, o GPT Image opera sobre a arquitetura autorregressiva do GPT-4o, aceitando texto e imagens de referência no mesmo processo generativo. É isso que viabiliza a edição conversacional — pedir um ajuste e manter a cena. O DALL·E não é mais uma alternativa: o DALL·E 2 e o DALL·E 3 foram desligados da API em 12 de maio de 2026.
Linha do tempo das versões
| Modelo | Data | O que mudou |
|---|---|---|
| Geração nativa no ChatGPT (GPT-4o) | 25/03/2025 | Substitui o DALL·E 3 no ChatGPT; o fenômeno Ghibli |
gpt-image-1 | 23/04/2025 | Exposição do modelo na API |
gpt-image-1-mini | 06/10/2025 | Cerca de 80% mais barato |
gpt-image-1.5 | 16/12/2025 | Edições mais precisas, até 4x mais rápido |
gpt-image-2 | 21/04/2026 | Raciocínio antes de gerar, busca na web, 2K, texto denso em japonês, coreano, chinês, hindi e bengali |
⚠️ Prazo de desligamento a anotar
Quem tem integração em produção precisa migrar. Pela página oficial de deprecações da OpenAI, gpt-image-1 e gpt-image-1-mini saem da API em 1º de dezembro de 2026, com o gpt-image-2 como substituto recomendado. O snapshot atual é gpt-image-2-2026-04-21.
O fenômeno Ghibli e o que ele ensinou
O lançamento da geração nativa no ChatGPT, em março de 2025, produziu um dos maiores picos de adoção já registrados em um produto digital. Em uma semana, mais de 130 milhões de usuários geraram mais de 700 milhões de imagens — cerca de 100 milhões por dia —, com pico de 1 milhão de novos usuários por hora. Sam Altman pediu publicamente que o público desacelerasse, dizendo que as GPUs estavam derretendo.
Há uma distinção jurídica no episódio que interessa a quem produz conteúdo comercial: a OpenAI permite imitar o estilo de estúdios — Ghibli, Pixar —, mas bloqueia o estilo de artistas vivos individuais. A fronteira é entre estética coletiva e assinatura pessoal.
Vale notar o contraste: o Images 2.0, em abril de 2026, não repetiu o fenômeno — crescimento de 11% em downloads na semana e cerca de 1% em usuários diários ativos. A Índia liderou, com aproximadamente 5 milhões de downloads na semana de lançamento. Novidade técnica, sozinha, não reproduz viralização.
Especificações do gpt-image-2
- Dimensões flexíveis: borda máxima de 3.840px, ambas múltiplas de 16, proporção até 3:1, entre 655.360 e 8.294.400 pixels no total. Formatos comuns: 1024×1024, 1536×1024, 2048×2048, 3840×2160.
- Qualidades:
low,medium,higheauto. - Edição e inpainting com máscara pelo endpoint
v1/images/edits, com múltiplas imagens de referência. - Saída: PNG, JPEG e WebP, com streaming de previews parciais.
Uma regressão importante para quem produz peças de marketing: o gpt-image-2 não suporta fundo transparente, recurso que existia no gpt-image-1. Se seu fluxo depende de PNG com alpha para composição, teste antes de migrar.
Preços por imagem
| Tamanho | Low | Medium | High |
|---|---|---|---|
| 1024×1024 | US$ 0,006 | US$ 0,053 | US$ 0,211 |
| 1024×1536 / 1536×1024 | US$ 0,005 | US$ 0,041 | US$ 0,165 |
Por tokens, o gpt-image-2 custa US$ 8,00 por milhão na entrada de imagem e US$ 30,00 na saída, com metade do valor no modo batch. O gpt-image-1-mini, mais barato (US$ 2,50 / US$ 8,00), é justamente um dos que serão desligados. Os limites de requisição vão de 5 imagens por minuto no Tier 1 a 250 no Tier 5.
Proveniência: o ponto fraco em relação ao concorrente
A OpenAI integra o comitê diretor do C2PA e anexa Content Credentials — metadados de origem — às imagens geradas. A própria empresa reconhece que a solução não é definitiva, e a limitação é prática: metadado C2PA desaparece com um print de tela ou upload em rede social.
A diferença em relação ao Nano Banana, do Google, é relevante para quem precisa de rastreabilidade: o SynthID marca o próprio pixel e sobrevive a recorte e recompressão. Se conformidade de proveniência for requisito do seu setor, isso pesa na escolha.
Quando faz sentido usar
O GPT Image é a escolha natural para quem já opera dentro do ecossistema da OpenAI e quer geração acoplada ao mesmo fluxo de conversa — a edição multi-turno preservando a cena é o diferencial real ante ferramentas de difusão pura como o Stable Diffusion. Para composição com camadas e fundo transparente, avalie alternativas: a ausência de alpha no modelo atual é limitação concreta.
Para entender onde ele se encaixa frente aos concorrentes diretos, veja a comparação em modelos de IA, e para produção visual em escala, o guia de Adobe Firefly cobre o lado de integração com ferramentas de design.
Fontes
- Documentação do gpt-image-2 — OpenAI
- Tabela de preços da API — OpenAI
- Página de deprecações — OpenAI
- Guia de geração de imagem — OpenAI
- 700 milhões de imagens em uma semana — TechCrunch
- OpenAI no comitê diretor do C2PA — C2PA