Images 2.5 reduz latência, mas dobra preços por token na API
Publicado 09 de set. de 2026 · Leitura 2 min de leitura · Relevância 9.3

A OpenAI separou o GPT Image 2.5 em Flare e Sunburst, adicionou edição mais precisa e até 50% menos latência, enquanto as tarifas por token ficaram duas vezes maiores que no GPT Image 2.
O ganho de velocidade e controle pode reduzir retrabalho em fluxos visuais, mas a tarifa por token dobrou; o custo real precisa ser avaliado por imagem aprovada e não por chamada.
O que mudou
O ChatGPT Images 2.5 chegou com melhor preservação de referências, edições mais localizadas e maior consistência em sequências de ajustes. A OpenAI afirma redução de latência de até 50% frente ao Images 2.0.
Na API, Flare prioriza velocidade e qualidade comparável ao GPT Image 2, enquanto Sunburst prioriza fidelidade e precisão, com geração mais lenta. Ambos aceitam geração, edição, fundo transparente e os novos níveis de qualidade xhigh e max.
Custo e adoção
A tabela oficial cobra, por milhão de tokens, US$ 8 por entrada de imagem, US$ 2 por entrada em cache, US$ 30 por saída de imagem e US$ 5 por entrada de texto nos dois modelos 2.5. No GPT Image 2, os valores correspondentes são US$ 4, US$ 1, US$ 15 e US$ 2,50.
Isso representa o dobro da tarifa por token. Não significa automaticamente o dobro do custo por imagem: o total depende dos tokens consumidos, da qualidade e da resolução. Equipes devem medir custo por ativo concluído.
Segurança
No conjunto adversarial do system card, a taxa geral de imagens inseguras apresentadas foi de 1,09% no Sunburst e 1,41% no Flare, contra 1,64% no Images 2.0. Os testes não representam o tráfego real e diferenças por categoria nem sempre foram estatisticamente significativas.
Benchmarks independentes de latência e fidelidade, tokens consumidos por qualidade e resolução, custo por ativo final e estabilidade de edições em múltiplos turnos.