GPT-5.4 Image 2 cobra US$ 15 por milhão e não publica nota de inteligência
Modelo multimodal da OpenAI é mais caro que o Gemini 3.1 Pro Preview e o GPT-5.3-Codex e entra no catálogo sem benchmark de IQ.
OpenAI quer cobrar US$ 15 por milhão — e o modelo ainda não tem nota de inteligência publicada
US$ 15 por milhão de tokens de saída. É isso que a OpenAI está pedindo pelo GPT-5.4 Image 2, listado hoje (21 de abril de 2026) no catálogo. Para dimensionar: os dois únicos modelos com índice de inteligência acima de 45 custam menos. O Gemini 3.1 Pro Preview sai por US$ 12; o GPT-5.3-Codex, por US$ 14. E nenhum dos dois tem geração de imagem no meio da resposta.
O que ele faz, na prática
O release descreve como multimodal completo: recebe texto, imagem e arquivo, devolve texto e imagem numa única chamada. A proposta é fundir raciocínio, código e geração visual sem encadear duas APIs. É o tipo de modelo para quem precisa que a IA olhe um PDF, raciocine sobre o conteúdo e devolva um infográfico — em vez de rodar texto num modelo e imagem em outro.
A janela de contexto é de 272 mil tokens. Dá para enfiar um repositório inteiro e pedir um diagrama de arquitetura de volta, por exemplo.
O buraco na ficha: zero benchmark
Aqui é onde a conta aperta. O GPT-5.4 Image 2 entrou no catálogo sem índice de inteligência, sem nota de coding, sem agentic. Você está pagando US$ 15 por milhão sem conseguir comparar o raciocínio dele com nenhum dos modelos que já passaram pelos testes.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5.4-image-2 |
| Criador | openai |
| Preço de entrada | US$ 8.00 / M tokens |
| Preço de saída | US$ 15.00 / M tokens |
| Janela de contexto | 272k |
| Modalidade | text+image+file->text+image |
| Leitura de cache | US$ 2.00 / M (75% de desconto) |
Enquanto isso, os dois modelos acima de IQ 45 — Gemini 3.1 Pro Preview (47,738) e GPT-5.3-Codex (45,512) — têm preço de saída mais baixo e nota medida.
Onde ele se encaixa no tabuleiro de hoje
Olhando só o preço de saída, o GPT-5.4 Image 2 está acima dos líderes em texto e empatado na faixa do Codex. Abaixo dele, com folga, o Xiaomi MiMo-V2-Omni cobra US$ 2 por milhão — mas entrega IQ 35,866 e não gera imagem, é outro produto, para outro caso.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| GPT-5.4 Image 2 (o novo) | — | 8 | 15 | 272k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
Para quem vale — e para quem não muda nada
Vale se o seu fluxo já envolve gerar imagem a partir de raciocínio sobre documentos: relatório que vira infográfico, código que vira diagrama, planilha que vira dashboard visual. Nesses casos, eliminar o passo intermediário pode valer o prêmio de US$ 1 a US$ 3 por milhão em relação ao Codex ou ao Gemini.
Não muda nada se você só precisa de texto forte, código ou agentes. O GPT-5.3-Codex segue sendo a referência da própria OpenAI para código, custa US$ 14 por milhão e tem IQ 45,512 medido. Pagar US$ 15 por um modelo que pode render menos em texto para ganhar uma capacidade que você não vai usar não fecha a conta.
O que fazer agora
Se geração de imagem multimodal é gargalo real, faça um teste cego antes de migrar workload: pegue três dos seus prompts mais caros, rode no GPT-5.4 Image 2 e no fluxo atual (texto no Codex + imagem em outro modelo), e meça qualidade, latência e custo total. O prêmio só compensa se o ganho de fluxo pagar a diferença.
Se imagem não está no seu caminho, siga no GPT-5.3-Codex ou no Gemini 3.1 Pro Preview até alguém publicar um benchmark do Image 2. Comprar modelo multimodal caro no escuro é o tipo de decisão que aparece na fatura de maio.
Só vale trocar para o GPT-5.4 Image 2 se você já roda fluxo multimodal com geração de imagem; para texto e código, o Codex de US$ 14 entrega mais por menos até sair um benchmark.
Perguntas frequentes
Quanto custa o GPT-5.4 Image 2 na API?
Cobra US$ 8 por milhão de tokens de entrada, US$ 15 por milhão de tokens de saída e US$ 2 por milhão para leitura em cache. É mais caro que os dois únicos modelos com IQ acima de 45 no catálogo hoje.
O GPT-5.4 Image 2 tem índice de inteligência?
Não. O modelo entrou no catálogo sem nota de inteligência, de coding ou agentic. Não há como comparar diretamente com Gemini 3.1 Pro Preview ou GPT-5.3-Codex nesses critérios.
Para qual caso de uso o GPT-5.4 Image 2 faz sentido?
Workflows que combinam raciocínio sobre texto, código ou documentos com geração de imagem numa única chamada — por exemplo, relatório que vira infográfico ou código que vira diagrama.