FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

GPT-5.4 Image 2 cobra US$ 15 por milhão e não publica nota de inteligência

Modelo multimodal da OpenAI é mais caro que o Gemini 3.1 Pro Preview e o GPT-5.3-Codex e entra no catálogo sem benchmark de IQ.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de saída
272.000tokens de contexto
US$ 2por milhão de tokens em cache

OpenAI quer cobrar US$ 15 por milhão — e o modelo ainda não tem nota de inteligência publicada

US$ 15 por milhão de tokens de saída. É isso que a OpenAI está pedindo pelo GPT-5.4 Image 2, listado hoje (21 de abril de 2026) no catálogo. Para dimensionar: os dois únicos modelos com índice de inteligência acima de 45 custam menos. O Gemini 3.1 Pro Preview sai por US$ 12; o GPT-5.3-Codex, por US$ 14. E nenhum dos dois tem geração de imagem no meio da resposta.

Preço de saída (US$ por milhão de tokens)
GPT-5.4 Image 215Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

O que ele faz, na prática

O release descreve como multimodal completo: recebe texto, imagem e arquivo, devolve texto e imagem numa única chamada. A proposta é fundir raciocínio, código e geração visual sem encadear duas APIs. É o tipo de modelo para quem precisa que a IA olhe um PDF, raciocine sobre o conteúdo e devolva um infográfico — em vez de rodar texto num modelo e imagem em outro.

A janela de contexto é de 272 mil tokens. Dá para enfiar um repositório inteiro e pedir um diagrama de arquitetura de volta, por exemplo.

O buraco na ficha: zero benchmark

Aqui é onde a conta aperta. O GPT-5.4 Image 2 entrou no catálogo sem índice de inteligência, sem nota de coding, sem agentic. Você está pagando US$ 15 por milhão sem conseguir comparar o raciocínio dele com nenhum dos modelos que já passaram pelos testes.

Índice de inteligência (Artificial Analysis)
Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis
Ficha técnica — GPT-5.4 Image 2
CampoValor
Identificadoropenai/gpt-5.4-image-2
Criadoropenai
Preço de entradaUS$ 8.00 / M tokens
Preço de saídaUS$ 15.00 / M tokens
Janela de contexto272k
Modalidadetext+image+file->text+image
Leitura de cacheUS$ 2.00 / M (75% de desconto)

Enquanto isso, os dois modelos acima de IQ 45 — Gemini 3.1 Pro Preview (47,738) e GPT-5.3-Codex (45,512) — têm preço de saída mais baixo e nota medida.

Onde ele se encaixa no tabuleiro de hoje

Olhando só o preço de saída, o GPT-5.4 Image 2 está acima dos líderes em texto e empatado na faixa do Codex. Abaixo dele, com folga, o Xiaomi MiMo-V2-Omni cobra US$ 2 por milhão — mas entrega IQ 35,866 e não gera imagem, é outro produto, para outro caso.

Inteligência × preço de saída
Gemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
GPT-5.4 Image 2 (o novo)815272k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale — e para quem não muda nada

Vale se o seu fluxo já envolve gerar imagem a partir de raciocínio sobre documentos: relatório que vira infográfico, código que vira diagrama, planilha que vira dashboard visual. Nesses casos, eliminar o passo intermediário pode valer o prêmio de US$ 1 a US$ 3 por milhão em relação ao Codex ou ao Gemini.

Não muda nada se você só precisa de texto forte, código ou agentes. O GPT-5.3-Codex segue sendo a referência da própria OpenAI para código, custa US$ 14 por milhão e tem IQ 45,512 medido. Pagar US$ 15 por um modelo que pode render menos em texto para ganhar uma capacidade que você não vai usar não fecha a conta.

O que fazer agora

Se geração de imagem multimodal é gargalo real, faça um teste cego antes de migrar workload: pegue três dos seus prompts mais caros, rode no GPT-5.4 Image 2 e no fluxo atual (texto no Codex + imagem em outro modelo), e meça qualidade, latência e custo total. O prêmio só compensa se o ganho de fluxo pagar a diferença.

Se imagem não está no seu caminho, siga no GPT-5.3-Codex ou no Gemini 3.1 Pro Preview até alguém publicar um benchmark do Image 2. Comprar modelo multimodal caro no escuro é o tipo de decisão que aparece na fatura de maio.

Em uma frase

Só vale trocar para o GPT-5.4 Image 2 se você já roda fluxo multimodal com geração de imagem; para texto e código, o Codex de US$ 14 entrega mais por menos até sair um benchmark.

Perguntas frequentes

Quanto custa o GPT-5.4 Image 2 na API?

Cobra US$ 8 por milhão de tokens de entrada, US$ 15 por milhão de tokens de saída e US$ 2 por milhão para leitura em cache. É mais caro que os dois únicos modelos com IQ acima de 45 no catálogo hoje.

O GPT-5.4 Image 2 tem índice de inteligência?

Não. O modelo entrou no catálogo sem nota de inteligência, de coding ou agentic. Não há como comparar diretamente com Gemini 3.1 Pro Preview ou GPT-5.3-Codex nesses critérios.

Para qual caso de uso o GPT-5.4 Image 2 faz sentido?

Workflows que combinam raciocínio sobre texto, código ou documentos com geração de imagem numa única chamada — por exemplo, relatório que vira infográfico ou código que vira diagrama.

Leia também