FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.4 custa US$ 15 por milhão de saída — e a conta não é o que parece

A OpenAI unificou as linhas Codex e GPT em um único modelo com contexto de 1M+ tokens. A questão é se vale migrar do Sonnet 4.6 ou do Gemini 3.1 Pro Preview.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de saída
US$ 2,50por milhão de tokens de entrada
US$ 0,25por milhão de tokens em cache

O que mudou em sete dias

Sete dias depois do lançamento, o GPT-5.4 ainda não tem índice de inteligência publicado no catálogo. Isso por si só já diz alguma coisa: em um mercado onde o top 5 aparece ranqueado, a ausência do flagship da OpenAI na lista é um buraco que você não pode ignorar. Enquanto isso, o irmão mais barato, o GPT-5.3-Codex, marca 45,512 de IQ ao preço de US$ 14 por milhão de saída — e o Gemini 3.1 Pro Preview da Google lidera com 47,738 a US$ 12.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 362 modelos disponíveis no catálogo nesta data.

A conta que o release esconde

O número que a OpenAI gosta de destacar é o cache: US$ 0,25 por milhão de tokens é agressivo, quase um terço do que se cobrava há pouco tempo. Mas o token de saída continua em US$ 15 por milhão — mesmo valor do GPT-5.3-Codex. Em tradução direta: se você está reenviando o mesmo prompt repetidamente (RAG, system prompt grande, agentes com contexto fixo), o cache paga. Se o seu caso de uso é geração pesada — código, texto longo, raciocínio extenso — a fatura vai se parecer muito com a do modelo anterior.

A entrada está em US$ 2,50 por milhão, também idêntica ao 5.3-Codex. Em um cenário típico de chat (3:1 entrada/saída), o custo médio ponderado fica em torno de US$ 4,40 por milhão de tokens — competitivo com o Gemini 3.1 Pro Preview, mas sem a liderança que o nome sugere.

Contexto de 1M+ tokens: presente ou armadilha?

A janela de 1.050.000 tokens é o chamariz. É a maior do catálogo entre os modelos frontier pagos, e ela chega com uma divisão clara: 922K de entrada, 128K de saída. Na prática, você consegue enfiar um repositório inteiro, uma base de código, ou um dump de documentação sem se preocupar com chunking agressivo.

Mas contexto grande não é de graça. Pagar US$ 2,50 por milhão de entrada significa que cada chamada com 500K tokens custa cerca de US$ 1,25 só para montar a janela — antes de gerar uma palavra. Para quem trabalha com documentos inteiros em loop, isso muda a conta. Para quem faz perguntas curtas, é dinheiro queimado.

Ficha técnica — GPT-5.4 (batch)
CampoValor
Identificadoropenai/gpt-5.4:batch
Criadoropenai
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 7.50 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.125 / M (90% de desconto)

Para quem vale — e para quem não muda nada

Vale migrar se você já roda GPT-5.3-Codex em produção e quer unificar a stack. A linha Codex foi absorvida: em vez de manter dois modelos (um para código, um para conversa), a OpenAI está empurrando tudo para um único endpoint. Para times pequenos que pagam a conta da API, menos modelos significa menos código de roteamento, menos chaves, menos surpresa no fim do mês.

Vale considerar se você está no Sonnet 4.6 e o motivo era o contexto longo. O Claude entrega 15 por milhão de saída com IQ de 35,108 — abaixo do Gemini, mas com reputação em raciocínio. O GPT-5.4 entra no mesmo preço de saída, com janela maior, e sem benchmark público para comparar. É uma troca cega até que apareçam números.

Não vale se você está feliz com o Gemini 3.1 Pro Preview. Pelo mesmo preço de saída (US$ 12 vs US$ 15), o Gemini lidera o ranking de inteligência e provavelmente continua sendo a escolha racional até o GPT-5.4 ganhar nota. E se o seu caso é velocidade e custo, o Xiaomi MiMo-V2-Flash a US$ 0,30 por milhão de saída entrega IQ de 34,024 — metade do caminho por 2% do preço.

O tabuleiro em 12 de março

O catálogo tem 362 modelos listados, 53 criadores, e 31 lançamentos nos últimos 30 dias. O GPT-5.4 entra em um mercado lotado, sem vantagem clara de preço nem de benchmark, apostando tudo em unificação de linha e janela de contexto. É um movimento de plataforma, não de performance.

Para quem escolhe modelo hoje: rode o GPT-5.4 em paralelo com o que você já usa por uma semana, meça custo real (não só o do release) e compare qualidade no seu caso específico. Sem índice de inteligência publicado, a única régua que importa é a sua.

Em uma frase

Se você já usa GPT-5.3-Codex, unifique a stack e ganhe simplicidade; se está no Gemini 3.1 Pro Preview, espere o benchmark aparecer antes de migrar.

Perguntas frequentes

Quanto custa o GPT-5.4 por milhão de tokens?

Entrada a US$ 2,50, saída a US$ 15 e cache a US$ 0,25 por milhão de tokens. É o mesmo preço de saída do GPT-5.3-Codex, então a economia real está no cache e na unificação da linha, não no token avulso.

O GPT-5.4 tem benchmark de inteligência publicado?

Não. No catálogo desta data, o GPT-5.4 aparece sem índice de inteligência, enquanto o GPT-5.3-Codex marca 45,512 e o Gemini 3.1 Pro Preview lidera com 47,738. Avalie no seu caso real antes de migrar.

Para que serve a janela de 1M+ tokens?

Serve para colocar repositórios inteiros, bases de código ou documentação volumosa em uma única chamada, sem chunking agressivo. O custo de entrada escala com o tamanho do prompt, então faz sentido em pipelines com contexto fixo grande e reuso via cache.

Leia também