FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.2-Codex cobra US$ 14 por milhão de saída — sem benchmark no catálogo

Modelo da OpenAI para coding e agentic entra mais caro que o o3 e sem nota de IQ publicada no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 14por milhão de tokens de saída
US$ 0,175por milhão de tokens de cache (10x mais barato que a entrada)
400 miltokens de contexto

US$ 14 por milhão de tokens de saída

Pega o extrato da API e multiplica: a OpenAI posicionou o GPT-5.2-Codex no topo do seu catálogo de cobrança. O custo de saída é de US$ 14 por milhão de tokens — quase o dobro do o3 (US$ 8) e quase três vezes o Claude Haiku 4.5 (US$ 5). A entrada sai por US$ 1,75 por milhão. Para uma sessão longa de coding ou agente autônomo que cuspa logs e diffs extensos, a conta pesa diferente de uma chamada curta de autocomplete.

O modelo é apresentado como evolução do GPT-5.1-Codex, otimizado para engenharia de software e fluxos de coding. A ficha diz text+image→text, 400 mil tokens de contexto e suporte tanto para sessões interativas quanto para execução independente de tarefas longas. É, no papel, o mesmo nicho do Devstral 2 2512 da Mistral — só que sem o mesmo preço de prateleira.

Ficha técnica — GPT-5.2-Codex
CampoValor
Identificadoropenai/gpt-5.2-codex
Criadoropenai
Preço de entradaUS$ 1.75 / M tokens
Preço de saídaUS$ 14.00 / M tokens
Janela de contexto400k
Modalidadetext+image->text
Leitura de cacheUS$ 0.175 / M (90% de desconto)

O detalhe que muda a conta de verdade

O preço de cache é US$ 0,175 por milhão de tokens — dez vezes mais barato que a entrada. Em sessões longas de agentic coding, onde o mesmo trecho de código, instruções e histórico é relido a cada passo, é isso que de fato reduz a fatura. Pense no cache como a memória de curto prazo do modelo: o primeiro acesso custa caro, todo o resto aproveita o que já foi lido. Se o seu fluxo é "carrega repositório uma vez, itera 200x", o cache paga o modelo premium. Se o seu fluxo é "uma chamada curta e descarta", você está pagando caro à toa — a entrada inteira cai no preço cheio.

Onde ele senta no tabuleiro

O catálogo tem hoje mais de 315 modelos — esse número é um piso, só conta o que ainda está listado. O GPT-5.2-Codex chega sem nota de IQ, sem benchmark de coding e sem score agentic publicados na ficha. Comparação direta com outros modelos fica, portanto, impossível sem teste próprio. Enquanto isso, o topo da régua atual mostra o Xiaomi MiMo-V2-Flash com IQ 34,024 a US$ 0,30 por milhão de saída, o o3 da própria OpenAI com IQ 31,096 a US$ 8 e o Claude Haiku 4.5 com IQ 29,892 a US$ 5. Em outras palavras: o Codex entra mais caro que qualquer um deles e sem número que prove ser melhor.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 315 modelos disponíveis no catálogo nesta data.

Para quem vale e para quem não muda nada

Vale a pena se:

  • Você já roda agentic coding sério contra código proprietário, e o cache a US$ 0,175/M realmente reduz o custo marginal.
  • Você precisa processar imagem (text+image→text) e 400k de contexto em uma só chamada, e já testou o o3 e achou insuficiente.
  • Você paga a conta como despesa fixa e prefere trocar benchmark por tempo de engenharia economizado.

Não muda nada se:

  • Seu uso é completar função curta ou pair-programming leve — o o3 a US$ 8/M sai mais barato e tem inteligência próxima.
  • O volume é alto e o orçamento aperta — Xiaomi MiMo-V2-Flash (US$ 0,30/M) e gpt-oss-120b (US$ 0,17/M) ficam na mesa.
  • Você já roda Devstral 2 2512 da Mistral para coding e está satisfeito — não há argumento de preço para trocar, o Devstral custa um sétimo do Codex.

O que fazer com isso hoje

Roda um piloto curto com cache habilitado e mede custo efetivo por tarefa, não por token. Se a economia do cache não compensar o prêmio de US$ 14/M de saída frente ao o3 ou ao Haiku 4.5, fica no que já tem. Se compensar, é o caso clássico de pagar caro porque o trabalho de engenharia que o modelo tira do caminho vale mais que a diferença na fatura.

Em uma frase

Com cache habilitado e tarefas longas, o prêmio do GPT-5.2-Codex se dilui; em chamada curta, ele some rápido na fatura. Pilote antes de migrar.

Perguntas frequentes

Quanto custa o GPT-5.2-Codex na API?

US$ 1,75 por milhão de tokens de entrada e US$ 14 por milhão de saída. O cache sai a US$ 0,175 por milhão — dez vezes mais barato que a entrada, e é o que reduz a fatura em sessões longas de agentic coding.

GPT-5.2-Codex é melhor que o o3?

O catálogo não publicou IQ nem benchmark de coding para nenhum dos dois nesta data. O o3 aparece com IQ 31,096 e custa US$ 8/M de saída — quase metade do Codex. A comparação de qualidade só sai com teste próprio.

Vale trocar o Devstral pelo GPT-5.2-Codex?

Depende do que você roda. O Devstral 2 2512 custa US$ 2/M de saída, tem IQ 19,242 e foco em coding; o Codex custa US$ 14/M sem IQ publicado. A diferença é de sete vezes no preço — sem benchmark público do Codex, a troca é um ato de fé.

Leia também