FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5 Codex cobra US$ 10 por milhão de saída e não tem nota de IQ

Dois dias depois do lançamento, o modelo de código da OpenAI chega caro, sem benchmark público no catálogo e competindo contra o3 que custa o mesmo para pensar — e melhor em quase tudo.

Redação FalaVIP IA 3 min de leitura
US$ 10por milhão de tokens de saída
US$ 1,25por milhão de tokens de entrada
US$ 0,125por milhão de tokens em cache (10x mais barato)

O preço chegou antes da prova

Dois dias após o lançamento, o GPT-5 Codex já está no catálogo — mas a conta chegou antes da prova. A OpenAI está cobrando US$ 10 por milhão de tokens de saída e US$ 1,25 por milhão de tokens de entrada, com cache a US$ 0,125. É o mesmo preço de saída do o3, o modelo de raciocínio que lidera o ranking de inteligência do catálogo nesta data. A diferença é que o o3 entrega 31,096 de IQ e o Codex, até agora, não tem nota publicada.

Ficha técnica — GPT-5 Codex (batch)
CampoValor
Identificadoropenai/gpt-5-codex:batch
Criadoropenai
Preço de entradaUS$ 0.625 / M tokens
Preço de saídaUS$ 5.00 / M tokens
Janela de contexto400k
Modalidadetext+image->text
Leitura de cacheUS$ 0.063 / M (90% de desconto)

O que o catálogo mostra (e o que não mostra)

O GPT-5 Codex é descrito como uma versão especializada do GPT-5 voltada para fluxos de engenharia de software — sessões interativas de desenvolvimento e execução longa e autônoma de tarefas complexas. A janela é de 400 mil tokens, a modalidade é texto+imagem→texto e o corte de conhecimento é setembro de 2024. Não há nota de IQ, não há nota de coding, não há nota agentic, não há blended, não há velocidade, não há país de origem declarado. Para um modelo que custa caro e foi feito para uma tarefa específica, a ausência de benchmarks públicos no catálogo é um problema — você está pagando premium sem referência para comparar.

Quem compete com ele nesta data

O topo do catálogo hoje é liderado pelo o3 (IQ 31,096, US$ 8 por milhão de saída), seguido pelo gpt-oss-120b (IQ 24,126, US$ 0,17 por milhão de saída — 58 vezes mais barato na saída) e pelo Qwen3 Next 80B A3B Thinking (IQ 16,867, US$ 1,20 por milhão de saída). O gpt-oss-20b, da própria OpenAI, marca 15,225 de IQ por US$ 0,13 de saída.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 238 modelos disponíveis no catálogo nesta data.

Traduzindo: para cada modelo acima do Codex na lista de inteligência, existe uma opção mais barata — algumas ordens de grandeza mais barata. O o3, no mesmo preço de saída, é a comparação mais incômoda: é um modelo de raciocínio geral, não especializado em código, e lidera o ranking.

Para quem o Codex faz sentido

Se o seu fluxo é agente de código de longa duração — execução autônoma de tarefas de engenharia que duram horas — o argumento de venda do Codex é a otimização para esse perfil, não a nota em um benchmark genérico. Pagar US$ 10 de saída por isso é defensável se o trabalho realmente for agentic e se o ganho de velocidade/finalização compensar o o3 no mesmo orçamento. Para quem está usando a API para autocompletar, revisar PR ou gerar funções curtas, o o3 no mesmo preço entrega mais IQ medido; o gpt-oss-120b entrega 70% da inteligência do o3 por 2% do preço de saída.

Quando NÃO vale a pena

Se você não está rodando tarefas agentic longas, o Codex não se justifica pelo preço. Se você quer o melhor custo-benefício em código, o gpt-oss-120b é o padrão óbvio. Se você quer o topo absoluto de inteligência medida, o o3 lidera. O Codex só entra na conta quando "longa execução autônoma" é o caso de uso real — e mesmo assim, vale rodar um piloto com o3 antes de assumir que a especialização compensa o premium.

O que falta para decidir

A OpenAI não publicou, no catálogo, benchmark de coding nem agentic para o Codex. Sem isso, "otimizado para engenharia" é argumento de marketing, não dado. Até saírem números públicos, a comparação justa é: mesmo preço do o3, sem nota de IQ, sem nota de coding, sem nota agentic. A decisão racional, hoje, é esperar — ou testar com orçamento curto antes de migrar produção.

Em uma frase

Só vale a pena pagar US$ 10/M de saída no GPT-5 Codex se você roda agentes de código de longa duração; para o resto, o o3 no mesmo preço ou o gpt-oss-120b a US$ 0,17/M cobrem melhor.

Perguntas frequentes

Quanto custa o GPT-5 Codex na API?

US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com cache a US$ 0,125 por milhão — dez vezes mais barato que a entrada cheia.

O GPT-5 Codex tem benchmark de código publicado?

Não no catálogo. IQ, coding, agentic e blended estão sem nota; só a descrição oficial e os preços foram publicados até esta data.

GPT-5 Codex ou o3 para tarefas de programação?

Depende do tipo de tarefa. Para fluxos agentic longos e autônomos, o Codex foi otimizado para isso; para uso geral de código, o o3 lidera o ranking de IQ no mesmo preço de saída e é a comparação mais direta.

Leia também