GPT-5 Codex cobra US$ 10 por milhão de saída e não tem nota de IQ
Dois dias depois do lançamento, o modelo de código da OpenAI chega caro, sem benchmark público no catálogo e competindo contra o3 que custa o mesmo para pensar — e melhor em quase tudo.
O preço chegou antes da prova
Dois dias após o lançamento, o GPT-5 Codex já está no catálogo — mas a conta chegou antes da prova. A OpenAI está cobrando US$ 10 por milhão de tokens de saída e US$ 1,25 por milhão de tokens de entrada, com cache a US$ 0,125. É o mesmo preço de saída do o3, o modelo de raciocínio que lidera o ranking de inteligência do catálogo nesta data. A diferença é que o o3 entrega 31,096 de IQ e o Codex, até agora, não tem nota publicada.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5-codex:batch |
| Criador | openai |
| Preço de entrada | US$ 0.625 / M tokens |
| Preço de saída | US$ 5.00 / M tokens |
| Janela de contexto | 400k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.063 / M (90% de desconto) |
O que o catálogo mostra (e o que não mostra)
O GPT-5 Codex é descrito como uma versão especializada do GPT-5 voltada para fluxos de engenharia de software — sessões interativas de desenvolvimento e execução longa e autônoma de tarefas complexas. A janela é de 400 mil tokens, a modalidade é texto+imagem→texto e o corte de conhecimento é setembro de 2024. Não há nota de IQ, não há nota de coding, não há nota agentic, não há blended, não há velocidade, não há país de origem declarado. Para um modelo que custa caro e foi feito para uma tarefa específica, a ausência de benchmarks públicos no catálogo é um problema — você está pagando premium sem referência para comparar.
Quem compete com ele nesta data
O topo do catálogo hoje é liderado pelo o3 (IQ 31,096, US$ 8 por milhão de saída), seguido pelo gpt-oss-120b (IQ 24,126, US$ 0,17 por milhão de saída — 58 vezes mais barato na saída) e pelo Qwen3 Next 80B A3B Thinking (IQ 16,867, US$ 1,20 por milhão de saída). O gpt-oss-20b, da própria OpenAI, marca 15,225 de IQ por US$ 0,13 de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Traduzindo: para cada modelo acima do Codex na lista de inteligência, existe uma opção mais barata — algumas ordens de grandeza mais barata. O o3, no mesmo preço de saída, é a comparação mais incômoda: é um modelo de raciocínio geral, não especializado em código, e lidera o ranking.
Para quem o Codex faz sentido
Se o seu fluxo é agente de código de longa duração — execução autônoma de tarefas de engenharia que duram horas — o argumento de venda do Codex é a otimização para esse perfil, não a nota em um benchmark genérico. Pagar US$ 10 de saída por isso é defensável se o trabalho realmente for agentic e se o ganho de velocidade/finalização compensar o o3 no mesmo orçamento. Para quem está usando a API para autocompletar, revisar PR ou gerar funções curtas, o o3 no mesmo preço entrega mais IQ medido; o gpt-oss-120b entrega 70% da inteligência do o3 por 2% do preço de saída.
Quando NÃO vale a pena
Se você não está rodando tarefas agentic longas, o Codex não se justifica pelo preço. Se você quer o melhor custo-benefício em código, o gpt-oss-120b é o padrão óbvio. Se você quer o topo absoluto de inteligência medida, o o3 lidera. O Codex só entra na conta quando "longa execução autônoma" é o caso de uso real — e mesmo assim, vale rodar um piloto com o3 antes de assumir que a especialização compensa o premium.
O que falta para decidir
A OpenAI não publicou, no catálogo, benchmark de coding nem agentic para o Codex. Sem isso, "otimizado para engenharia" é argumento de marketing, não dado. Até saírem números públicos, a comparação justa é: mesmo preço do o3, sem nota de IQ, sem nota de coding, sem nota agentic. A decisão racional, hoje, é esperar — ou testar com orçamento curto antes de migrar produção.
Só vale a pena pagar US$ 10/M de saída no GPT-5 Codex se você roda agentes de código de longa duração; para o resto, o o3 no mesmo preço ou o gpt-oss-120b a US$ 0,17/M cobrem melhor.
Perguntas frequentes
Quanto custa o GPT-5 Codex na API?
US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com cache a US$ 0,125 por milhão — dez vezes mais barato que a entrada cheia.
O GPT-5 Codex tem benchmark de código publicado?
Não no catálogo. IQ, coding, agentic e blended estão sem nota; só a descrição oficial e os preços foram publicados até esta data.
GPT-5 Codex ou o3 para tarefas de programação?
Depende do tipo de tarefa. Para fluxos agentic longos e autônomos, o Codex foi otimizado para isso; para uso geral de código, o o3 lidera o ranking de IQ no mesmo preço de saída e é a comparação mais direta.