FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5 Codex em modo batch custa 8 vezes menos que o o3

Lançado ontem, o GPT-5 Codex na fila batch sai a US$ 0,625 por milhão de tokens de entrada — e tem 400 mil de contexto. Para quem roda agente de código, a conta muda de figura.

Redação FalaVIP IA 3 min de leitura
US$ 0,625por milhão de tokens de entrada no batch
US$ 5,00por milhão de tokens de saída no batch
400.000tokens de contexto

O gancho é a fila, não o modelo

Você provavelmente viu o anúncio do GPT-5 Codex ontem e pensou em capacidade de programação. Faz sentido — é para isso que ele existe. Mas o detalhe que muda a conta no fim do mês não está no cérebro dele, está no modal em que ele foi listado: batch. A OpenAI não publicou preço para a versão interativa do Codex neste catálogo; o que está no card é a fila assíncrona, aquela em que você envia o trabalho, espera minutos ou horas e paga menos. É o mesmo modelo, é a mesma janela de contexto de 400 mil tokens, é a mesma especialização em engenharia de software — só muda a velocidade da resposta e o preço.

Traduzindo o que o card mostra: US$ 0,625 por milhão de tokens de entrada e US$ 5 por milhão de tokens de saída, com cache de leitura a US$ 0,0625 por milhão. Para colocar números que você sente no bolso, um agente que gasta 1 milhão de tokens de saída por mês sai por US$ 5,00 — não por hora, por mês, se for batch.

Ficha técnica — GPT-5 Codex
CampoValor
Identificadoropenai/gpt-5-codex
Criadoropenai
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 10.00 / M tokens
Janela de contexto400k
Modalidadetext+image->text
Leitura de cacheUS$ 0.125 / M (90% de desconto)

Quem ele está sentando do lado

O catálogo tem hoje 237 modelos ativos de 39 criadores, e 22 deles foram lançados nos últimos 30 dias. O Codex entra nesse bolo sem índice de inteligência publicado (o campo está vazio), então não dá para empilhá-lo no ranking de IQ que o catálogo mantém — e isso importa ser dito em vez de inventado. O que dá para fazer é comparar com quem está no topo da tabela hoje e quanto custa a referência.

O o3 da OpenAI lidera o ranking de inteligência com IQ 31,096 e cobra US$ 8 por milhão de tokens de saída. O gpt-oss-120b, também da OpenAI, marca IQ 24,126 e sai a US$ 0,17 por milhão de saída — mas é modelo aberto, perfil diferente. A Qwen aparece com o Qwen3 Next 80B A3B Thinking a IQ 16,867 e US$ 1,20 por milhão de saída. A Meta entra com o Llama 4 Maverick a IQ 14,477 e US$ 0,696 por milhão.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 237 modelos disponíveis no catálogo nesta data.

Sem nota de IQ para o Codex, a comparação honesta é pelo preço de saída em batch: US$ 5 contra US$ 8 do o3 — uma diferença de 37,5%. Não é o “45% mais barato” que releases adoram prometer, é um número que você reproduz na calculadora.

Para quem esse modelo vale a pena

Você roda agente de código que dispara dezenas de chamadas longas e pode esperar? O batch do GPT-5 Codex é candidato sério. O contexto de 400 mil tokens é o mesmo teto que outros modelos da casa operam, e a especialização em engenharia de software não é marketing vazio: a descrição do card diz explicitamente que ele foi otimizado para sessões interativas e para execução longa e independente de tarefas complexas — exatamente o perfil de quem usa batch.

Você quer resposta em tempo real no IDE, com latência de poucos segundos? Aí o card não te ajuda: o preço da versão interativa não foi publicado neste catálogo, e batch não serve para isso. Você precisa de modelo aberto para rodar local? Não é esse — Codex não tem pesos abertos nem parâmetros divulgados. Você quer o topo absoluto de inteligência medida? O o3 ainda lidera o ranking.

O que você faz com isso amanhã

Se você já paga API da OpenAI e tem fila de tarefas de código que podem esperar — refactor grande, geração de testes em massa, migração de código legado —, abra o playground batch e jogue um job real. Meça latência real, meça qualidade do diff, meça a conta. Se a fila batch do Codex entregar qualidade próxima do o3 por 37,5% menos no token de saída, a decisão é trocar o que dá para trocar e deixar o o3 só para o que precisa de resposta imediata ou do topo de IQ.

Se você não roda agente de código pesado, se sua conta de API é dominada por chat curto ou por tarefas que não podem esperar, esse card não muda nada para você esta semana.

Em uma frase

Troque o que puder para o batch do GPT-5 Codex e mantenha o o3 só para o que precisa de resposta na hora ou do topo de IQ medido.

Perguntas frequentes

Quanto custa o GPT-5 Codex no modo batch?

US$ 0,625 por milhão de tokens de entrada, US$ 5,00 por milhão de tokens de saída e US$ 0,0625 por milhão de tokens em cache de leitura. O preço da versão interativa não foi publicado neste catálogo.

GPT-5 Codex tem índice de inteligência no catálogo?

Não. O campo de IQ está vazio no card, então não dá para compará-lo diretamente com o o3, o Qwen3 ou o Llama 4 Maverick pelo ranking atual.

Quando vale a pena usar o batch do GPT-5 Codex em vez do o3?

Quando a tarefa de engenharia de software pode esperar minutos ou horas na fila batch e o orçamento pesa. O o3 continua sendo a referência para o topo de IQ medido e para respostas imediatas.

Leia também