GPT-5.1-Codex-Max chega a US$ 10 por Million de saída: o que muda na conta de coding
Modelo agentic da OpenAI estreia com contexto de 400 mil tokens e preço 25% acima do o3 — promete tarefas longas, mas a fatura sobe.
Saiu por US$ 10 a saída e US$ 1,25 a entrada. Antes de você pensar em trocar o o3, vale olhar o que esse número faz com a fatura de uma equipe de desenvolvimento que roda agentes o dia inteiro.
O que a OpenAI jogou no catálogo hoje
O GPT-5.1-Codex-Max apareceu no catálogo com um foco declarado: tarefas agentic de longa duração. A descrição oficial trata de um modelo construído sobre a stack de raciocínio 5.1, afinado para fluxos de software que envolvem múltiplas chamadas, edição de arquivos e iteração longa. A janela de contexto é de 400 mil tokens — bem acima do que a maioria dos rivais entrega hoje. A modalidade é texto e imagem como entrada, só texto como saída.
Em outras palavras: a OpenAI está vendendo contexto generoso e continuidade de raciocínio, não só um modelo que responde rápido.
O preço traduzido
A conta é direta: US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. O cache hit fica em US$ 0,125 — uma diferença de dez vezes em relação ao preço cheio, útil quando o agente repete o mesmo prompt do sistema ou as mesmas instruções de projeto várias vezes na mesma sessão.
O Codex-Max custa 25% mais caro na saída do que o o3, que sai por US$ 8 por milhão. Em comparação, o Claude Haiku 4.5 cobra US$ 5 de saída — metade do preço do lançamento de hoje. Quem roda tarefas agentic pesadas paga em tokens de saída; cada Mil tokens gerados a mais pesa.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5.1-codex-max |
| Criador | openai |
| Preço de entrada | US$ 1.25 / M tokens |
| Preço de saída | US$ 10.00 / M tokens |
| Janela de contexto | 400k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.125 / M (90% de desconto) |
Não existe custo fixo nem assinatura embutida: é consumo puro. E não há informação publicada sobre inteligência, latência ou velocidade, então qualquer comparação de qualidade hoje é chute.
Para quem vale a troca
Se o seu caso de uso é rodar agentes que precisam manter muito código carregado em contexto — refatoração de monorepo, migração de base inteira, agente que lê uma issue inteira e age sozinho por horas — a janela de 400 mil tokens faz sentido. É literalmente mais espaço para o agente respirar antes de truncar memória.
Se o que você roda são chamadas curtas, perguntas pontuais ou geração de snippets isolados, o o3 continua na prateleira por US$ 8 de saída. A diferença de 25% não se paga em prompts de 500 tokens.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| GPT-5.1-Codex-Max (o novo) | — | 1.25 | 10 | 400k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
E se preço é o critério — e para muita empresa pequena é — o gpt-oss-120b da própria OpenAI sai por US$ 0,17 por milhão de tokens de saída, quase sessenta vezes mais barato. Não é o mesmo produto, mas é a referência de quanto dá para economizar quando você não precisa de raciocínio pesado.
Onde ele se encaixa no tabuleiro
Olhando o topo do catálogo hoje, o ranking de inteligência continua dominado pelo o3 (31.096) e pelo Claude Haiku 4.5 (29.892), com o gpt-oss-120b em terceiro (24.126). O Codex-Max não traz índice publicado — então não dá para colocá-lo nessa régua agora. O que dá para dizer é a faixa de preço: ele entra acima do o3 e bem acima do Claude Haiku, ocupando um ponto de "premium para coding" que não tinha ninguém com esse contexto.
Os EUA seguem sendo a casa da maioria desses modelos top-tier, e a OpenAI mantém a estratégia de empilhar variantes especializadas em vez de canibalizar a linha principal.
O que fazer com isso
Se você roda agentes em produção e o gargalo é contexto estourando ou agente esquecendo o que combinou, vale testar o Codex-Max em um workload isolado antes de migrar. Meça tokens de saída por tarefa completada — é onde mora o custo. Se o agente terminar o trabalho em menos chamadas, os 25% a mais por token podem ser irrelevantes. Se terminar no mesmo número de chamadas que o o3, sua fatura sobe sem ganho.
Enquanto isso, o o3 segue sendo a referência em inteligência publicada no catálogo e o Claude Haiku 4.5 segue sendo a alternativa mais barata para quem quer sair da OpenAI sem perder raciocínio de ponta.
Rode um piloto em workload isolado e meça tokens de saída por tarefa concluída — só vale migrar do o3 se o agente precisar do contexto de 400 mil tokens.
Perguntas frequentes
Quanto custa o GPT-5.1-Codex-Max?
Custa US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com cache hit a US$ 0,125 por milhão. É 25% mais caro na saída do que o o3, que cobra US$ 8.
Vale trocar o o3 pelo Codex-Max?
Depende do workload. Se seus agentes rodam em tarefas longas que extrapolam janelas menores de contexto, a janela de 400 mil tokens pode compensar os 25% a mais. Para chamadas curtas, o o3 continua mais barato com inteligência publicada equivalente.
O GPT-5.1-Codex-Max é mais inteligente que o Claude Haiku 4.5?
Sem índice de inteligência publicado para o Codex-Max, não dá para afirmar. O Claude Haiku 4.5 marca 29.892 no ranking atual do catálogo, então é a referência de raciocínio da Anthropic no momento — e custa metade do preço de saída do Codex-Max.