FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

GPT-5.1-Codex-Max chega a US$ 10 por Million de saída: o que muda na conta de coding

Modelo agentic da OpenAI estreia com contexto de 400 mil tokens e preço 25% acima do o3 — promete tarefas longas, mas a fatura sobe.

Redação FalaVIP IA 3 min de leitura
US$ 10por milhão de tokens de saída
US$ 1,25por milhão de tokens de entrada
US$ 0,125cache hit por milhão de tokens

Saiu por US$ 10 a saída e US$ 1,25 a entrada. Antes de você pensar em trocar o o3, vale olhar o que esse número faz com a fatura de uma equipe de desenvolvimento que roda agentes o dia inteiro.

O que a OpenAI jogou no catálogo hoje

O GPT-5.1-Codex-Max apareceu no catálogo com um foco declarado: tarefas agentic de longa duração. A descrição oficial trata de um modelo construído sobre a stack de raciocínio 5.1, afinado para fluxos de software que envolvem múltiplas chamadas, edição de arquivos e iteração longa. A janela de contexto é de 400 mil tokens — bem acima do que a maioria dos rivais entrega hoje. A modalidade é texto e imagem como entrada, só texto como saída.

Preço de saída (US$ por milhão de tokens)
GPT-5.1-Codex-Max10o38Claude Haiku 4.55gpt-oss-120b0,17US$/M
Fonte: OpenRouter

Em outras palavras: a OpenAI está vendendo contexto generoso e continuidade de raciocínio, não só um modelo que responde rápido.

O preço traduzido

A conta é direta: US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. O cache hit fica em US$ 0,125 — uma diferença de dez vezes em relação ao preço cheio, útil quando o agente repete o mesmo prompt do sistema ou as mesmas instruções de projeto várias vezes na mesma sessão.

O Codex-Max custa 25% mais caro na saída do que o o3, que sai por US$ 8 por milhão. Em comparação, o Claude Haiku 4.5 cobra US$ 5 de saída — metade do preço do lançamento de hoje. Quem roda tarefas agentic pesadas paga em tokens de saída; cada Mil tokens gerados a mais pesa.

Ficha técnica — GPT-5.1-Codex-Max
CampoValor
Identificadoropenai/gpt-5.1-codex-max
Criadoropenai
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 10.00 / M tokens
Janela de contexto400k
Modalidadetext+image->text
Leitura de cacheUS$ 0.125 / M (90% de desconto)

Não existe custo fixo nem assinatura embutida: é consumo puro. E não há informação publicada sobre inteligência, latência ou velocidade, então qualquer comparação de qualidade hoje é chute.

Para quem vale a troca

Se o seu caso de uso é rodar agentes que precisam manter muito código carregado em contexto — refatoração de monorepo, migração de base inteira, agente que lê uma issue inteira e age sozinho por horas — a janela de 400 mil tokens faz sentido. É literalmente mais espaço para o agente respirar antes de truncar memória.

Se o que você roda são chamadas curtas, perguntas pontuais ou geração de snippets isolados, o o3 continua na prateleira por US$ 8 de saída. A diferença de 25% não se paga em prompts de 500 tokens.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
GPT-5.1-Codex-Max (o novo)1.2510400k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

E se preço é o critério — e para muita empresa pequena é — o gpt-oss-120b da própria OpenAI sai por US$ 0,17 por milhão de tokens de saída, quase sessenta vezes mais barato. Não é o mesmo produto, mas é a referência de quanto dá para economizar quando você não precisa de raciocínio pesado.

Onde ele se encaixa no tabuleiro

Olhando o topo do catálogo hoje, o ranking de inteligência continua dominado pelo o3 (31.096) e pelo Claude Haiku 4.5 (29.892), com o gpt-oss-120b em terceiro (24.126). O Codex-Max não traz índice publicado — então não dá para colocá-lo nessa régua agora. O que dá para dizer é a faixa de preço: ele entra acima do o3 e bem acima do Claude Haiku, ocupando um ponto de "premium para coding" que não tinha ninguém com esse contexto.

Índice de inteligência (Artificial Analysis)
o331,1Claude Haiku 4.529,9gpt-oss-120b24,1índice
Fonte: Artificial Analysis

Os EUA seguem sendo a casa da maioria desses modelos top-tier, e a OpenAI mantém a estratégia de empilhar variantes especializadas em vez de canibalizar a linha principal.

O que fazer com isso

Se você roda agentes em produção e o gargalo é contexto estourando ou agente esquecendo o que combinou, vale testar o Codex-Max em um workload isolado antes de migrar. Meça tokens de saída por tarefa completada — é onde mora o custo. Se o agente terminar o trabalho em menos chamadas, os 25% a mais por token podem ser irrelevantes. Se terminar no mesmo número de chamadas que o o3, sua fatura sobe sem ganho.

Enquanto isso, o o3 segue sendo a referência em inteligência publicada no catálogo e o Claude Haiku 4.5 segue sendo a alternativa mais barata para quem quer sair da OpenAI sem perder raciocínio de ponta.

Em uma frase

Rode um piloto em workload isolado e meça tokens de saída por tarefa concluída — só vale migrar do o3 se o agente precisar do contexto de 400 mil tokens.

Perguntas frequentes

Quanto custa o GPT-5.1-Codex-Max?

Custa US$ 1,25 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com cache hit a US$ 0,125 por milhão. É 25% mais caro na saída do que o o3, que cobra US$ 8.

Vale trocar o o3 pelo Codex-Max?

Depende do workload. Se seus agentes rodam em tarefas longas que extrapolam janelas menores de contexto, a janela de 400 mil tokens pode compensar os 25% a mais. Para chamadas curtas, o o3 continua mais barato com inteligência publicada equivalente.

O GPT-5.1-Codex-Max é mais inteligente que o Claude Haiku 4.5?

Sem índice de inteligência publicado para o Codex-Max, não dá para afirmar. O Claude Haiku 4.5 marca 29.892 no ranking atual do catálogo, então é a referência de raciocínio da Anthropic no momento — e custa metade do preço de saída do Codex-Max.

Leia também