FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.3-Codex chega a US$ 14 por milhão e fica abaixo do Gemini em inteligência

OpenAI posiciona o modelo como o mais avançado para coding agentico, mas a conta de saída sai US$ 2 mais cara que a do rival do Google — e o argumento de venda está no cache e na velocidade.

Redação FalaVIP IA 3 min de leitura
US$ 14por milhão de tokens de saída
US$ 0,175por milhão de tokens em cache (10× mais barato que o input)
45,512índice de inteligência — 2º do catálogo

GPT-5.3-Codex é o segundo modelo mais inteligente do catálogo e, ao mesmo tempo, o mais caro dos dois que estão no topo. Você leu certo: a OpenAI lança hoje um modelo que perde em QI para o Gemini 3.1 Pro Preview — e ainda cobra US$ 2 a mais por milhão de tokens de saída.

O que o release diz vs. o que a conta mostra

O material de lançamento chama o GPT-5.3-Codex de "modelo agentico de codificação mais avançado da OpenAI", combinando a performance de engenharia de software do GPT-5.2-Codex com o raciocínio amplo do GPT-5.2. Traduzindo: é um especialista em código que também serve para trabalho profissional geral. O problema é que, quando você olha o índice de inteligência do catálogo hoje, ele aparece em segundo lugar com 45,5 pontos — quase dois pontos atrás do Gemini 3.1 Pro Preview, que marca 47,7.

Índice de inteligência (Artificial Analysis)
GPT-5.3-Codex45,5Gemini 3.1 Pro Preview47,7índice
Fonte: Artificial Analysis

E a conta não melhora. O Codex cobra US$ 14 por milhão de tokens de saída, contra US$ 12 do Gemini. Em outras palavras: você paga mais caro para levar o modelo que pontua menos no ranking geral.

Onde ele entra no tabuleiro

O catálogo tem mais de 342 modelos listados hoje, de 52 criadores. Apenas dois passam da barreira de QI 45: o Gemini 3.1 Pro Preview e este Codex. Abaixo deles, há um precipício — o terceiro colocado, Claude Sonnet 4.6 da Anthropic, marca 35,1, e o quarto (Qwen 3.5 397B) fica em 34,3. Isso significa que, se você precisa de um modelo acima de QI 45, suas opções reais se resumem a dois — e nenhum dos dois é barato.

Para quem olha preço, o cenário é ainda mais desconfortável. O MiMo-V2-Flash da Xiaomi entrega QI 34,0 por US$ 0,30 por milhão de saída — quase cinquenta vezes mais barato que o Codex. A diferença de inteligência é de 11 pontos. Dependendo do seu caso de uso, essa conta pode fechar.

O trunfo que ninguém comenta: o cache

Se o Codex tem um argumento, ele está no preço de cache: US$ 0,175 por milhão de tokens, dez vezes mais barato que o input normal (US$ 1,75). Isso é relevante para fluxos agenticos que ficam reenviando o mesmo contexto — código de um repositório, documentação, histórico de conversa. Quem consegue manter o cache aquecido paga perto do preço de um modelo de mid-tier.

Preço de saída (US$ por milhão de tokens)
GPT-5.3-Codex14Gemini 3.1 Pro Preview12US$/M
Fonte: OpenRouter

A velocidade também joga a favor: 118 tokens por segundo contra 102 do Gemini. Em workflows agenticos onde o modelo fica gerando trechos de código em loop, essa diferença de 15% se acumula.

O que o Codex não faz (e o Gemini faz)

Aqui está o ponto que o release da OpenAI não destaca: o Codex é multimodal apenas para texto, imagem e arquivo. O Gemini 3.1 Pro Preview aceita áudio e vídeo como entrada também. Se o seu pipeline precisa transcrever uma reunião, analisar um vídeo ou processar um podcast, o Codex não serve — e você precisa manter outro modelo na stack.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
GPT-5.3-Codex (o novo)45.51.7514400k
Gemini 3.1 Pro Preview47.72121.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A janela de contexto também é menor: 400 mil tokens contra 1 milhão do Gemini. Para bases de código muito grandes ou sessões agenticas longas, isso pode ser um limitador real.

Para quem vale — e para quem não muda nada

Vale a pena se você está construindo um agente de codificação dentro do ecossistema OpenAI, faz uso intensivo de cache e valoriza velocidade de geração. O desconto de 10× no cache é o que separa esse modelo de um gasto insustentável.

Não vale se você precisa do QI mais alto absoluto (vá de Gemini), se seu fluxo depende de áudio ou vídeo, ou se o orçamento é o fator decisivo — nesse caso, um modelo de QI 34 a US$ 0,30/M pode resolver 80% do que você precisa por uma fração do custo.

Ficha técnica — GPT-5.3-Codex
CampoValor
Identificadoropenai/gpt-5.3-codex
Criadoropenai
Preço de entradaUS$ 1.75 / M tokens
Preço de saídaUS$ 14.00 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.175 / M (90% de desconto)
Índice de inteligência (AA)45.5
Pesosfechados
Velocidade de saída118 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

A pergunta que fica não é "o Codex é bom?". É: você tem workload agentico de código pesado o suficiente para justificar US$ 14 por milhão quando existe uma opção um pouco mais inteligente por US$ 12? Para a maioria, a resposta vai ser não — a menos que o cache mude a equação.

Em uma frase

Só adote o GPT-5.3-Codex se o seu fluxo agentico de código conseguir manter o cache aquecido — caso contrário, o Gemini 3.1 Pro Preview entrega mais QI por menos na saída.

Perguntas frequentes

GPT-5.3-Codex ou Gemini 3.1 Pro Preview: qual escolher para coding agentico?

Se velocidade e desconto agressivo de cache pesam mais, vá de Codex. Se você precisa do maior QI absoluto, de multimodalidade com áudio/vídeo ou de janela de contexto de 1 milhão de tokens, o Gemini 3.1 Pro Preview entrega mais por US$ 12/M de saída.

Quando o cache do GPT-5.3-Codex compensa?

Quando o mesmo contexto (repositório, documentação, histórico) é reutilizado em muitas chamadas seguidas. Nesse cenário, o custo efetivo cai para US$ 0,175/M — dez vezes menos que o input normal — e a conta se aproxima de modelos mid-tier.

Existe alternativa mais barata com QI parecido?

Não acima de QI 45. O próximo degrau é o Claude Sonnet 4.6 (QI 35,1) por US$ 15/M de saída. Se QI 34 resolve, o MiMo-V2-Flash da Xiaomi sai por US$ 0,30/M — quase 50× mais barato que o Codex.

Leia também