FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

GPT-5.3 Chat estreia a US$ 14/M, mesmo valor do Codex

A OpenAI não publicou IQ, coding nem agentic. A diferença na fatura está no cache, que cai a um décimo do preço de entrada.

Redação FalaVIP IA 3 min de leitura
US$ 14 / milhãopreço de saída do GPT-5.3 Chat
US$ 0,175 / milhãopreço de cache (10% da entrada)
128 mil tokensjanela de contexto

US$ 14 por milhão de tokens de saída. É o que a OpenAI está cobrando pelo GPT-5.3 Chat, anunciado nesta terça (3) como "evolução do modelo mais usado do ChatGPT". A descrição oficial fala em conversas "mais suaves, mais úteis e mais diretas". O detalhe que merece atenção é outro: o valor é exatamente o mesmo do GPT-5.3 Codex, o modelo da própria OpenAI que marca 45,5 no índice de inteligência. Sem benchmark publicado para o Chat, o que se paga agora é a embalagem, não a nota.

Ficha técnica — Gemini 3.1 Flash Lite Previe
CampoValor
Identificadorgoogle/gemini-3.1-flash-lite-preview
Criadorgoogle
Preço de entradaUS$ 0.250 / M tokens
Preço de saídaUS$ 1.50 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file+audio+video->text
Leitura de cacheUS$ 0.025 / M (90% de desconto)

O que ficou mais barato (e o que não)

O release promete "respostas mais precisas" e "melhor contextualização". A tabela de preços conta uma história mais modesta: a entrada, US$ 1,75 por milhão, é a mesma do Codex. A saída, US$ 14, também. Nada de corte de preço, nada de desconto de lançamento.

O item que mexe no bolso de verdade é o cache: US$ 0,175 por milhão de tokens, um décimo do preço de entrada. Em produto, isso aparece quando você repete o mesmo system prompt em milhares de chamadas — o tipo de economia que não aparece em benchmark, mas aparece na fatura do fim do mês.

A multimodalidade segue sendo texto, imagem e arquivo entrando, só texto saindo. Contexto de 128 mil tokens, igual ao do Codex. Quem já usava o modelo anterior pela integração com upload de arquivos e visão não ganha nem perde funcionalidade aqui.

Onde o Chat se encaixa no tabuleiro de hoje

O catálogo soma 352 modelos de 52 criadores, com 25 novidades nos últimos 30 dias. Não faltou opção em março. No topo do índice de inteligência, o Gemini 3.1 Pro Preview da Google marca 47,7 e custa US$ 12 por milhão de saída; logo atrás, o Codex da própria OpenAI com 45,5 a US$ 14; o Claude Sonnet 4.6 da Anthropic fecha o pódio com 35,1 a US$ 15.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Gemini 3.1 Flash Lite Previe (o novo)0.251.51.05M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
Claude Sonnet 4.635.13151M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.
Preço de saída (US$ por milhão de tokens)
Gemini 3.1 Flash Lite Previe1,5Gemini 3.1 Pro Preview12GPT-5.3-Codex14Claude Sonnet 4.615US$/M
Fonte: OpenRouter

A pergunta que não sai da fatura: a OpenAI está cobrando o mesmo do Chat e do Codex. Se o Chat render menos em raciocínio, a diferença é a embalagem conversacional. Se render igual, o "Chat" no nome é só rótulo de produto. Sem nota publicada, é impossível saber.

Pra quem vale a troca

  • Produtos conversacionais em produção, onde a "suavidade" da resposta pesa mais que nota de benchmark. Assistentes de atendimento, copilots de chat, ferramentas internas com prompts repetidos — esse é o terreno onde o cache de 10% vira economia real antes de qualquer upgrade de modelo.
  • Quem já está no ecossistema ChatGPT e quer a evolução sem trocar de SDK, de provedor ou de formato de mensagem.

Pra quem não muda nada

  • Quem usa o Codex para coding ou agentic: a versão Chat não foi posicionada como substituta, e sem benchmark não dá para afirmar que cobre o mesmo chão. Continua valendo o Codex para tarefas que exigem nota alta.
  • Quem busca o melhor QI por dólar: o Qwen3.5 397B A17B está a US$ 2,34 por milhão de saída, e o Xiaomi MiMo-V2-Flash a US$ 0,30 — ordens de grandeza abaixo. Sim, o índice de inteligência é outro (34,2 e 34,0), mas para muita coisa isso basta.
  • Quem precisa de áudio, vídeo ou raciocínio medido: nada disso está na ficha do Chat.

O que fazer agora

Se a sua escolha de modelo passa por "qual tem o melhor índice de inteligência por real gasto", espere. O GPT-5.3 Chat entra no catálogo sem IQ, sem coding e sem agentic — os três números que movem a régua da decisão. Quando (e se) saírem, aí você compara.

Se a sua escolha passa por "qual conversa melhor com o meu usuário", o caminho é teste A/B com tráfego real, não leitura de release. O preço não mudou, então a fatura não assusta; o ganho, se houver, vai aparecer na retenção, não no dashboard.

Em uma frase

Sem benchmark publicado, escolha o GPT-5.3 Chat só quando a prioridade for conversar melhor, não quando a prioridade for pensar mais — e meça em produção, porque a fatura não vai diferenciar.

Perguntas frequentes

GPT-5.3 Chat tem nota de inteligência publicada?

Não. No catálogo desta terça (3), o modelo aparece sem IQ, sem coding e sem agentic. Para comparar com o Gemini 3.1 Pro Preview (47,7) ou com o próprio Codex da OpenAI (45,5), é preciso esperar por uma medição independente.

Quanto custa o cache do GPT-5.3 Chat?

US$ 0,175 por milhão de tokens, um décimo do preço de entrada (US$ 1,75/M). Em produtos que repetem o mesmo system prompt em milhares de chamadas, isso muda a fatura mais do que qualquer upgrade de modelo.

Posso trocar o GPT-5.3 Codex pelo Chat?

Depende do uso. O Codex tem nota 45,5 no índice de inteligência e foi desenhado para coding e agentic; o Chat foi descrito como atualização de UX conversacional, sem benchmarks. Para tarefas que exigem nota alta, mantenha o Codex.

Leia também