GPT-5.3 Chat estreia a US$ 14/M, mesmo valor do Codex
A OpenAI não publicou IQ, coding nem agentic. A diferença na fatura está no cache, que cai a um décimo do preço de entrada.
US$ 14 por milhão de tokens de saída. É o que a OpenAI está cobrando pelo GPT-5.3 Chat, anunciado nesta terça (3) como "evolução do modelo mais usado do ChatGPT". A descrição oficial fala em conversas "mais suaves, mais úteis e mais diretas". O detalhe que merece atenção é outro: o valor é exatamente o mesmo do GPT-5.3 Codex, o modelo da própria OpenAI que marca 45,5 no índice de inteligência. Sem benchmark publicado para o Chat, o que se paga agora é a embalagem, não a nota.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-flash-lite-preview |
| Criador | |
| Preço de entrada | US$ 0.250 / M tokens |
| Preço de saída | US$ 1.50 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.025 / M (90% de desconto) |
O que ficou mais barato (e o que não)
O release promete "respostas mais precisas" e "melhor contextualização". A tabela de preços conta uma história mais modesta: a entrada, US$ 1,75 por milhão, é a mesma do Codex. A saída, US$ 14, também. Nada de corte de preço, nada de desconto de lançamento.
O item que mexe no bolso de verdade é o cache: US$ 0,175 por milhão de tokens, um décimo do preço de entrada. Em produto, isso aparece quando você repete o mesmo system prompt em milhares de chamadas — o tipo de economia que não aparece em benchmark, mas aparece na fatura do fim do mês.
A multimodalidade segue sendo texto, imagem e arquivo entrando, só texto saindo. Contexto de 128 mil tokens, igual ao do Codex. Quem já usava o modelo anterior pela integração com upload de arquivos e visão não ganha nem perde funcionalidade aqui.
Onde o Chat se encaixa no tabuleiro de hoje
O catálogo soma 352 modelos de 52 criadores, com 25 novidades nos últimos 30 dias. Não faltou opção em março. No topo do índice de inteligência, o Gemini 3.1 Pro Preview da Google marca 47,7 e custa US$ 12 por milhão de saída; logo atrás, o Codex da própria OpenAI com 45,5 a US$ 14; o Claude Sonnet 4.6 da Anthropic fecha o pódio com 35,1 a US$ 15.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Gemini 3.1 Flash Lite Previe (o novo) | — | 0.25 | 1.5 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| Claude Sonnet 4.6 | 35.1 | 3 | 15 | 1M |
A pergunta que não sai da fatura: a OpenAI está cobrando o mesmo do Chat e do Codex. Se o Chat render menos em raciocínio, a diferença é a embalagem conversacional. Se render igual, o "Chat" no nome é só rótulo de produto. Sem nota publicada, é impossível saber.
Pra quem vale a troca
- Produtos conversacionais em produção, onde a "suavidade" da resposta pesa mais que nota de benchmark. Assistentes de atendimento, copilots de chat, ferramentas internas com prompts repetidos — esse é o terreno onde o cache de 10% vira economia real antes de qualquer upgrade de modelo.
- Quem já está no ecossistema ChatGPT e quer a evolução sem trocar de SDK, de provedor ou de formato de mensagem.
Pra quem não muda nada
- Quem usa o Codex para coding ou agentic: a versão Chat não foi posicionada como substituta, e sem benchmark não dá para afirmar que cobre o mesmo chão. Continua valendo o Codex para tarefas que exigem nota alta.
- Quem busca o melhor QI por dólar: o Qwen3.5 397B A17B está a US$ 2,34 por milhão de saída, e o Xiaomi MiMo-V2-Flash a US$ 0,30 — ordens de grandeza abaixo. Sim, o índice de inteligência é outro (34,2 e 34,0), mas para muita coisa isso basta.
- Quem precisa de áudio, vídeo ou raciocínio medido: nada disso está na ficha do Chat.
O que fazer agora
Se a sua escolha de modelo passa por "qual tem o melhor índice de inteligência por real gasto", espere. O GPT-5.3 Chat entra no catálogo sem IQ, sem coding e sem agentic — os três números que movem a régua da decisão. Quando (e se) saírem, aí você compara.
Se a sua escolha passa por "qual conversa melhor com o meu usuário", o caminho é teste A/B com tráfego real, não leitura de release. O preço não mudou, então a fatura não assusta; o ganho, se houver, vai aparecer na retenção, não no dashboard.
Sem benchmark publicado, escolha o GPT-5.3 Chat só quando a prioridade for conversar melhor, não quando a prioridade for pensar mais — e meça em produção, porque a fatura não vai diferenciar.
Perguntas frequentes
GPT-5.3 Chat tem nota de inteligência publicada?
Não. No catálogo desta terça (3), o modelo aparece sem IQ, sem coding e sem agentic. Para comparar com o Gemini 3.1 Pro Preview (47,7) ou com o próprio Codex da OpenAI (45,5), é preciso esperar por uma medição independente.
Quanto custa o cache do GPT-5.3 Chat?
US$ 0,175 por milhão de tokens, um décimo do preço de entrada (US$ 1,75/M). Em produtos que repetem o mesmo system prompt em milhares de chamadas, isso muda a fatura mais do que qualquer upgrade de modelo.
Posso trocar o GPT-5.3 Codex pelo Chat?
Depende do uso. O Codex tem nota 45,5 no índice de inteligência e foi desenhado para coding e agentic; o Chat foi descrito como atualização de UX conversacional, sem benchmarks. Para tarefas que exigem nota alta, mantenha o Codex.