FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.3 Chat cobra US$ 14 por milhão — o mesmo que o Codex, sem nota de QI

Lançado há oito dias, o modelo conversacional da OpenAI entra no catálogo sem medição de inteligência e disputa espaço com alternativas até 46 vezes mais baratas para o mesmo tipo de tarefa.

Redação FalaVIP IA 2 min de leitura
US$ 14,00por milhão de tokens de saída
US$ 0,175por milhão de tokens em cache
128.000 tokensde contexto

Oito dias no mercado e a pergunta que não sai da conta

Você está montando um agente de atendimento ou um assistente interno que vai rodar 24/7. A tentação é chamar o modelo mais recente da OpenAI. O GPT-5.3 Chat foi lançado em 3 de março e já está disponível via API. Só que o preço de saída — US$ 14 por milhão de tokens — é o mesmo do irmão GPT-5.3-Codex, e US$ 2 mais caro que o Gemini 3.1 Pro Preview, que carrega a maior nota de inteligência do catálogo nesta terça-feira, 11 de março.

Ficha técnica — GPT-5.3 Chat
CampoValor
Identificadoropenai/gpt-5.3-chat
Criadoropenai
Preço de entradaUS$ 1.75 / M tokens
Preço de saídaUS$ 14.00 / M tokens
Janela de contexto128k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.175 / M (90% de desconto)

O que o nome "Chat" esconde

A descrição oficial diz que o modelo torna "conversas cotidianas mais suaves, úteis e diretamente prestativas". Traduzindo: é o motor que move o ChatGPT para o usuário comum, portado para a API com a mesma experiência. A diferença para o Codex está na proposta — o Codex foi desenhado para programar e aparece no topo do ranking de inteligência com IQ 45,512 pelo mesmo preço. O Chat não tem nota de QI publicada no catálogo. Isso não é sentença de morte; é ponto cego. O catálogo ainda não mediu. Para quem decide pelo benchmark, é um espaço vazio na ficha.

Para US$ 14 por milhão de tokens, o que mais está no jogo?

O cenário de hoje reúne 362 modelos ativos de 53 criadores, com 31 lançamentos nos últimos 30 dias. No topo da inteligência, o Gemini 3.1 Pro Preview cobra US$ 12 por milhão de tokens de saída e marca IQ 47,738. Se a régua é economizar sem perder muita capacidade, o Qwen3.5 397B A17B entrega IQ 34,262 por US$ 2,34 por milhão. O Xiaomi MiMo-V2-Flash vai a US$ 0,30 por milhão com IQ 34,024 — quase 47 vezes mais barato na saída. São outros patamares de preço e outras conversas.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 362 modelos disponíveis no catálogo nesta data.

Para quem o GPT-5.3 Chat vale a pena

Se você já roda workloads na API da OpenAI, o upgrade é quase natural: continuidade do ecossistema, mesmos SDKs, mesma latência calibrada. A modalidade aceita texto, imagem e arquivo de entrada para gerar texto — uma flexibilidade que cobre a maioria dos casos de chatbot. E tem um detalhe que ajuda no volume: o preço de cache é US$ 0,175 por milhão, dez vezes mais barato que a entrada. Em workloads com prompts repetidos ou system prompts longos, isso muda a conta no fim do mês.

Para assistentes conversacionais, suporte ao cliente e ferramentas internas, a proposta de "conversa mais útil" é exatamente o que está no contrato.

Quando NÃO vale a pena

  • Tarefas puras de programação: o Codex é o mesmo preço e foi medido para isso.
  • Busca da maior inteligência bruta pelo menor preço: o Gemini 3.1 Pro Preview é mais barato e mais bem pontuado no catálogo.
  • Volume alto de tokens de saída sem estratégia de cache: a economia existe, mas US$ 14 por milhão de saída continua caro se a geração for longa.

O GPT-5.3 Chat não é mau negócio — é um negócio específico. A pergunta antes de bater o martelo: você está pagando pela conversa ou pelo nome na fatura?

Em uma frase

Se você já está no ecossistema OpenAI e precisa de multimodalidade barata em cache, faz sentido migrar para o GPT-5.3 Chat; para todo o resto, o catálogo de 11 de março mostra alternativas mais baratas e, em vários casos, com QI mais alto.

Perguntas frequentes

Quanto custa o GPT-5.3 Chat por token na API?

Cobra US$ 1,75 por milhão de tokens de entrada e US$ 14 por milhão de tokens de saída, com cache de US$ 0,175 por milhão — dez vezes mais barato que a entrada. Não há camada gratuita.

GPT-5.3 Chat é melhor que o Gemini 3.1 Pro Preview?

O catálogo de 11 de março não publicou nota de QI para o GPT-5.3 Chat, então não há como comparar diretamente pelo benchmark. O que dá para afirmar: o Gemini 3.1 Pro Preview custa US$ 12 por milhão de saída e tem IQ 47,738, acima de qualquer outro modelo listado.

Qual a diferença entre GPT-5.3 Chat e GPT-5.3 Codex?

Os dois custam US$ 14 por milhão de tokens de saída. O Codex foi desenhado para programação e aparece com IQ 45,512 no catálogo; o Chat é descrito como voltado a conversas cotidianas e ainda não tem nota publicada.

Leia também