FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.2 Chat cobra US$ 14 por milhão de saída: vale pelo resto?

O membro "leve" da família 5.2 chega sem benchmark público e preço de modelo premium — o que ele entrega de fato para quem paga a API.

Redação FalaVIP IA 3 min de leitura
US$ 14por milhão de tokens de saída
US$ 1,75por milhão de tokens de entrada
US$ 0,175por milhão de tokens em cache (10x mais barato que a entrada)

Você abriu o painel da OpenAI, viu "GPT-5.2 Chat" na lista e o primeiro instinto foi trocar o modelo padrão por ele. Antes de fazer isso, vale olhar para o preço: US$ 14 por milhão de tokens de saída e US$ 1,75 por milhão de entrada. É a mesma faixa do o3, que aparece em segundo lugar no índice de inteligência do catálogo hoje, com IQ 31,096 — só que o o3 é explicitamente um modelo de raciocínio, enquanto o 5.2 Chat se vende como "leve e rápido para chat de baixa latência". É uma combinação estranha para o seu bolso.

Ficha técnica — GPT-5.2 Chat
CampoValor
Identificadoropenai/gpt-5.2-chat
Criadoropenai
Preço de entradaUS$ 1.75 / M tokens
Preço de saídaUS$ 14.00 / M tokens
Janela de contexto128k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.175 / M (90% de desconto)

O que a OpenAI está te pedindo para confiar

A ficha técnica entregue pela própria OpenAI descreve o 5.2 Chat como "rápido, leve, otimizado para baixa latência, com raciocínio adaptativo". Bonito no release, mas tem um problema: o catálogo não publicou índice de inteligência, nota de coding nem de agentic para esse modelo. Você está comprando um produto cujo desempenho relativo ninguém mediu de forma padronizada até agora. Em outras palavras, é a OpenAI pedindo para você confiar na marca enquanto os números ainda não existem.

Compare com o que você consegue medir hoje. O topo do catálogo nesta data tem o Xiaomi MiMo-V2-Flash com IQ 34,024 e custo de US$ 0,30 por milhão de saída — quase 47 vezes mais barato que o 5.2 Chat. Logo abaixo vem o o3, da própria OpenAI, com IQ 31,096 e US$ 8 por milhão de saída. O Claude Haiku 4.5, da Anthropic, marca IQ 29,892 a US$ 5 por milhão de saída. São três modelos com índice publicado, mais baratos e, no caso do Haiku, com a mesma proposta de "leve e rápido para chat".

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 313 modelos disponíveis no catálogo nesta data.

Para quem o 5.2 Chat faz sentido

Se você já roda workloads na infraestrutura da OpenAI e precisa de um modelo "default" com baixo tempo de resposta para atendimento ao cliente, agentes internos ou assistentes embarcados em produto, o 5.2 Chat entra na conversa por uma razão específica: o cache de US$ 0,175 por milhão de tokens é 10 vezes mais barato que a entrada. Em sistemas que repetem o mesmo system prompt milhares de vezes por dia — qualquer RAG com prompt fixo, qualquer chatbot corporativo — esse desconto de cache paga a conta. É o mesmo mecanismo que torna o cache do o3 competitivo, só que aqui o "modelo de chat" provavelmente é mais previsível em latência.

Fora desse cenário, a conta não fecha. Para tarefas de raciocínio pesado, o o3 da própria casa é mais barato na saída (US$ 8 contra US$ 14) e tem benchmark público. Para custo agressivo em alto volume, o MiMo-V2-Flash da Xiaomi entrega o melhor índice do catálogo por uma fração do preço. Para o nicho de "Haiku equivalente", o Claude Haiku 4.5 cobra US$ 5 por milhão de saída e tem IQ medido.

O que ninguém te conta no anúncio

A OpenAI não publicou país de origem, número de parâmetros, velocidade em tokens por segundo nem data de corte de conhecimento do 5.2 Chat. Em um mercado onde 48 criadores competem com 313 modelos listados, a ausência desses dados não é detalhe — é sinal de que o produto ainda está sendo posicionado. Você está adotando um modelo que a própria OpenAI ainda não mediu contra os concorrentes no índice que usamos como referência.

O que fazer com isso na segunda-feira

Se você roda chat de alto volume com prompt repetido, ligue o cache e teste o 5.2 Chat em 10% do tráfego antes de migrar. Se você precisa de raciocínio, continue no o3. Se você quer pagar menos sem perder qualidade de chat, vá de Haiku 4.5 ou MiMo-V2-Flash. E se a sua decisão depende de benchmark, espere: até a OpenAI publicar números comparáveis, o 5.2 Chat é um ato de fé com preço de modelo premium.

Em uma frase

Só vale trocar pelo 5.2 Chat se você já roda alto volume de chat na OpenAI e consegue explorar o cache de US$ 0,175 por milhão; para todo o resto, há opção mais barata e com benchmark público.

Perguntas frequentes

Quanto custa o GPT-5.2 Chat na API?

US$ 1,75 por milhão de tokens de entrada, US$ 14 por milhão de tokens de saída e US$ 0,175 por milhão em cache — dez vezes mais barato que a entrada, o que é o principal atrativo do modelo.

GPT-5.2 Chat tem benchmark de inteligência publicado?

Não. O catálogo consultado nesta data não traz índice de inteligência, coding nem agentic para o 5.2 Chat, ao contrário de modelos como o3, Claude Haiku 4.5 e MiMo-V2-Flash, que aparecem com notas públicas.

GPT-5.2 Chat substitui o o3?

Para tarefas de raciocínio pesado, não: o o3 custa US$ 8 por milhão de saída (quase metade do preço do 5.2 Chat) e tem índice de inteligência medido. O 5.2 Chat faz mais sentido como default de baixa latência com cache barato.

Leia também