FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.2 batch custa US$ 7 por milhão e ainda não tem IQ publicado

Dez dias depois do lançamento, o modo assíncrono do novo modelo da OpenAI entra num mercado em que o Xiaomi MiMo lidera o ranking de inteligência medida por um quarto do preço.

Redação FalaVIP IA 3 min de leitura
US$ 0,875por milhão de tokens de entrada
US$ 7,00por milhão de tokens de saída
400.000tokens de contexto

O que o release diz vs. o que a fatura mostra

A OpenAI chamou o GPT-5.2 de "frontier-grade" e prometeu raciocínio adaptativo, melhor performance agentic e janela de contexto maior. Dez dias depois, o que aparece no catálogo é a versão :batch — o modo assíncrono da API, que processa em lote e normalmente cobra menos. Só que o preço publicado não é exatamente "menos": US$ 0,875 por milhão de tokens de entrada e US$ 7 por milhão de tokens de saída. Compare com o o3, que está em US$ 8 por milhão de saída, e a diferença some. Mais importante: o GPT-5.2 não tem IQ medido no índice do catálogo. Você está pagando tarifa de top-tier sem ter um número que confirme que ele é top-tier.

Ficha técnica — GPT-5.2
CampoValor
Identificadoropenai/gpt-5.2
Criadoropenai
Preço de entradaUS$ 1.75 / M tokens
Preço de saídaUS$ 14.00 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.175 / M (90% de desconto)

A grande sacada (e o grande asterisco) do batch

O :batch não é a versão em tempo real do modelo. É a versão que você envia agora e recebe horas depois, em jobs de até 24 horas. A vantagem tradicional do batch é o desconto sobre o preço cheio — aqui, o "cheio" do GPT-5.2 síncrono não está publicado no catálogo, então não dá para cravar a economia real. O que está publicado é o preço do batch, e é com ele que você fecha a conta. Para quem roda pipelines de madrugada processando milhares de documentos, esse modo é útil. Para quem precisa de resposta em 500 ms, não é o mesmo modelo.

Onde o GPT-5.2 batch se diferencia mesmo é em três números: 400 mil tokens de contexto — uma das maiores janelas do catálogo —, US$ 0,0875 por milhão de tokens em cache hit (dez vezes mais barato que a entrada) e a modalidade texto + imagem + arquivo → texto. A combinação "contexto gigante + cache barato" é o cenário clássico de RAG pesado, análise de bases inteiras de código ou revisão de documentos longos em lote.

Onde ele se encaixa no tabuleiro de hoje

Olhando o topo do catálogo nesta data, o ranking de inteligência medida está curioso: o Xiaomi MiMo-V2-Flash lidera com IQ 34,024 a US$ 0,30 por milhão de saída. O OpenAI o3 está em segundo, com IQ 31,096 a US$ 8. O Claude Haiku 4.5 vem logo atrás, com IQ 29,892 a US$ 5. O GPT-5.2 batch entra nesse intervalo de preço — US$ 7 de saída — mas sem número de IQ. É mais caro que o Haiku 4.5 e mais barato que o o3, só que nenhum dos dois traz 400K de contexto declarado nos dados.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 309 modelos disponíveis no catálogo nesta data.

Tradução direta: você está pagando o preço de "fronteira" da OpenAI sem ter como comparar a inteligência no mesmo índice. Num mercado em que Xiaomi e OpenAI disputam a ponta, a métrica que vai decidir a compra vai ser outra — contexto máximo, multimodalidade, estabilidade de SLA e qualidade em agente.

Para quem vale a pena

  • Pipelines batch de análise de código, contratos ou papers longos, onde os 400K de contexto eliminam a etapa de chunking.
  • Sistemas RAG com cache de instruções pesadas — o preço de hit em US$ 0,0875/M está entre os mais baixos do catálogo.
  • Workloads agentic em que o tempo de resposta não é crítico e a OpenAI tem track record de estabilidade.

Para quem NÃO faz sentido

  • Qualquer coisa em tempo real. O batch retorna em horas, não em segundos.
  • Times que escolhem modelo por benchmark público. Sem IQ publicado, você está decidindo no escuro.
  • Projetos sensíveis a custo por chamada, em que o Xiaomi MiMo ou o gpt-oss-120b já entregam inteligência medida suficiente para a maioria dos casos por uma fração do preço.

Implicação prática

Espere uma semana. Se o índice de IQ do catálogo publicar o número do GPT-5.2 batch, ele entra na conta com peso. Se não publicar, trate como um modelo OpenAI caro e sem lastro comparativo — o que é, aliás, exatamente o que a fatura da API vai refletir.

Em uma frase

Use o GPT-5.2 batch só em jobs de contexto longo que toleram espera; para qualquer coisa que precisa de benchmark público, resposta em tempo real ou custo baixo por chamada, há alternativa mais barata no mesmo catálogo.

Perguntas frequentes

GPT-5.2 batch é mais barato que o o3?

Pouco. O o3 custa US$ 8 por milhão de tokens de saída e o GPT-5.2 batch sai por US$ 7 — diferença de um dólar. O o3 tem IQ medido de 31,096 e o GPT-5.2 ainda não tem IQ publicado. Sem esse número, a troca só se justifica se você precisa dos 400K de contexto que o o3 não traz no catálogo.

O que significa ":batch" no nome do modelo?

É o modo assíncrono da API: você envia jobs que processam em até 24 horas e retornam em lote, não em tempo real. Serve para pipelines pesados e não para aplicações interativas.

Quando o cache de US$ 0,0875 por milhão vale a pena?

Quando você reutiliza o mesmo contexto longo repetidas vezes — instruções de sistema, bases de código ou documentos estáticos. A um décimo do preço da entrada, é a maior alavanca de custo para RAG pesado.

Leia também