FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída

Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.

Redação FalaVIP IA 3 min de leitura
US$ 60por milhão de tokens de saída
US$ 7,50por milhão de tokens de entrada
400.000tokens de contexto

O GPT-5 Pro chegou ao catálogo há dois dias cobrando US$ 60 por milhão de tokens de saída. Antes de pensar em migrar sua stack, é esse número que precisa estar na mesa — não o que o release diz.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 249 modelos disponíveis no catálogo nesta data.

O "batch" muda a conta — e nem sempre a seu favor

Quando o modelo vem marcado como "batch", o processamento é assíncrono: você envia um lote, espera minutos ou horas, recebe tudo de uma vez. A contrapartida costumeira é desconto em relação ao endpoint em tempo real. O detalhe é que esta ficha só publicou o preço do batch. Não há tabela com a tarifa do endpoint síncrono do GPT-5 Pro. Logo, US$ 60 por milhão é o piso, não o teto. Se você precisa de resposta em três segundos, espere pagar mais.

Onde o GPT-5 Pro se encaixa no catálogo

Ficha técnica — GPT-5 Pro
CampoValor
Identificadoropenai/gpt-5-pro
Criadoropenai
Preço de entradaUS$ 15.00 / M tokens
Preço de saídaUS$ 120.00 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text

Hoje, o topo da lista de inteligência medida tem OpenAI o3 com IQ 31 e US$ 8 por milhão de tokens de saída. GPT-5 Pro custa 7,5 vezes isso. No input o GPT-5 Pro cobra US$ 7,50 por milhão; sem o preço de entrada do o3 publicado na mesma lista, a comparação que sobra é pela saída — e é aí que a diferença explode.

E tem um porém que precisa ser dito: o catálogo desta data não publicou nota de QI, nem benchmark de coding ou agentic para o GPT-5 Pro. Não tem régua comparando com o3, Qwen ou Llama. O que sobra é a descrição da própria OpenAI — "raciocínio avançado, qualidade de código, tarefas complexas" — e a fé de quem paga a fatura.

Para quem faz sentido adotar

Se o seu workload é pequeno em volume e cada resposta tem peso de verdade — geração de código em que cada iteração economiza horas de debug, análise de cláusulas longas, planejamento que exige seguir instruções à risca — faz sentido testar. A janela de 400 mil tokens é generosa: dá para colar processos inteiros, contratos ou bases de código que caibam, com entrada multimodal (texto, imagem, arquivo) e saída em texto.

Onde o GPT-5 Pro pode pagar o premium é em tarefas sem revisão linha a linha, em que o custo de uma resposta errada é alto e o humano não vai conferir token por token. Nesses casos, os US$ 52 adicionais por milhão em relação ao o3 podem se justificar — mas só se você medir antes.

Para quem não muda absolutamente nada

Chat em volume, sumarização, geração de descrições — qualquer coisa em que o3 ou modelos mais baratos já estavam resolvendo, GPT-5 Pro é dinheiro queimado. Para raciocínio com orçamento apertado, o Qwen3 Next 80B A3B Thinking está entre os 25 modelos lançados nos últimos 30 dias, marca IQ 16,87 e custa US$ 1,20 por milhão de saída: 50 vezes mais barato.

Se a sua régua é "o melhor da OpenAI com preço civilizado", o gpt-oss-120b entrega IQ 24 por US$ 0,17 e o Llama 4 Maverick marca IQ 14 por US$ 0,696. Esses números mudam a equação inteira — multiplicador de três dígitos que raramente se traduz em três dígitos a mais de qualidade no resultado.

O que fazer na prática antes de migrar

Pegue seu workload mais caro, rode o o3 e meça a taxa de erro. Se o retrabalho humano do o3 custa mais que os US$ 52 adicionais por milhão na saída, o GPT-5 Pro vira economia. Se o o3 já passa, ele segue sendo o melhor custo-benefício entre os modelos medidos do catálogo desta data.

E tenha em mente: o sufixo "batch" no nome é como a OpenAI colocou o flagship à venda sem ainda precisar publicar a tarifa do endpoint em tempo real. Só vale pagar batch se a sua fila não precisa responder em três segundos.

Em uma frase

Para workloads pequenos onde cada resposta pesa, vale testar GPT-5 Pro batch contra o o3. Para todo o resto, o3 e os open-weights da OpenAI entregam raciocínio medido por uma fração de até três dígitos menor por token.

Perguntas frequentes

GPT-5 Pro (batch) já tem benchmark publicado no catálogo?

Não. O índice de inteligência, score de coding e agentic do GPT-5 Pro estão em branco nesta ficha. O que consta são preço de entrada (US$ 7,50/M), preço de saída (US$ 60/M), contexto de 400 mil tokens e a data de corte de conhecimento. Para comparar com o3 ou Qwen você precisa confiar na descrição da OpenAI ou rodar o seu próprio benchmark.

Por que o nome tem "batch" e isso muda o preço?

Batch é processamento assíncrono: você submete um lote de requisições e recebe os resultados todos de uma vez, em vez de esperar uma resposta em tempo real. Por isso costuma custar menos que o endpoint síncrono. Nesta ficha só foi publicado o preço do batch; o preço do endpoint em tempo real do GPT-5 Pro ainda não apareceu no catálogo.

Vale trocar do o3 pelo GPT-5 Pro (batch)?

Depende do workload. O3 custa US$ 8 por milhão de saída e tem IQ 31 medido; GPT-5 Pro custa 7,5 vezes isso sem nota pública de QI. Se o o3 já passa nos seus casos, trocar é desperdício. Se você tem um workload pequeno e crítico em que cada resposta pesa muito e o o3 ainda falha, vale rodar os dois lado a lado antes de migrar.

Leia também