GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída
Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.
O GPT-5 Pro chegou ao catálogo há dois dias cobrando US$ 60 por milhão de tokens de saída. Antes de pensar em migrar sua stack, é esse número que precisa estar na mesa — não o que o release diz.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
O "batch" muda a conta — e nem sempre a seu favor
Quando o modelo vem marcado como "batch", o processamento é assíncrono: você envia um lote, espera minutos ou horas, recebe tudo de uma vez. A contrapartida costumeira é desconto em relação ao endpoint em tempo real. O detalhe é que esta ficha só publicou o preço do batch. Não há tabela com a tarifa do endpoint síncrono do GPT-5 Pro. Logo, US$ 60 por milhão é o piso, não o teto. Se você precisa de resposta em três segundos, espere pagar mais.
Onde o GPT-5 Pro se encaixa no catálogo
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5-pro |
| Criador | openai |
| Preço de entrada | US$ 15.00 / M tokens |
| Preço de saída | US$ 120.00 / M tokens |
| Janela de contexto | 400k |
| Modalidade | text+image+file->text |
Hoje, o topo da lista de inteligência medida tem OpenAI o3 com IQ 31 e US$ 8 por milhão de tokens de saída. GPT-5 Pro custa 7,5 vezes isso. No input o GPT-5 Pro cobra US$ 7,50 por milhão; sem o preço de entrada do o3 publicado na mesma lista, a comparação que sobra é pela saída — e é aí que a diferença explode.
E tem um porém que precisa ser dito: o catálogo desta data não publicou nota de QI, nem benchmark de coding ou agentic para o GPT-5 Pro. Não tem régua comparando com o3, Qwen ou Llama. O que sobra é a descrição da própria OpenAI — "raciocínio avançado, qualidade de código, tarefas complexas" — e a fé de quem paga a fatura.
Para quem faz sentido adotar
Se o seu workload é pequeno em volume e cada resposta tem peso de verdade — geração de código em que cada iteração economiza horas de debug, análise de cláusulas longas, planejamento que exige seguir instruções à risca — faz sentido testar. A janela de 400 mil tokens é generosa: dá para colar processos inteiros, contratos ou bases de código que caibam, com entrada multimodal (texto, imagem, arquivo) e saída em texto.
Onde o GPT-5 Pro pode pagar o premium é em tarefas sem revisão linha a linha, em que o custo de uma resposta errada é alto e o humano não vai conferir token por token. Nesses casos, os US$ 52 adicionais por milhão em relação ao o3 podem se justificar — mas só se você medir antes.
Para quem não muda absolutamente nada
Chat em volume, sumarização, geração de descrições — qualquer coisa em que o3 ou modelos mais baratos já estavam resolvendo, GPT-5 Pro é dinheiro queimado. Para raciocínio com orçamento apertado, o Qwen3 Next 80B A3B Thinking está entre os 25 modelos lançados nos últimos 30 dias, marca IQ 16,87 e custa US$ 1,20 por milhão de saída: 50 vezes mais barato.
Se a sua régua é "o melhor da OpenAI com preço civilizado", o gpt-oss-120b entrega IQ 24 por US$ 0,17 e o Llama 4 Maverick marca IQ 14 por US$ 0,696. Esses números mudam a equação inteira — multiplicador de três dígitos que raramente se traduz em três dígitos a mais de qualidade no resultado.
O que fazer na prática antes de migrar
Pegue seu workload mais caro, rode o o3 e meça a taxa de erro. Se o retrabalho humano do o3 custa mais que os US$ 52 adicionais por milhão na saída, o GPT-5 Pro vira economia. Se o o3 já passa, ele segue sendo o melhor custo-benefício entre os modelos medidos do catálogo desta data.
E tenha em mente: o sufixo "batch" no nome é como a OpenAI colocou o flagship à venda sem ainda precisar publicar a tarifa do endpoint em tempo real. Só vale pagar batch se a sua fila não precisa responder em três segundos.
Para workloads pequenos onde cada resposta pesa, vale testar GPT-5 Pro batch contra o o3. Para todo o resto, o3 e os open-weights da OpenAI entregam raciocínio medido por uma fração de até três dígitos menor por token.
Perguntas frequentes
GPT-5 Pro (batch) já tem benchmark publicado no catálogo?
Não. O índice de inteligência, score de coding e agentic do GPT-5 Pro estão em branco nesta ficha. O que consta são preço de entrada (US$ 7,50/M), preço de saída (US$ 60/M), contexto de 400 mil tokens e a data de corte de conhecimento. Para comparar com o3 ou Qwen você precisa confiar na descrição da OpenAI ou rodar o seu próprio benchmark.
Por que o nome tem "batch" e isso muda o preço?
Batch é processamento assíncrono: você submete um lote de requisições e recebe os resultados todos de uma vez, em vez de esperar uma resposta em tempo real. Por isso costuma custar menos que o endpoint síncrono. Nesta ficha só foi publicado o preço do batch; o preço do endpoint em tempo real do GPT-5 Pro ainda não apareceu no catálogo.
Vale trocar do o3 pelo GPT-5 Pro (batch)?
Depende do workload. O3 custa US$ 8 por milhão de saída e tem IQ 31 medido; GPT-5 Pro custa 7,5 vezes isso sem nota pública de QI. Se o o3 já passa nos seus casos, trocar é desperdício. Se você tem um workload pequeno e crítico em que cada resposta pesa muito e o o3 ainda falha, vale rodar os dois lado a lado antes de migrar.