FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5 Pro custa US$ 120 por milhão de saída — vale para quem?

Lançado ontem pela OpenAI, o modelo topo de linha cobra 15 vezes mais caro na saída do que o o3 e fica sem nota pública de inteligência no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de entrada
US$ 120por milhão de tokens de saída
400 miltokens de contexto

Oito dólares por milhão de saída virou US$ 120 em uma geração

Ontem a OpenAI colocou no ar o GPT-5 Pro e o catálogo já mostra o preço: US$ 15 por milhão de tokens de entrada e US$ 120 por milhão de tokens de saída. Para quem estava pagando US$ 8 por milhão no o3 — o modelo que lidera o ranking de inteligência do catálogo nesta data —, a conta multiplica por 15 na ponta que mais consome em tarefas longas: a geração de texto. Em qualquer fluxo com agente, raciocínio encadeado ou geração de código com explicação, a saída é onde o tokenômetro dispara.

Ficha técnica — GPT-5 Pro (batch)
CampoValor
Identificadoropenai/gpt-5-pro:batch
Criadoropenai
Preço de entradaUS$ 7.50 / M tokens
Preço de saídaUS$ 60.00 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text

O que exatamente ficou mais caro

O release fala em "avanços em raciocínio, qualidade de código e experiência de uso". Traduzindo: a OpenAI reposicionou o topo da pirâmide de preço para um público que não olha centavos por milhão, mas sim o resultado de uma tarefa crítica. O contexto de 400 mil tokens segue o padrão da família e abre espaço para análise de bases inteiras de código ou documentos longos em uma única chamada. A multimodalidade continua sendo texto, imagem e arquivo como entrada, com saída em texto — nada mudou nesse eixo.

O detalhe que pesa no orçamento é a ausência de cache publicado. O catálogo não trouxe valor de cache_read para o GPT-5 Pro, o que significa que você não consegue, hoje, planejar economia reutilizando prefixos longos como faz em outros modelos da casa. Quem vinha amortizando custo com prompt cache precisa colocar isso na ponta do lápis antes de migrar.

Onde o GPT-5 Pro se senta no tabuleiro

O catálogo tem 249 modelos listados, 40 criadores, e 27 lançamentos nos últimos 30 dias. O topo de inteligência hoje é o o3, com IQ 31,096 e US$ 8 por milhão de saída. Logo abaixo vem o gpt-oss-120b (IQ 24,126, US$ 0,17 por milhão de saída) — um modelo aberto da própria OpenAI custando menos de 1% do Pro. O Qwen3 Next 80B A3B Thinking aparece em terceiro (IQ 16,867, US$ 1,20 por milhão de saída), vindo da China, e o gpt-oss-20b fecha o bloco dos abertos da casa (IQ 15,225, US$ 0,13).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 249 modelos disponíveis no catálogo nesta data.

O GPT-5 Pro entra sem nota pública de inteligência, coding, agentic ou blended no catálogo. Isso não quer dizer que ele seja ruim — quer dizer que o índice desta data ainda não foi publicado, e qualquer comparação numérica com o o3 passa a ser declaração de release, não medição. Quem precisa de benchmark antes de migrar vai esperar a próxima janela.

Para quem vale — e para quem é dinheiro queimado

Vale para: times rodando fluxos curtos e caros, onde uma única chamada decide um bug em produção, uma cláusula contratual ou um diagnóstico clínico. O orçamento mensal cabe no patamar de US$ 120 por milhão quando o custo de errar é maior que o custo do token. Também vale para quem precisa do contexto de 400 mil em uma tacada só, sem dividir documento.

Não vale para: qualquer coisa que rode em volume. Chatbot de atendimento, sumarização em massa, classificação de tickets, geração de descrição de produto, revisão de PR em escala — tudo isso tem alternativa aberta da própria OpenAI (gpt-oss-120b ou gpt-oss-20b) ou de terceiros (Qwen3, Llama 4 Maverick a US$ 0,696 por milhão de saída) custando entre 0,1% e 1,5% do preço do Pro. Multiplique pelo volume mensal e a diferença paga um engenheiro.

O que fazer com isso na segunda-feira

Antes de trocar o o3 pelo GPT-5 Pro, rode o mesmo prompt caro nos dois e meça a diferença real no seu critério de aceite. Se a taxa de erro cair de 8% para 2% em uma tarefa que custa US$ 0,40 por execução, a conta fecha. Se a diferença for subjetiva, o o3 segue sendo o teto de inteligência medido do catálogo, a um décimo quinto do preço. E se o seu fluxo depender de cache para caber no orçamento, espere a OpenAI publicar o valor de cache_read antes de mover produção.

Em uma frase

Só migre do o3 para o GPT-5 Pro em fluxos curtos onde o custo de errar supera o custo do token; para qualquer coisa em volume, os modelos abertos da própria OpenAI ou o Qwen3 entregam resultado a menos de 1,5% do preço.

Perguntas frequentes

Quanto custa o GPT-5 Pro por milhão de tokens?

US$ 15 por milhão de tokens de entrada e US$ 120 por milhão de tokens de saída. O catálogo não publicou valor de cache_read nesta data, então não há como planejar economia com prompt cache ainda.

O GPT-5 Pro é melhor que o o3 em inteligência?

O catálogo desta data não publicou nota de inteligência para o GPT-5 Pro. O o3 lidera o ranking com IQ 31,096 e custa US$ 8 por milhão de saída — qualquer comparação numérica hoje é declaração de release, não medição.

Quando o GPT-5 Pro não vale a pena?

Em qualquer fluxo de alto volume: atendimento, sumarização em massa, classificação, geração de descrição. Nesses casos, o gpt-oss-120b (US$ 0,17 por milhão de saída) ou o Qwen3 Next Thinking (US$ 1,20) entregam resultado suficiente a uma fração do custo.

Leia também