GPT-5 Pro estreia a US$ 120 por milhão em semana de nove lançamentos
OpenAI abre as duas pontas de preço enquanto Qwen, Baidu e NVIDIA disputam a faixa intermediária do catálogo
GPT-5 Pro chegou cobrando US$ 120 por milhão de tokens de saída. É o preço mais alto do catálogo inteiro hoje — e a comparação que importa vem de dentro da própria casa: o o3, que lidera o ranking de inteligência do catálogo, sai por US$ 8. A diferença entre os dois é de 15 vezes, pelo mesmo fornecedor.
A semana que fecha hoje, de 6 a 12 de outubro, foi dominada pela OpenAI — mas o movimento mais importante não está no topo. Está nos dois extremos que a empresa abriu ao mesmo tempo.
OpenAI em duas trilhas
Em quatro dias, a OpenAI colocou quatro modelos novos no mercado. Olhando pelo preço, dá para ver uma estratégia clara: um trilho premium e um trilho de pesquisa profunda, com a família gpt-oss já servindo a faixa de baixo custo desde antes.
No premium, o GPT-5 Pro entra a US$ 120 por milhão de tokens de saída. A versão batch, que aceita latência maior em troca de desconto, sai pela metade: US$ 60. Para quem precisa de agente de pesquisa, vieram dois novos: o3 Deep Research a US$ 40 e o4 Mini Deep Research a US$ 8.
A OpenAI já tinha, no catálogo, o gpt-oss-120b a US$ 0,17 e o gpt-oss-20b a US$ 0,13 por milhão. É a maior dispersão interna de preços em um único criador: a diferença entre o GPT-5 Pro e o gpt-oss-20b chega a quase mil vezes.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2025-10-06 | GPT-5 Pro (batch) | openai | — | 60 |
| 2025-10-06 | GPT-5 Pro | openai | — | 120 |
| 2025-10-06 | Qwen3 VL 30B A3B Instruct | qwen | — | 0.6 |
| 2025-10-06 | Qwen3 VL 30B A3B Thinking | qwen | — | 2.4 |
| 2025-10-07 | Nano Banana (Gemini 2.5 Flas | — | 2.5 | |
| 2025-10-09 | ERNIE 4.5 21B A3B Thinking | baidu | — | 0.28 |
| 2025-10-10 | Llama 3.3 Nemotron Super 49B | nvidia | 12.4 | 0.4 |
| 2025-10-10 | o4 Mini Deep Research | openai | — | 8 |
| 2025-10-10 | o3 Deep Research | openai | — | 40 |
A faixa do meio foi dos chineses
Enquanto a OpenAI esticava as pontas, dois criadores chineses e a NVIDIA disputaram a faixa entre US$ 0,28 e US$ 2,50 por milhão de tokens de saída. Foi ali que caiu a maioria dos lançamentos da semana.
A Qwen soltou duas variantes do Qwen3 VL 30B A3B — uma Instruct a US$ 0,60 e uma Thinking a US$ 2,40 por milhão. A diferença de quatro vezes entre as duas versões mostra o que o sufixo "Thinking" significa na prática: o modelo que raciocina mais cobra mais. A Baidu entrou com ERNIE 4.5 21B A3B Thinking a US$ 0,28 — o Thinking mais barato da semana. A NVIDIA publicou uma receita: Llama 3.3 Nemotron Super 49B V1.5 a US$ 0,40, baseado no Llama da Meta, com ajustes da NVIDIA.
O Google no meio da semana
O lançamento mais curioso da semana veio do Google, com nome de fruta: Nano Banana, que é o Gemini 2.5 Flash Image dedicado a geração de imagem, a US$ 2,50 por milhão de tokens de saída. É o único dos nove modelos novos voltado especificamente a imagem — todos os outros são texto ou multimodal geral.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
O que isso muda na sua fatura
Se você roda um agente que consome muito output, o GPT-5 Pro a US$ 120 por milhão é o tipo de número que aparece no fim do mês como surpresa ruim. Para a mesma tarefa, o o3 sai por US$ 8 e o gpt-oss-120b por US$ 0,17. Em volume, a diferença entre Pro e gpt-oss é de três ordens de grandeza.
Mas a OpenAI não está sozinha no topo da régua de inteligência. O ranking do catálogo segue liderado pelo o3, com índice 31,096, e pelo gpt-oss-120b logo atrás, com 24,126. Nenhum dos modelos lançados nesta semana tem nota de inteligência publicada ainda — e vale lembrar que o índice da fonte é medido hoje, sem série histórica registrada.
Na prática, três caminhos se abriram esta semana:
- Quem precisa do melhor raciocínio e pode pagar caro: o3 ou, se a tarefa exigir o tier Pro, o GPT-5 Pro.
- Quem quer custo baixo com qualidade aceitável: Qwen3 VL 30B Instruct (US$ 0,60), Baidu ERNIE 4.5 Thinking (US$ 0,28) ou NVIDIA Nemotron 49B V1.5 (US$ 0,40).
- Quem precisa gerar imagem: só o Nano Banana apareceu esta semana.
E um detalhe que costuma escapar: foram 26 modelos novos nos últimos 30 dias. O catálogo hoje tem mais de 253 modelos ativos, vindos de 40 criadores. A cada semana, escolher modelo fica menos sobre "qual é o melhor" e mais sobre "qual é o mais barato que ainda resolve o meu caso".
Com GPT-5 Pro a US$ 120 e gpt-oss-20b a US$ 0,13 no mesmo fornecedor, a decisão da semana é menos sobre qual modelo é o melhor e mais sobre qual tarefa aceita qual faixa de preço.
Perguntas frequentes
Por que o GPT-5 Pro custa US$ 120 por milhão de tokens de saída?
Porque a OpenAI posicionou o modelo como tier premium do catálogo. A própria empresa oferece a versão batch pela metade (US$ 60) e mantém o o3, que lidera o ranking de inteligência, a US$ 8 — mostrando que o Pro é cobrado como produto topo de linha, não como referência de preço da casa.
O Nano Banana é modelo de imagem ou de texto?
É o Gemini 2.5 Flash Image do Google, voltado especificamente a geração de imagem. Foi o único dos nove lançamentos da semana dedicado a essa tarefa; todos os outros são texto ou multimodal geral, com preço entre US$ 0,28 e US$ 120 por milhão de tokens de saída.
Os modelos novos da semana já têm benchmark de inteligência?
Não. Dos nove lançamentos entre 6 e 12 de outubro, só o NVIDIA Llama 3.3 Nemotron Super 49B V1.5 aparece com índice de inteligência no catálogo (12,401). Os outros oito ainda não têm medição publicada — e vale lembrar que o índice da fonte é medido hoje, sem série histórica para comparar evolução.