Seis modelos novos e zero corte de preço: a semana dos lançamentos de nicho
Semana trouxe agente de busca a US$ 15 e modelo premium da Amazon a US$ 12,50, mas nenhuma mudança de tabela — o catálogo está se especializando, não se consolidando.
O número que define a semana
Seis modelos entraram no catálogo entre 27 de outubro e 2 de novembro, e em nenhum deles o preço mudou. A conta parece simples, mas diz algo maior: o mercado parou de brigar por tabela e começou a se especializar por categoria. Você não viu corte, não viu alta, viu fragmentação.
O catálogo fecha o domingo com 269 modelos de 41 criadores, e 25 lançamentos só nos últimos 30 dias. O ritmo continua alto — quem não está lançando está ficando para trás — mas o tipo de lançamento mudou.
Os dois lançamentos que vão pesar no boleto
Perplexity Sonar Pro Search e Amazon Nova Premier 1.0 são os mais caros da semana: US$ 15 e US$ 12,50 por milhão de tokens de saída, respectivamente. Coloque na balança com o topo do mercado de hoje — o3 cobra US$ 8 e Claude Haiku 4.5 fica em US$ 5. Um agente de busca e um modelo "premier" de hyperscaler custando quase o dobro do que o melhor modelo de raciocínio do momento? É a conta que o release nunca destaca.
Para quem está cotando Nova Premier como substituto de Claude em pipeline de produção, a comparação direta é contra US$ 5 do Haiku 4.5 — e sai perdendo por 2,5x no token de saída. Para uso de Sonar Pro Search em agente que dispara consultas longas, a multiplicação em relação ao o3 é quase 2x. A pergunta deixa de ser "este modelo é bom?" e passa a ser "este caso de uso aguenta esse custo?".
A faixa dos US$ 0,30: especializar é baratear
No outro extremo, dois modelos estrearam a US$ 0,30 por milhão de tokens de saída: o gpt-oss-safeguard-20b da OpenAI e o Voxtral Small 24B 2507 da Mistral. O primeiro é um modelo de guardrails, sem nota de QI medida no catálogo; o segundo é um modelo de áudio. São categorias em que você não quer — nem precisa — pagar por capacidade de raciocínio geral.
Um classificador de segurança que custa US$ 0,30 em vez de US$ 5 muda a economia de uma pipeline de moderação inteira. É o tipo de lançamento que não vira notícia, mas vira linha de código de produção.
NVIDIA, visão e a versão gratuita
A NVIDIA entrou com o Nemotron Nano 12B 2 VL a US$ 0,60 por milhão, e ainda soltou uma versão gratuita. QI medido em 8,8 — baixo no ranking geral, mas irrelevante se o seu caso é extrair dados de imagem em volume. A faixa de modelos de visão segue sendo um segmento próprio, e a NVIDIA está precificando para dominar por custo, não por capacidade.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2025-10-28 | Nemotron Nano 12B 2 VL | nvidia | 8.8 | 0.6 |
| 2025-10-28 | Nemotron Nano 12B 2 VL (free | nvidia | — | 0 |
| 2025-10-29 | gpt-oss-safeguard-20b | openai | — | 0.3 |
| 2025-10-30 | Voxtral Small 24B 2507 | mistralai | — | 0.3 |
| 2025-10-30 | Sonar Pro Search | perplexity | — | 15 |
| 2025-10-31 | Nova Premier 1.0 | amazon | 12.7 | 12.5 |
O tabuleiro nesta segunda
Para situar a semana: o topo do mercado continua exatamente o mesmo. o3 lidera com QI 31,1, seguido de Claude Haiku 4.5 em 29,9 e gpt-oss-120b em 24,1. Nenhum dos seis lançamentos da semana entra nesse top 5 — o melhor classificado é o Nova Premier, com QI 12,7, abaixo do Qwen3 Next 80B A3B Thinking (16,9) e do gpt-oss-20b (15,2).
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
O que isso muda na prática
Se você está desenhando pipeline de produção agora, a lição da semana é que o catálogo virou um supermercado de categorias, não um ranking único. A pergunta deixou de ser "qual o melhor modelo" e passou a ser "qual modelo serve para esta etapa". Para a maioria das empresas, o caminho é manter o frontier (o3, Haiku 4.5) para raciocínio e puxar modelos de US$ 0,30 para classificação, moderação e transcrição. A fatura de API de novembro vai depender mais dessa mistura do que da próxima queda de preço — que, aliás, não veio.
A semana mostrou que escolher modelo deixou de ser ranking único: vale manter frontier para raciocínio e usar os lançamentos baratos de US$ 0,30 para classificação, moderação e áudio — a economia de API agora vem da mistura, não do corte.
Perguntas frequentes
Qual foi o modelo mais caro lançado na semana?
O Perplexity Sonar Pro Search, a US$ 15 por milhão de tokens de saída. O Amazon Nova Premier 1.0 vem logo atrás, a US$ 12,50 por milhão — ambos mais caros que o o3 (US$ 8) e o Claude Haiku 4.5 (US$ 5).
Houve alguma mudança de preço nesta semana?
Nenhuma. O resumo da semana registra zero alterações de tabela entre 27/10 e 02/11. Os preços que mudaram o cenário foram os de lançamento, não os de reajuste.
Quantos modelos tem no catálogo hoje?
Pelo menos 269 modelos de 41 criadores, com 25 lançamentos só nos últimos 30 dias. O número é um piso — modelos removidos depois não aparecem na conta.