FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Seis modelos novos e zero corte de preço: a semana dos lançamentos de nicho

Semana trouxe agente de busca a US$ 15 e modelo premium da Amazon a US$ 12,50, mas nenhuma mudança de tabela — o catálogo está se especializando, não se consolidando.

Redação FalaVIP IA 3 min de leitura
6lançamentos entre 27/10 e 02/11
US$ 15 / milhãopreço de saída do Perplexity Sonar Pro Search
0alterações de preço na semana

O número que define a semana

Seis modelos entraram no catálogo entre 27 de outubro e 2 de novembro, e em nenhum deles o preço mudou. A conta parece simples, mas diz algo maior: o mercado parou de brigar por tabela e começou a se especializar por categoria. Você não viu corte, não viu alta, viu fragmentação.

O catálogo fecha o domingo com 269 modelos de 41 criadores, e 25 lançamentos só nos últimos 30 dias. O ritmo continua alto — quem não está lançando está ficando para trás — mas o tipo de lançamento mudou.

Lançamentos da semana por criador
nvidia2openai1mistralai1perplexity1amazon1modelos

Os dois lançamentos que vão pesar no boleto

Perplexity Sonar Pro Search e Amazon Nova Premier 1.0 são os mais caros da semana: US$ 15 e US$ 12,50 por milhão de tokens de saída, respectivamente. Coloque na balança com o topo do mercado de hoje — o3 cobra US$ 8 e Claude Haiku 4.5 fica em US$ 5. Um agente de busca e um modelo "premier" de hyperscaler custando quase o dobro do que o melhor modelo de raciocínio do momento? É a conta que o release nunca destaca.

Para quem está cotando Nova Premier como substituto de Claude em pipeline de produção, a comparação direta é contra US$ 5 do Haiku 4.5 — e sai perdendo por 2,5x no token de saída. Para uso de Sonar Pro Search em agente que dispara consultas longas, a multiplicação em relação ao o3 é quase 2x. A pergunta deixa de ser "este modelo é bom?" e passa a ser "este caso de uso aguenta esse custo?".

A faixa dos US$ 0,30: especializar é baratear

No outro extremo, dois modelos estrearam a US$ 0,30 por milhão de tokens de saída: o gpt-oss-safeguard-20b da OpenAI e o Voxtral Small 24B 2507 da Mistral. O primeiro é um modelo de guardrails, sem nota de QI medida no catálogo; o segundo é um modelo de áudio. São categorias em que você não quer — nem precisa — pagar por capacidade de raciocínio geral.

Um classificador de segurança que custa US$ 0,30 em vez de US$ 5 muda a economia de uma pipeline de moderação inteira. É o tipo de lançamento que não vira notícia, mas vira linha de código de produção.

NVIDIA, visão e a versão gratuita

A NVIDIA entrou com o Nemotron Nano 12B 2 VL a US$ 0,60 por milhão, e ainda soltou uma versão gratuita. QI medido em 8,8 — baixo no ranking geral, mas irrelevante se o seu caso é extrair dados de imagem em volume. A faixa de modelos de visão segue sendo um segmento próprio, e a NVIDIA está precificando para dominar por custo, não por capacidade.

Lançamentos entre 2025-10-27 e 2025-11-02
DataModeloCriadorInteligênciaSaída US$/M
2025-10-28Nemotron Nano 12B 2 VLnvidia8.80.6
2025-10-28Nemotron Nano 12B 2 VL (freenvidia0
2025-10-29gpt-oss-safeguard-20bopenai0.3
2025-10-30Voxtral Small 24B 2507mistralai0.3
2025-10-30Sonar Pro Searchperplexity15
2025-10-31Nova Premier 1.0amazon12.712.5

O tabuleiro nesta segunda

Para situar a semana: o topo do mercado continua exatamente o mesmo. o3 lidera com QI 31,1, seguido de Claude Haiku 4.5 em 29,9 e gpt-oss-120b em 24,1. Nenhum dos seis lançamentos da semana entra nesse top 5 — o melhor classificado é o Nova Premier, com QI 12,7, abaixo do Qwen3 Next 80B A3B Thinking (16,9) e do gpt-oss-20b (15,2).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 269 modelos disponíveis no catálogo nesta data.

O que isso muda na prática

Se você está desenhando pipeline de produção agora, a lição da semana é que o catálogo virou um supermercado de categorias, não um ranking único. A pergunta deixou de ser "qual o melhor modelo" e passou a ser "qual modelo serve para esta etapa". Para a maioria das empresas, o caminho é manter o frontier (o3, Haiku 4.5) para raciocínio e puxar modelos de US$ 0,30 para classificação, moderação e transcrição. A fatura de API de novembro vai depender mais dessa mistura do que da próxima queda de preço — que, aliás, não veio.

Em uma frase

A semana mostrou que escolher modelo deixou de ser ranking único: vale manter frontier para raciocínio e usar os lançamentos baratos de US$ 0,30 para classificação, moderação e áudio — a economia de API agora vem da mistura, não do corte.

Perguntas frequentes

Qual foi o modelo mais caro lançado na semana?

O Perplexity Sonar Pro Search, a US$ 15 por milhão de tokens de saída. O Amazon Nova Premier 1.0 vem logo atrás, a US$ 12,50 por milhão — ambos mais caros que o o3 (US$ 8) e o Claude Haiku 4.5 (US$ 5).

Houve alguma mudança de preço nesta semana?

Nenhuma. O resumo da semana registra zero alterações de tabela entre 27/10 e 02/11. Os preços que mudaram o cenário foram os de lançamento, não os de reajuste.

Quantos modelos tem no catálogo hoje?

Pelo menos 269 modelos de 41 criadores, com 25 lançamentos só nos últimos 30 dias. O número é um piso — modelos removidos depois não aparecem na conta.

Leia também