FalaVIP IA o que os modelos custam,
medido todo dia
Preços

NVIDIA Nemotron 3 Ultra sobe 30,2%; Mistral Small 3.2, 25%

As tabelas do OpenRouter ficaram mais caras em dois modelos usados por equipes de produção. A alta pesa no orçamento, mas os dados não separam entrada e saída nesses registros.

Redação FalaVIP IA 3 min de leitura
30,2%alta do Nemotron 3 Ultra
US$ 3,125preço listado por milhão de tokens do Nemotron 3 Ultra
25%alta do Mistral Small 3.2 24B

Se você usa o NVIDIA Nemotron 3 Ultra em produção, o preço listado no OpenRouter subiu 30,2% em 16 de setembro. O valor passou de US$ 2,40 para US$ 3,125 por milhão de tokens. No mesmo dia, o Mistral Small 3.2 24B ficou 25% mais caro, de US$ 0,20 para US$ 0,25 por milhão.

A mudança coloca dois modelos no radar de quem calcula custo por requisição, mas há uma ressalva importante: os registros de preço não separam tokens de entrada e de saída. Portanto, a alta confirmada é a da tarifa listada para cada modelo, não uma comparação detalhada entre os dois componentes da API.

O que mudou na conta

A atualização mais pesada foi a do Nemotron 3 Ultra. Cada milhão de tokens passou a custar US$ 3,125, contra US$ 2,40 antes da alteração. Em uma aplicação com volume constante, a tarifa do modelo cresce na mesma proporção, desde que o padrão de uso permaneça igual.

O Mistral Small 3.2 24B teve uma alta menor em termos percentuais, mas a lógica é a mesma: o preço saiu de US$ 0,20 para US$ 0,25 por milhão de tokens. Para uma equipe que escolheu o modelo justamente pelo custo baixo, a diferença pode afetar a margem de produtos com muitas chamadas.

O dado vem das tabelas de preços do OpenRouter. A plataforma registra 20 mudanças de preço no recorte analisado, mas nem todas foram altas. O Qwen3 VL 30B A3B Instruct caiu de US$ 0,60 para US$ 0,52, uma redução de 13,3%. O Kimi K2.7 Code baixou de US$ 3,50 para US$ 3,21, queda de 8,3%.

A NVIDIA teve outro reajuste

O Nemotron 3 Ultra não foi o único modelo da NVIDIA a subir. O Nemotron 3 Super passou de US$ 0,40 para US$ 0,45 por milhão de tokens em 14 de setembro, alta de 12,5%.

Isso não significa que toda a linha da fabricante tenha recebido o mesmo tratamento. O reajuste do Ultra foi mais de duas vezes maior que o do Super em termos percentuais. Para quem compara modelos pelo preço da família, olhar apenas o nome NVIDIA não basta: é preciso conferir a tabela do modelo específico.

Também houve movimentos fortes em outras famílias. O DeepSeek V4.1 Flash aparece com uma alteração de US$ 0,60 para US$ 1,20, alta de 100%, em 15 de setembro. O DeepSeek V4 Pro 0813 aparece com registros de alta e de baixa em datas próximas, o que recomenda cautela antes de transformar uma linha isolada em custo definitivo de produção.

O que não mudou para todos

As altas atingem diretamente quem chama o Nemotron 3 Ultra ou o Mistral Small 3.2 24B pela tabela do OpenRouter. Se a aplicação usa Qwen3 VL 30B A3B Instruct, Kimi K2.7 Code ou outro modelo que teve redução, o efeito pode ser diferente. Se o sistema não utiliza nenhum dos modelos listados, não há impacto direto indicado por esses registros.

Também não há informação suficiente para concluir que o desempenho melhorou junto com o preço. O Artificial Analysis registra notas de inteligência, mas os dados apresentados não trazem uma nova nota para o Nemotron 3 Ultra nem para o Mistral Small 3.2 24B neste recorte. Preço maior, portanto, não deve ser tratado como sinônimo de modelo melhor.

Para quem está escolhendo um modelo agora, o catálogo reúne 598 modelos de 71 criadores. A variedade reduz a justificativa para aceitar um reajuste sem teste: uma troca pode baixar o custo, mas só depois de validar qualidade, latência e comportamento nas tarefas reais do produto.

Quem precisa agir hoje

O primeiro grupo é o de equipes com tráfego alto e orçamento fixo. Nesse caso, a alta de 30,2% do Nemotron 3 Ultra pode exigir revisão imediata da margem ou do roteamento. O segundo é o de produtos que usam o Mistral Small 3.2 24B em tarefas simples e sensíveis a preço; a diferença de US$ 0,05 por milhão pode acumular em escala.

Para quem ainda está em protótipo, a mudança não obriga uma migração imediata. Mas é um sinal para separar o modelo da aplicação, manter alternativas compatíveis e registrar o preço vigente no momento de cada decisão.

A implicação prática é direta: antes de aumentar o volume no Nemotron 3 Ultra ou no Mistral Small 3.2 24B, refaça a projeção com US$ 3,125 e US$ 0,25 por milhão de tokens e compare o custo com uma rota alternativa testada.

Em uma frase

Se você usa esses modelos em produção, atualize a projeção agora: o Nemotron 3 Ultra ficou 30,2% mais caro e o Mistral Small 3.2 24B, 25%.

Perguntas frequentes

Quanto subiu o preço do NVIDIA Nemotron 3 Ultra?

O preço listado no OpenRouter passou de US$ 2,40 para US$ 3,125 por milhão de tokens em 16 de setembro. A variação registrada foi de 30,2%.

O Mistral Small 3.2 24B ficou mais caro na API?

Sim. O preço listado passou de US$ 0,20 para US$ 0,25 por milhão de tokens, uma alta de 25%. Os dados não separam tarifas de entrada e saída.

Todos os modelos ficaram mais caros no OpenRouter?

Não. O Qwen3 VL 30B A3B Instruct caiu 13,3%, e o Kimi K2.7 Code caiu 8,3% no recorte. O efeito depende do modelo usado pela aplicação.

Leia também