NVIDIA Nemotron 3 Ultra sobe 30,2%; Mistral Small 3.2, 25%
As tabelas do OpenRouter ficaram mais caras em dois modelos usados por equipes de produção. A alta pesa no orçamento, mas os dados não separam entrada e saída nesses registros.
Se você usa o NVIDIA Nemotron 3 Ultra em produção, o preço listado no OpenRouter subiu 30,2% em 16 de setembro. O valor passou de US$ 2,40 para US$ 3,125 por milhão de tokens. No mesmo dia, o Mistral Small 3.2 24B ficou 25% mais caro, de US$ 0,20 para US$ 0,25 por milhão.
A mudança coloca dois modelos no radar de quem calcula custo por requisição, mas há uma ressalva importante: os registros de preço não separam tokens de entrada e de saída. Portanto, a alta confirmada é a da tarifa listada para cada modelo, não uma comparação detalhada entre os dois componentes da API.
O que mudou na conta
A atualização mais pesada foi a do Nemotron 3 Ultra. Cada milhão de tokens passou a custar US$ 3,125, contra US$ 2,40 antes da alteração. Em uma aplicação com volume constante, a tarifa do modelo cresce na mesma proporção, desde que o padrão de uso permaneça igual.
O Mistral Small 3.2 24B teve uma alta menor em termos percentuais, mas a lógica é a mesma: o preço saiu de US$ 0,20 para US$ 0,25 por milhão de tokens. Para uma equipe que escolheu o modelo justamente pelo custo baixo, a diferença pode afetar a margem de produtos com muitas chamadas.
O dado vem das tabelas de preços do OpenRouter. A plataforma registra 20 mudanças de preço no recorte analisado, mas nem todas foram altas. O Qwen3 VL 30B A3B Instruct caiu de US$ 0,60 para US$ 0,52, uma redução de 13,3%. O Kimi K2.7 Code baixou de US$ 3,50 para US$ 3,21, queda de 8,3%.
A NVIDIA teve outro reajuste
O Nemotron 3 Ultra não foi o único modelo da NVIDIA a subir. O Nemotron 3 Super passou de US$ 0,40 para US$ 0,45 por milhão de tokens em 14 de setembro, alta de 12,5%.
Isso não significa que toda a linha da fabricante tenha recebido o mesmo tratamento. O reajuste do Ultra foi mais de duas vezes maior que o do Super em termos percentuais. Para quem compara modelos pelo preço da família, olhar apenas o nome NVIDIA não basta: é preciso conferir a tabela do modelo específico.
Também houve movimentos fortes em outras famílias. O DeepSeek V4.1 Flash aparece com uma alteração de US$ 0,60 para US$ 1,20, alta de 100%, em 15 de setembro. O DeepSeek V4 Pro 0813 aparece com registros de alta e de baixa em datas próximas, o que recomenda cautela antes de transformar uma linha isolada em custo definitivo de produção.
O que não mudou para todos
As altas atingem diretamente quem chama o Nemotron 3 Ultra ou o Mistral Small 3.2 24B pela tabela do OpenRouter. Se a aplicação usa Qwen3 VL 30B A3B Instruct, Kimi K2.7 Code ou outro modelo que teve redução, o efeito pode ser diferente. Se o sistema não utiliza nenhum dos modelos listados, não há impacto direto indicado por esses registros.
Também não há informação suficiente para concluir que o desempenho melhorou junto com o preço. O Artificial Analysis registra notas de inteligência, mas os dados apresentados não trazem uma nova nota para o Nemotron 3 Ultra nem para o Mistral Small 3.2 24B neste recorte. Preço maior, portanto, não deve ser tratado como sinônimo de modelo melhor.
Para quem está escolhendo um modelo agora, o catálogo reúne 598 modelos de 71 criadores. A variedade reduz a justificativa para aceitar um reajuste sem teste: uma troca pode baixar o custo, mas só depois de validar qualidade, latência e comportamento nas tarefas reais do produto.
Quem precisa agir hoje
O primeiro grupo é o de equipes com tráfego alto e orçamento fixo. Nesse caso, a alta de 30,2% do Nemotron 3 Ultra pode exigir revisão imediata da margem ou do roteamento. O segundo é o de produtos que usam o Mistral Small 3.2 24B em tarefas simples e sensíveis a preço; a diferença de US$ 0,05 por milhão pode acumular em escala.
Para quem ainda está em protótipo, a mudança não obriga uma migração imediata. Mas é um sinal para separar o modelo da aplicação, manter alternativas compatíveis e registrar o preço vigente no momento de cada decisão.
A implicação prática é direta: antes de aumentar o volume no Nemotron 3 Ultra ou no Mistral Small 3.2 24B, refaça a projeção com US$ 3,125 e US$ 0,25 por milhão de tokens e compare o custo com uma rota alternativa testada.
Se você usa esses modelos em produção, atualize a projeção agora: o Nemotron 3 Ultra ficou 30,2% mais caro e o Mistral Small 3.2 24B, 25%.
Perguntas frequentes
Quanto subiu o preço do NVIDIA Nemotron 3 Ultra?
O preço listado no OpenRouter passou de US$ 2,40 para US$ 3,125 por milhão de tokens em 16 de setembro. A variação registrada foi de 30,2%.
O Mistral Small 3.2 24B ficou mais caro na API?
Sim. O preço listado passou de US$ 0,20 para US$ 0,25 por milhão de tokens, uma alta de 25%. Os dados não separam tarifas de entrada e saída.
Todos os modelos ficaram mais caros no OpenRouter?
Não. O Qwen3 VL 30B A3B Instruct caiu 13,3%, e o Kimi K2.7 Code caiu 8,3% no recorte. O efeito depende do modelo usado pela aplicação.