FalaVIP IA o que os modelos custam,
medido todo dia
Preços

Nemotron cai 23,2%, mas Kimi K3 já ensaia alta

O Nemotron 3 Ultra passou a custar US$ 2,40 por milhão de tokens de saída. O Kimi K3 teve corte de 27%, mas a mesma lista registra uma alta posterior no preço.

Redação FalaVIP IA 3 min de leitura
US$ 2,40por milhão de tokens de saída do Nemotron 3 Ultra
23,2%de redução no preço do Nemotron 3 Ultra
US$ 10,95preço por milhão de tokens de saída do Kimi K3 após o corte

Se você usa o NVIDIA Nemotron 3 Ultra em produção, a tarifa de saída caiu 23,2%, de US$ 3,125 para US$ 2,40 por milhão de tokens. É uma redução que aparece diretamente na fatura de quem gera respostas longas, relatórios ou chamadas em cadeia.

O Kimi K3 também teve um corte relevante: de US$ 15 para US$ 10,95 por milhão de tokens de saída, queda de 27%. Mas há uma ressalva importante para quem vai trocar o modelo hoje: a mesma lista de preços registra uma alta posterior, para US$ 11,589, no próprio dia. A manchete do desconto é verdadeira; tratá-lo como tarifa estável já seria arriscado.

Nemotron entrega o desconto mais previsível

Os preços listados no OpenRouter mostram o Nemotron 3 Ultra em US$ 2,40 por milhão de tokens de saída, contra US$ 3,125 antes da alteração. A entrada não aparece entre as mudanças destacadas, portanto o número que muda a conta é o da geração de texto.

Para uma aplicação com alto volume de saída, a diferença reduz o custo variável sem exigir uma mudança de arquitetura. Isso vale especialmente para fluxos em que o modelo responde com bastante texto ou é acionado várias vezes por tarefa. Ainda assim, o preço sozinho não informa qualidade, latência, limite operacional ou adequação ao caso de uso.

O corte coloca o Nemotron abaixo de opções mais caras do catálogo. O DeepSeek V4.1 Flash, por exemplo, está listado a US$ 0,15 por milhão de tokens de entrada e US$ 0,60 na saída, enquanto o Gemini 3.8 Flash custa US$ 0,75 na entrada e US$ 3,75 na saída. A comparação não significa que os modelos sejam equivalentes: mostra apenas que a economia depende de separar entrada e saída na simulação da fatura.

Kimi K3: desconto real, tarifa instável

O Kimi K3 caiu de US$ 15 para US$ 10,95 por milhão de tokens de saída, segundo o histórico do OpenRouter. Essa redução de 27% é relevante para integrações que já usam o modelo e multiplicam o consumo por milhares ou milhões de chamadas.

O problema está no registro seguinte: o preço aparece depois em US$ 11,589, uma alta de 5,8% sobre US$ 10,95. Portanto, quem calcular o orçamento com base apenas no corte pode subestimar a fatura. A diferença entre US$ 10,95 e US$ 11,589 é pequena diante do preço total, mas importa quando o volume de saída é grande.

Para contratação ou roteamento automático, a recomendação prática é tratar US$ 11,589 como referência mais conservadora até que a tarifa fique estável. O desconto continua sendo uma mudança relevante, mas não deve ser convertido em compromisso de custo sem monitorar o preço efetivamente aplicado.

O mercado também mexeu para cima

A queda dos dois modelos não representa um movimento uniforme. No mesmo período, o DeepSeek V4 Pro 0423 aparece com uma redução de US$ 3,20 para US$ 1,149 por milhão de tokens de saída, depois de ter passado por alterações anteriores. Já o DeepSeek V4 Flash 0731 subiu de US$ 0,12 para US$ 0,18, alta de 50%.

O Meta Muse Glimmer 30B também aparece em direções diferentes no histórico: primeiro caiu de US$ 1,50 para US$ 1,10 e depois subiu para US$ 1,50. O padrão é claro para quem paga API: acompanhar apenas anúncios de redução não basta. O preço pode mudar novamente, inclusive em intervalo curto.

Para quem isso muda a decisão

O Nemotron é mais interessante para quem já o utiliza ou procura um modelo de saída mais barato sem migrar para uma alternativa de outra família. O Kimi K3 interessa a equipes que precisam de suas capacidades atuais e têm volume suficiente para sentir uma redução de US$ 4,05 por milhão de tokens, mas a instabilidade do registro exige margem no orçamento.

Para quem usa Claude Opus 4.8, GPT-5.4, Gemini 3.8 Flash ou DeepSeek V4.1 Flash, essas alterações não mudam automaticamente a conta. A economia só aparece se houver migração, roteamento ou substituição de chamadas — e isso depende de testes de qualidade e compatibilidade.

O índice do Artificial Analysis lista modelos no topo de inteligência a US$ 20 por milhão de tokens, enquanto o Claude Opus 5 aparece no recorte de melhor custo-benefício a US$ 10, com índice de inteligência de 50,7. Esses indicadores ajudam a comparar custo e desempenho, mas não transformam Nemotron ou Kimi K3 em substitutos universais.

Na prática, atualize o cálculo de custo usando US$ 2,40 para o Nemotron e uma faixa entre US$ 10,95 e US$ 11,589 para o Kimi K3, e só migre depois de validar a qualidade no seu tráfego real.

Em uma frase

O Nemotron oferece um corte mais direto para a fatura, enquanto o Kimi K3 exige orçamento conservador porque o preço subiu novamente após a redução.

Perguntas frequentes

Quanto custa o NVIDIA Nemotron 3 Ultra na API?

O preço listado no OpenRouter é de US$ 2,40 por milhão de tokens de saída. Antes, a tarifa era de US$ 3,125, uma redução de 23,2%.

Quanto caiu o preço do Kimi K3?

O Kimi K3 passou de US$ 15 para US$ 10,95 por milhão de tokens de saída, queda de 27%. O histórico também registra uma alta posterior para US$ 11,589, então o orçamento deve considerar essa oscilação.

Esses descontos tornam os modelos mais baratos que todos os concorrentes?

Não. O preço depende da comparação entre entrada e saída, e os modelos têm capacidades diferentes. O DeepSeek V4.1 Flash, por exemplo, custa US$ 0,60 por milhão de tokens de saída, enquanto o Gemini 3.8 Flash custa US$ 3,75.

Leia também