OpenRouter registra quedas de até 38,9% e oscilações na conta
O Nemotron 3 Ultra ficou mais barato, enquanto modelos da Tencent, Qwen e DeepSeek mudaram de preço no mesmo dia. Para quem roda alto volume, a diferença entre uma escolha e outra pode pesar mais que o nome do modelo.
Se você usa um modelo pesado em produção, a mudança mais importante do dia está no preço do NVIDIA: o Nemotron 3 Ultra caiu de US$ 3,60 para US$ 2,20 por milhão de tokens, uma redução de 38,9% nos preços listados no OpenRouter. A queda não veio sozinha: o catálogo registrou 17 alterações em 27 de agosto, com aumentos e reduções que mudam rapidamente a conta de aplicações em larga escala.
O movimento também expõe um problema prático. Uma tabela de preços consultada hoje pode não representar a mesma equação de custo-benefício amanhã — e, em alguns casos, nem no fim do próprio dia.
NVIDIA puxa a maior queda
O Nemotron 3 Ultra concentra a maior redução registrada: 38,9%, de US$ 3,60 para US$ 2,20 por milhão de tokens. A diferença é relevante para workloads que geram grandes volumes de texto, código ou respostas intermediárias, embora o registro de mudança não informe se o valor corresponde à entrada ou à saída.
Na prática, o corte aproxima o modelo de alternativas que antes pareciam mais baratas apenas no preço nominal. A comparação, porém, não deve parar no valor por milhão. É preciso medir qualidade, latência, tamanho médio das respostas e quantidade de tentativas necessárias para concluir uma tarefa.
Esse movimento vale principalmente para empresas que já usam o Nemotron 3 Ultra ou que mantêm uma fila de tarefas de alto volume. Para quem roda poucas chamadas ou precisa de um modelo específico por capacidade, a redução pode ter impacto financeiro pequeno.
Tencent e Qwen mostram que o preço oscila
O caso mais claro de instabilidade é o Tencent Hy3. O OpenRouter registra uma alta de 60%, de US$ 0,33 para US$ 0,528 por milhão de tokens, e também uma queda de 37,5%, no sentido inverso, de US$ 0,528 para US$ 0,33, ambas em 27 de agosto.
O Qwen3.5-35B-A3B aparece no mesmo padrão: primeiro, alta de 44%, de US$ 1,25 para US$ 1,80; depois, redução de 30,6%, de US$ 1,80 para US$ 1,25. Os registros não permitem tratar essas entradas como uma tendência contínua de alta ou baixa. Eles mostram que o valor listado mudou mais de uma vez no período.
Para quem escolhe provedor automaticamente, isso é mais importante que uma promoção isolada. Filtros de preço, limites de orçamento e rotas de fallback precisam considerar alterações de tarifa, ou a aplicação pode trocar de modelo sem que a equipe perceba a mudança no comportamento da fatura.
DeepSeek cai em alguns modelos e sobe em outros
A família DeepSeek também teve movimentos em direções diferentes. O DeepSeek V4 Flash Latest subiu 33,3%, de US$ 0,075 para US$ 0,10 por milhão. Já o DeepSeek V4 Flash 0731 caiu 16,7%, de US$ 0,12 para US$ 0,10, enquanto o V4 Pro 0813 recuou 15%, de US$ 3,96 para US$ 3,366.
O modelo identificado como DeepSeek V4 Flash 0423 teve quatro reduções menores, entre 1,9% e 3,9%, com valores listados passando por US$ 0,162, US$ 0,159, US$ 0,156, US$ 0,15 e US$ 0,147. As versões não devem ser tratadas como equivalentes só porque compartilham o nome da família.
O Qwen também teve uma redução de 36,4% no Qwen3 235B A22B Instruct 2507, de US$ 0,55 para US$ 0,35. Em sentido oposto, o Qwen3.6 27B subiu 12,5%, de US$ 3,20 para US$ 3,60. O Qwen3.6 35B A3B caiu 10%, de US$ 1 para US$ 0,90.
O que muda para cada tipo de operação
O catálogo do OpenRouter reúne 562 modelos de 70 criadores. Nesse universo, uma diferença de alguns centavos por milhão pode ser decisiva em classificação, atendimento automatizado e geração em lote, mas não substitui um teste com a carga real.
Os modelos recém-listados reforçam a pressão na faixa barata. O GLM Flash Latest estreou com preço de US$ 0,075 na entrada e US$ 0,25 na saída, além de uma janela de contexto de 1.310.720 tokens. Também entrou o Ling 3.0 Flash Fin, com entrada e saída gratuitas e contexto de 262.144 tokens.
No índice do Artificial Analysis, o GLM-5.3-Flash apareceu com nota de inteligência de 57,5 e preço de US$ 0,238 por milhão. O Qwen3.8-Flash-Next teve nota de 55,8, mas sem preço informado nessa estreia. A diferença entre o preço do catálogo e o preço do índice mostra que a comparação precisa manter a fonte e a modalidade alinhadas.
Para uma operação nova, os cortes favorecem quem pode testar e trocar de modelo. Para uma operação estável, o ganho só aparece depois de verificar qualidade, limites e preço efetivamente aplicado à rota usada. A decisão prática é revisar os valores antes de fixar um modelo em produção e acompanhar a fatura depois da troca.
Se a aplicação roda em alto volume, trate o preço do OpenRouter como variável operacional e revalide custo, qualidade e rota antes de manter qualquer modelo em produção.
Perguntas frequentes
Qual modelo teve a maior queda de preço no OpenRouter em 27 de agosto de 2026?
O NVIDIA Nemotron 3 Ultra teve a maior redução registrada, de 38,9%. O preço listado caiu de US$ 3,60 para US$ 2,20 por milhão de tokens.
O preço do Tencent Hy3 subiu ou caiu?
Os dois movimentos aparecem no catálogo no mesmo dia. Há um registro de alta de US$ 0,33 para US$ 0,528 e outro de queda de US$ 0,528 para US$ 0,33.
Qual modelo barato teve boa nota de inteligência?
O Artificial Analysis registrou o GLM-5.3-Flash com nota de inteligência de 57,5 e preço de US$ 0,238 por milhão. O Qwen3.8-Flash-Next teve nota de 55,8, mas sem preço informado nessa estreia.