Hy3 sobe 60%, enquanto Nemotron 3.5 Lightning fica 20% mais barato
A Tencent encarece o Hy3 no OpenRouter, enquanto a NVIDIA reduz o preço do Nemotron 3.5 Lightning. Se você usa uma dessas opções em produção, a revisão de custo-benefício deixou de ser opcional.
O mercado intermediário de modelos de IA teve uma mudança que afeta diretamente a fatura: o Hy3, da Tencent, ficou 60% mais caro, enquanto o Nemotron 3.5 Lightning, da NVIDIA, caiu 20%. Nos preços listados no OpenRouter, o Hy3 passou de US$ 0,33 para US$ 0,528 por milhão de tokens de saída. O Nemotron fez o caminho inverso, de US$ 0,25 para US$ 0,20.
Se você usa o Hy3 em produção, não basta atualizar a tabela de preços. É preciso recalcular o custo por tarefa, principalmente em fluxos com respostas longas, agentes que fazem várias chamadas ou sistemas que processam grandes volumes. Para quem roda o Nemotron 3.5 Lightning, a redução abre espaço para aumentar o uso ou reduzir a despesa — desde que a qualidade continue adequada ao caso de uso.
A conta mudou sem troca de modelo
O reajuste do Hy3 não vem acompanhado, nos dados disponíveis, de um lançamento ou de uma nova nota de desempenho. O registro do dia não aponta estreias de modelos. Isso muda a leitura do anúncio: o mesmo modelo passou a custar mais, e a justificativa não aparece nos dados apresentados.
Na prática, uma aplicação que mantém o mesmo volume de saída com o Hy3 terá uma tarifa maior por milhão de tokens. A diferença pesa mais em produtos com geração frequente de texto, classificação em lote e automações que acumulam respostas intermediárias. Se o modelo foi escolhido porque ficava em uma faixa de preço competitiva, essa premissa precisa ser testada novamente.
A NVIDIA oferece o movimento contrário. A queda do Nemotron 3.5 Lightning reduz o preço de saída para US$ 0,20 por milhão de tokens. Para equipes que já validaram o modelo, o corte pode melhorar a margem sem exigir uma migração imediata. Para quem ainda está escolhendo uma opção, o preço menor torna o teste mais barato, mas não prova que ele seja superior ao Hy3 em qualidade, velocidade ou estabilidade.
O preço sozinho não resolve a escolha
Os índices do Artificial Analysis mostram que custo-benefício depende de mais do que a tarifa. Entre os modelos destacados, Qwen3.8-Flash-Next aparece com índice de inteligência de 55,8 e preço de US$ 0,23 por milhão de tokens. O GLM-5.3-Flash registra índice de 57,5 a US$ 0,238. Esses números servem como referência para a faixa de preço, não como comparação direta com Hy3 ou Nemotron.
Não há, nos dados apresentados, notas de inteligência, código ou desempenho agêntico para os dois modelos afetados pelo reajuste. Portanto, não é possível afirmar que o Nemotron entrega mais valor apenas porque ficou mais barato, nem que o Hy3 deixou de ser competitivo apenas porque subiu. A decisão exige medir a taxa de acerto, o número de chamadas por tarefa e a quantidade média de tokens gerados.
Essa ausência de nota é importante para quem escolhe modelo por planilha. Um preço menor pode ser anulado por mais tentativas, correções manuais ou chamadas adicionais. Da mesma forma, um modelo mais caro pode continuar compensando se resolver a tarefa com menos etapas. O custo relevante é o da tarefa concluída, não apenas o valor por milhão de tokens.
Quem precisa revisar agora
A mudança é urgente para quem tem o Hy3 fixado como padrão em produção, sobretudo em rotas de alto volume. Também vale para empresas que definiram um limite de custo por tarefa com base no preço anterior de US$ 0,33. O reajuste pode alterar a margem mesmo sem qualquer mudança no código.
O corte do Nemotron interessa mais a quem já usa a NVIDIA ou mantém uma arquitetura com fallback entre modelos. Nesse cenário, vale testar se o modelo pode absorver parte do tráfego que hoje vai para alternativas mais caras. A redução também favorece workloads assíncronos e processamento em lote, desde que os requisitos de latência e qualidade permitam.
Para quem não usa Hy3 nem Nemotron 3.5 Lightning, o impacto direto é zero. Ainda assim, os dois movimentos funcionam como alerta: preços de modelos intermediários podem mudar rapidamente, e uma escolha barata hoje não garante uma fatura previsível amanhã.
O próximo passo é medir a tarefa
Antes de trocar o provedor, congele uma amostra representativa das solicitações e compare os dois modelos com a mesma entrada, o mesmo limite de saída e o mesmo critério de aprovação. Registre custo por tarefa, quantidade de tokens, falhas e necessidade de nova chamada.
Se o Hy3 continuar entregando resultado melhor com menos tentativas, o aumento pode ser absorvido. Se a diferença de qualidade for pequena, o Nemotron a US$ 0,20 passa a ser um candidato natural para reduzir o custo. A escolha final deve sair do preço de tabela para o custo por resultado aceito.
Se o Hy3 está em produção, refaça hoje o custo por tarefa; se o Nemotron já foi validado, o corte de 20% é uma oportunidade concreta para ampliar seu uso.
Perguntas frequentes
Quanto passou a custar o Tencent Hy3 no OpenRouter?
O Hy3 passou de US$ 0,33 para US$ 0,528 por milhão de tokens de saída. O reajuste representa aumento de 60%.
Qual é o novo preço do NVIDIA Nemotron 3.5 Lightning?
O modelo passou de US$ 0,25 para US$ 0,20 por milhão de tokens de saída. A redução registrada é de 20%.
O Nemotron ficou automaticamente melhor que o Hy3?
Não. Os dados apresentados não trazem notas de inteligência, código ou desempenho agêntico para os dois modelos. O preço menor do Nemotron exige validação com as tarefas reais da aplicação.