Nemotron 3 Ultra oscilou 64% em 28/07 e mais 5 preços mexeram
Qwen3 Coder Next subiu 64% no input e ficou; GLM 5.2 fez ioiô. Veja quem paga mais caro agora e quem voltou ao preço de ontem.
Se você abriu o painel de billing hoje e achou que viu um fantasma, não viu. Foi o catálogo de modelos mexendo em preço no mesmo dia, em mais de uma direção. Nesta terça-feira, 28 de julho de 2026, o catálogo — que lista mais de 522 modelos de 66 criadores — registrou seis alterações de preço. Duas delas foram do mesmo modelo, em sentidos opostos, na mesma janela de 24 horas.
É o tipo de evento que mostra, na prática, por que "preço de modelo" não é atributo de produto — é atributo de prateleira. O que importa para quem está rodando inference em produção é o valor que aparece no momento em que a chamada é feita, não o de ontem.
Nemotron 3 Ultra fez ioiô no mesmo dia
O caso mais marcante foi o do NVIDIA Nemotron 3 Ultra. Pela manhã, o preço de saída saltou de US$ 2,20 para US$ 3,60 por milhão de tokens — um aumento de 64%. Horas depois, o catálogo registrou o movimento inverso: o output voltou para US$ 2,20 e o input caiu de US$ 0,60 para US$ 0,50. Resultado líquido do dia: zero. O modelo acabou exatamente onde começou.
Mas o sinal fica. Se você é o tipo de pessoa que faz lock de fornecedor buscando previsibilidade de custo, esse é o aviso de que "lock de preço" não existe nesse catálogo: o histórico da fatura é o que sobra, e o catálogo permite que provedores mexam a qualquer momento.
Qwen3 Coder Next e Gemma 4, as altas que ficaram
Nem todo mundo voltou ao ponto de partida. Dois movimentos foram líquidos — ou seja, o preço de fechamento do dia foi mesmo diferente do de ontem:
- Qwen3 Coder Next: input saltou de US$ 0,11 para US$ 0,18 por milhão de tokens (+64%). Output foi de US$ 0,80 para US$ 0,90 (+13%).
- Google Gemma 4 26B A4B: input de US$ 0,14 para US$ 0,15 (+7%); output de US$ 0,42 para US$ 0,45 (+7%).
Para o Qwen3 Coder Next, o salto no input é o que pesa: prompts longos — típicos de fluxos de code generation que injetam repositórios inteiros — vão custar quase o dobro agora. Se você roda esse modelo achando que ele era "barato", precisa refazer a conta.
Para o Gemma 4 26B A4B, a alta é pequena em valor absoluto, mas segue o movimento de alta que a família vinha mostrando nesse catálogo.
Z.ai GLM 5.2 fez ioiô e quase voltou
O Z.ai GLM 5.2 entrou na lista duas vezes — primeiro caiu (input de US$ 0,7714 para US$ 0,721, output de US$ 2,4244 para US$ 2,266), depois subiu de novo (input de US$ 0,721 para US$ 0,7686, output de US$ 2,266 para US$ 2,4156). No líquido do dia, input e output caíram cerca de 0,4% em cada. Para quem usa GLM 5.2 hoje, a mudança efetiva é marginal.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| Nemotron 3 Ultra | 2.2 | 3.6 | +64% |
| Nemotron 3 Ultra | 3.6 | 2.2 | -39% |
| Qwen3 Coder Next | 0.8 | 0.9 | +13% |
| GLM 5.2 | 2.4244 | 2.266 | -7% |
| Gemma 4 26B A4B | 0.42 | 0.45 | +7% |
| GLM 5.2 | 2.266 | 2.4156 | +7% |
O que isso significa na prática
"Preço mudou" pode significar três coisas diferentes no mesmo dia:
- Preço mudou e ficou (Qwen3 Coder Next, Gemma 4): quem usa esses modelos paga mais a partir de agora.
- Preço mudou e voltou (Nemotron 3 Ultra): quem usa hoje paga igual a ontem, mas viu o pico passar pela fatura se estava rodando inference durante a janela da alta.
- Preço mudou e quase voltou (GLM 5.2): mudança residual irrelevante.
O sinal maior para quem decide arquitetura é o ponto 2: o catálogo não trava preço entre alterações. A defesa continua sendo locks curtos, monitoramento de billing em tempo real e fallback para modelo alternativo já configurado. O topo do catálogo segue com Claude Opus 5 (IQ 63,053 a US$ 25 por milhão de tokens de saída) e GPT-5.6 Sol (IQ 60,93 a US$ 10 por milhão) como referência de qualidade-preço na faixa premium.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
Para quem cada movimento importa
- Quem usa Qwen3 Coder Next em produção: refazer a planilha de custo. O input subiu 64% de verdade. Se o seu caso é prompt pequeno, mal muda; se é prompt longo, quase dobra.
- Quem usa Google Gemma 4 26B A4B: aumento pequeno em valor absoluto, mas acumulando tendência de alta — vale comparar com alternativas na faixa de IQ 45+, como MiniMax M3 e GPT-5.6 Luna, ambos a US$ 1,20 por milhão de tokens de saída.
- Quem usa GLM 5.2 ou Nemotron 3 Ultra: sem mudança efetiva hoje, mas o sinal de volatilidade está aí.
- Quem não usa nenhum desses: vida normal. Nenhuma mudança aqui afeta a escolha entre Claude Opus 5, GPT-5.6 Sol, Kimi K3 ou os modelos do topo do catálogo.
A implicação prática é direta: se o seu modelo do dia a dia está nesta lista, abra o dashboard de billing hoje e confirme o preço vigente antes de continuar queimando tokens. E se você ainda não tem fallback automático configurado para quando o modelo principal der uma oscilada, este é o dia para colocar isso na sprint.
Confirme hoje o preço vigente do Qwen3 Coder Next no dashboard de billing — o input subiu 64% de verdade — e configure fallback automático para o seu modelo principal, porque 28/07 mostrou que um provider pode mexer em preço duas vezes no mesmo dia.
Perguntas frequentes
Quais modelos mudaram de preço em 28 de julho de 2026?
Foram seis mudanças detectadas: Nemotron 3 Ultra (oscilou para cima e voltou ao preço original), Qwen3 Coder Next (input +64%, output +13%), Z.ai GLM 5.2 (oscilou para baixo e voltou quase ao mesmo lugar) e Google Gemma 4 26B A4B (input +7%, output +7%).
O Nemotron 3 Ultra continua mais caro depois das mudanças?
Não, no líquido do dia o Nemotron 3 Ultra voltou ao preço de antes: US$ 0,50 de input e US$ 2,20 de saída por milhão de tokens. A alta de 64% foi uma oscilação intradiária que não se sustentou no fechamento.
Vale trocar de modelo depois dessas mudanças?
Depende do uso. Se você roda Qwen3 Coder Next com prompts longos (caso típico de code generation), o custo de input quase dobrou e vale refazer a conta ou testar alternativas na faixa de IQ 45+, como GPT-5.6 Luna ou MiniMax M3, ambos a US$ 1,20 por milhão de tokens de saída no catálogo.