FalaVIP IA o que os modelos custam,
medido todo dia
Preços

APIs oscilam até 100% enquanto Z.ai, Tencent e NVIDIA mudam preços

O catálogo do OpenRouter registrou 20 alterações de preço em um dia, incluindo a duplicação do GLM 5.3 Flash e movimentos opostos para o Hy3. Para quem paga API, a estabilidade do orçamento virou uma hipótese a ser testada.

Redação FalaVIP IA 3 min de leitura
100%alta do GLM 5.3 Flash
US$ 4,40preço listado do GLM 5.3
20mudanças de preço em um dia

O preço de uma API pode dobrar sem que você troque uma linha de código. Foi o que aconteceu com o Z.ai GLM 5.3 Flash: o valor listado passou de US$ 0,25 para US$ 0,50 por milhão de tokens, uma alta de 100% em 14 de setembro de 2026.

Esse não foi um caso isolado. Os preços listados no OpenRouter registraram 20 mudanças em um único dia, enquanto o catálogo reunia 598 modelos de 71 criadores. Para quem usa modelos em produção, a notícia não é apenas que há opções mais baratas. É que o custo operacional pode mudar no mesmo catálogo e na mesma data.

A alta que muda a planilha

O GLM 5.3 Flash é o exemplo mais direto para equipes que escolhem modelos por custo. Uma aplicação que consuma 100 milhões de tokens no preço anterior pagaria US$ 25; no novo valor, US$ 50. O cálculo considera o preço listado por milhão de tokens e não inclui outras variáveis de uso.

O modelo mais robusto da mesma família também subiu: o GLM 5.3 passou de US$ 3,432 para US$ 4,40 por milhão de tokens. O aumento foi de 28,2%. Já o GLM 5.2 avançou de US$ 2 para US$ 2,147, uma alta de 7,4%.

A leitura prática é incômoda: permanecer na mesma família não garante previsibilidade. Se a aplicação usa roteamento por nome de modelo e não congela preços, uma alteração do provedor pode aparecer diretamente na fatura.

Hy3 expõe a instabilidade do catálogo

O caso da Tencent Hy3 é ainda mais difícil de interpretar. Um registro aponta alta de US$ 0,33 para US$ 0,528, ou 60%. Outro registro do mesmo dia mostra o movimento inverso, de US$ 0,528 para US$ 0,33, queda de 37,5%.

Isso não permite tratar o Hy3 como um modelo que simplesmente ficou 60% mais caro. O que aparece é uma sequência de preços conflitantes no catálogo. Para o comprador de API, a consequência é concreta: uma captura de preço em um momento do dia pode não representar o valor disponível em outro momento.

A NVIDIA também teve movimentos em sentidos opostos. O Nemotron 3 Ultra caiu de US$ 3,125 para US$ 2,40 por milhão de tokens, redução de 23,2%. O Nemotron 3 Super subiu de US$ 0,40 para US$ 0,45, alta de 12,5%.

DeepSeek combina lançamentos e reajustes

A DeepSeek lançou dois modelos no dia: o DeepSeek Pro Latest, com preço de US$ 0,579 por milhão de tokens de entrada e US$ 1,738 de saída, e o DeepSeek Flash Latest, a US$ 0,15 de entrada e US$ 0,60 de saída. Ambos têm janela de contexto de 1.048.576 tokens, segundo os preços e especificações listados no OpenRouter.

Ao mesmo tempo, versões já catalogadas também oscilaram. O DeepSeek V4 Flash 0423 subiu de US$ 0,095 para US$ 0,177, alta de 86,1%. O V4 Pro 0813 aparece em registros que mostram alta de 69,7%, de US$ 1,738 para US$ 2,95, e depois quedas para US$ 1,976 e US$ 1,738.

Nem toda mudança foi para cima. O Qwen3 14B caiu de US$ 0,91 para US$ 0,24, redução de 73,6%. O Llama 4 Maverick recuou de US$ 0,696 para US$ 0,653, queda de 6,3%.

O que muda para quem escolhe modelo

Se você usa um modelo em produção, a prioridade é separar desempenho de preço e monitorar os dois. As notas do Artificial Analysis ajudam a comparar inteligência, código e uso agêntico quando estão disponíveis, mas não substituem a conferência do valor cobrado na rota escolhida.

O movimento também não atinge todos da mesma forma. Uma equipe que faz testes ocasionais pode absorver uma variação pontual. Uma empresa que gera alto volume, mantém margens estreitas ou usa agentes com muitas chamadas sente rapidamente uma duplicação no preço. Para esse grupo, o risco não está apenas no modelo mais caro, mas na ausência de um limite de gasto e de uma rota alternativa.

A implicação prática é direta: fixe o preço esperado por modelo, registre a data da verificação e coloque alerta para mudanças antes de deixar a aplicação escalar.

Em uma frase

Se você usa API em produção, trate o preço do modelo como uma variável operacional: monitore o OpenRouter, limite gastos e mantenha uma alternativa antes que uma alta de 100% chegue à fatura.

Perguntas frequentes

Qual API teve a maior alta de preço em 14 de setembro de 2026?

O Z.ai GLM 5.3 Flash teve a maior alta destacada, de 100%. O preço listado passou de US$ 0,25 para US$ 0,50 por milhão de tokens.

O preço do Tencent Hy3 subiu ou caiu?

Os registros do OpenRouter mostram os dois movimentos no mesmo dia. Um aponta alta de 60%, de US$ 0,33 para US$ 0,528, e outro mostra queda de 37,5%, de US$ 0,528 para US$ 0,33.

Qual foi o preço do NVIDIA Nemotron 3 Ultra?

O preço listado caiu de US$ 3,125 para US$ 2,40 por milhão de tokens, uma redução de 23,2%. A mudança afeta o custo da API, não é uma nota de desempenho.

Leia também