FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

DeepSeek V4 Pro sobe 127,6%; GLM 5.2 cai 33,3%

O preço listado do DeepSeek V4 Pro 0813 passa de US$ 0,87 para US$ 1,98 por milhão de tokens. No mesmo dia, o GLM 5.2 fica mais barato e chega a US$ 0,968 na saída.

Redação FalaVIP IA 3 min de leitura
US$ 1,98por milhão de tokens no preço listado do DeepSeek V4 Pro 0813
127,6%alta no preço do DeepSeek V4 Pro 0813
US$ 0,968por milhão de tokens de saída do GLM 5.2

Se você usa o DeepSeek V4 Pro 0813 em produção, a conta projetada para o modelo fica mais pesada a partir de hoje. O preço listado no OpenRouter subiu de US$ 0,87 para US$ 1,98 por milhão de tokens, uma alta de 127,6%.

A mudança contrasta com o GLM 5.2. O modelo da Z.ai teve queda de 33,3%, de US$ 1,452 para US$ 0,968 por milhão de tokens no preço de saída. Para quem está revisando o roteamento de modelos ou negociando o orçamento de inferência, a diferença muda a ordem das alternativas.

O que mudou na prática

O aumento do DeepSeek V4 Pro não é um ajuste marginal. O preço listado passou a superar o do GLM 5.2 em mais de uma vez, considerando os valores registrados para a saída. Em aplicações que geram respostas longas, executam fluxos com várias chamadas ou mantêm alto volume, o efeito aparece diretamente na fatura.

Isso não significa que toda requisição ao DeepSeek ficou automaticamente mais cara na mesma proporção. O impacto depende da divisão entre tokens de entrada e saída, do volume usado e da forma como a aplicação aproveita cache. O dado disponível para a mudança registra o preço que saiu de US$ 0,87 e chegou a US$ 1,98; ele não separa entrada e saída nessa alteração.

O GLM 5.2, por outro lado, aparece no OpenRouter com US$ 0,308 por milhão de tokens de entrada, US$ 0,968 na saída e US$ 0,1932 em cache. A janela de contexto é de 1.048.576 tokens. Na prática, isso dá ao modelo uma combinação de preço menor na saída e espaço amplo para prompts, históricos e documentos — desde que o desempenho da tarefa seja suficiente.

Para quem o GLM 5.2 passa a fazer sentido

A queda interessa principalmente a quem pode trocar o modelo sem refazer toda a arquitetura. Se o seu serviço usa geração de texto, classificação, extração ou etapas de agentes e o GLM 5.2 entrega qualidade aceitável, vale colocá-lo em um teste controlado contra o DeepSeek V4 Pro.

Os índices do Artificial Analysis ajudam a dimensionar a escolha. O GLM 5.2 registra 52,6 em inteligência, 68,756 em código e 45,667 em tarefas agênticas. O modelo tem 753 bilhões de parâmetros, com 40 bilhões ativos, e pesos abertos. Esses indicadores não substituem um teste com seus próprios prompts, mas mostram que a alternativa não deve ser avaliada apenas pelo preço.

A queda também vale para equipes que mantêm fallback, roteamento por complexidade ou diferentes modelos para etapas distintas. Uma aplicação pode reservar um modelo mais caro para casos difíceis e usar o GLM 5.2 em tarefas de maior volume. O ganho depende de a mudança não reduzir a taxa de acerto a ponto de gerar retrabalho ou novas chamadas.

As alternativas ficaram mais variadas

O movimento não foi isolado. O Qwen3.6 27B caiu de US$ 3,60 para US$ 2 por milhão de tokens, redução de 44,4%. O NVIDIA Nemotron 3.5 Lightning recuou de US$ 0,25 para US$ 0,20, enquanto o DeepSeek V4 Flash Latest passou de US$ 0,134 para US$ 0,121.

Também houve alta no Qwen3 30B A3B, de US$ 0,50 para US$ 0,52, uma variação de 4%. O catálogo registrou 11 mudanças de preço no dia, com 549 modelos de 68 criadores. Ou seja: o aumento do V4 Pro ocorre dentro de um mercado em que outros modelos estão ficando mais baratos, e não em uma alta generalizada.

Há uma ressalva importante no caso do Kimi K2.6. O mesmo identificador aparece com uma alta de 49,6%, de US$ 2,28 para US$ 3,41, e também com uma queda de 33,1%, de US$ 3,41 para US$ 2,28. O registro não esclarece se são momentos distintos, rotas diferentes ou uma correção de preço. Não dá para tratar esse item como uma direção única sem confirmação adicional.

O que não muda

A redução do GLM 5.2 não prova que ele substitui o DeepSeek V4 Pro em qualquer carga. Também não há estreia de modelo nem novo índice de benchmark registrado nesta janela. A comparação de qualidade precisa considerar seus casos reais, especialmente se o sistema depende de raciocínio, código ou uso de ferramentas.

Para quem já usa o GLM 5.2, a mudança é uma oportunidade de recalcular o custo por tarefa e revisar limites de uso. Para quem está no DeepSeek V4 Pro, a alta é um gatilho para medir tokens, renegociar o roteamento e testar alternativas. Para quem não usa nenhum dos dois, o impacto é apenas de mercado: há mais uma referência de preço para comparar antes de escolher um modelo.

Em uma frase

Se o DeepSeek V4 Pro está em produção, rode agora um teste de substituição pelo GLM 5.2 antes que a alta de 127,6% vire custo recorrente.

Perguntas frequentes

Quanto custa o DeepSeek V4 Pro 0813 na API?

O preço listado no OpenRouter passou de US$ 0,87 para US$ 1,98 por milhão de tokens. A variação registrada foi de 127,6%.

Qual é o preço do GLM 5.2?

O GLM 5.2 custa US$ 0,308 por milhão de tokens de entrada e US$ 0,968 por milhão de tokens de saída. O valor da saída caiu 33,3% em relação ao preço anterior de US$ 1,452.

O GLM 5.2 é uma alternativa mais barata ao DeepSeek V4 Pro?

No preço de saída listado, sim: o GLM 5.2 está em US$ 0,968, contra US$ 1,98 do DeepSeek V4 Pro 0813. A substituição ainda depende do desempenho do modelo na tarefa e do perfil de tokens da aplicação.

Leia também