FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 dobra preço enquanto DeepSeek V4 Pro estreia barato

O catálogo do OpenRouter registrou 12 mudanças de preço em um dia. O DeepSeek V4 Pro aparece no Artificial Analysis com desempenho de raciocínio por uma fração do custo dos líderes.

Redação FalaVIP IA 3 min de leitura
104,5%de alta no preço listado do GLM 5.2
US$ 0,544por milhão de tokens para o DeepSeek V4 Pro no benchmark
US$ 0,175por milhão de tokens no DeepSeek V4 Flash, líder em custo-benefício

Se você usa modelos em produção, a notícia mais importante do catálogo nesta quinta-feira não é um novo recorde de inteligência. É a instabilidade da fatura: o GLM 5.2 passou de US$ 1,54 para US$ 3,15 por milhão de tokens, alta de 104,5%, enquanto o Gemini Flash Latest caiu de US$ 7,50 para US$ 1,875, redução de 75%.

Os preços listados no OpenRouter mostram 12 mudanças em um único dia. A movimentação atinge Z.ai, MoonshotAI, Google e Qwen. Para quem escolhe um modelo apenas pelo preço visto hoje, o risco é montar uma arquitetura com custo que muda antes do próximo ciclo de cobrança.

O GLM 5.2 expõe a volatilidade

O caso mais extremo é o GLM 5.2. O mesmo modelo aparece com uma alta de 104,5%, de US$ 1,54 para US$ 3,15 por milhão de tokens, e também com uma queda de 51,1%, de US$ 3,15 para US$ 1,54. O registro do dia, portanto, não descreve uma trajetória estável: ele captura oscilações bruscas no catálogo.

O GLM 5.1 também ficou mais barato, passando de US$ 4,40 para US$ 2,992, queda de 32%. Já o GLM 4.6 recuou de US$ 2,20 para US$ 2, uma redução de 9,1%.

Na MoonshotAI, o Kimi K2.6 foi de US$ 2,44 para US$ 4, alta de 63,9%, e também aparece no sentido contrário, de US$ 4 para US$ 2,36, queda de 41%. A mensagem para uma equipe de produção é direta: não basta comparar fornecedores; é preciso acompanhar a tarifa do identificador exato usado pela aplicação.

Qwen 3.5 sobe, mas não de forma linear

A linha Qwen 3.5 teve reajustes para cima. O Qwen3.5-35B-A3B passou de US$ 1 para US$ 1,25 por milhão de tokens, alta de 25%. O Qwen3.5 397B A17B foi de US$ 3 para US$ 3,60, aumento de 20%.

O mesmo modelo de 397B A17B também registra uma queda posterior de US$ 3,60 para US$ 3, redução de 16,7%. Assim como no GLM 5.2, a sequência sugere que o preço disponível no catálogo pode variar rapidamente. Se a escolha depende de margem apertada, o valor atual precisa entrar nos testes de orçamento e não apenas na documentação inicial da integração.

DeepSeek V4 Pro chega com foco em raciocínio

O Artificial Analysis registrou a estreia de três configurações do DeepSeek V4 Pro. A versão Reasoning, Max Effort marcou 45,3 no índice de inteligência; a Reasoning, High Effort ficou em 43,7; e a Non-reasoning, em 31,9. Todas aparecem com preço de US$ 0,544 por milhão de tokens no índice.

O resultado mais eficiente não é o maior índice absoluto do catálogo. No ranking de custo-benefício do Artificial Analysis, o DeepSeek V4 Pro 0813 Reasoning, Max Effort aparece com índice 53 e preço de US$ 0,544. O DeepSeek V4 Flash 0731 Reasoning, Max Effort lidera essa lista com índice 51,8 a US$ 0,175.

Isso vale para quem precisa de raciocínio em tarefas de alto volume e aceita avaliar qualidade caso a caso. Não muda a decisão de quem precisa do melhor índice geral: o topo continua com Claude Opus 5 Adaptive Reasoning, Max Effort, com 63,1 a US$ 10 por milhão de tokens. O Grok 4.6 high marca 60,9 a US$ 3, uma alternativa mais barata entre os seis primeiros colocados.

Gemini 3.7 Flash mira volume

O Google lançou o Gemini 3.7 Flash e sua versão batch. A versão regular custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 de saída, com janela de contexto de 1.048.576 tokens. O batch custa US$ 0,188 na entrada e US$ 0,938 na saída, mantendo a mesma janela.

O modelo estreou com nota de código de 76,121 e nota agêntica de 45,105 no Artificial Analysis. A opção batch não tem essas notas registradas. Para processamento assíncrono, a tarifa reduzida pode ser mais relevante que a diferença de desempenho; para respostas interativas, a versão regular é a comparação apropriada.

O catálogo passou a reunir 547 modelos de 67 criadores. No recorte do dia, foram dois lançamentos e dez estreias no índice de benchmarks, além das 12 mudanças de preço. Para você, a implicação prática é revisar hoje os limites de gasto, o identificador fixado e a rota de fallback: uma troca automática de versão pode alterar a conta sem mudar uma linha do prompt.

Em uma frase

Fixe o identificador do modelo e monitore o preço antes de colocar GLM, Qwen ou Gemini em uma rota de produção.

Perguntas frequentes

Quanto custa o DeepSeek V4 Pro no benchmark?

O DeepSeek V4 Pro aparece no Artificial Analysis a US$ 0,544 por milhão de tokens nas configurações Reasoning, Max Effort, Reasoning, High Effort e Non-reasoning. A versão Max Effort 0813 tem índice de inteligência 53 no ranking de custo-benefício.

O preço do GLM 5.2 subiu ou caiu?

Os dois movimentos aparecem no registro do dia. O GLM 5.2 foi de US$ 1,54 para US$ 3,15, alta de 104,5%, e também de US$ 3,15 para US$ 1,54, queda de 51,1%, o que indica forte volatilidade no catálogo.

Qual é o preço do Gemini 3.7 Flash?

No OpenRouter, a versão regular custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 de saída. A versão batch custa US$ 0,188 na entrada e US$ 0,938 na saída.

Leia também