GLM 5.2 dobra preço enquanto DeepSeek V4 Pro estreia barato
O catálogo do OpenRouter registrou 12 mudanças de preço em um dia. O DeepSeek V4 Pro aparece no Artificial Analysis com desempenho de raciocínio por uma fração do custo dos líderes.
Se você usa modelos em produção, a notícia mais importante do catálogo nesta quinta-feira não é um novo recorde de inteligência. É a instabilidade da fatura: o GLM 5.2 passou de US$ 1,54 para US$ 3,15 por milhão de tokens, alta de 104,5%, enquanto o Gemini Flash Latest caiu de US$ 7,50 para US$ 1,875, redução de 75%.
Os preços listados no OpenRouter mostram 12 mudanças em um único dia. A movimentação atinge Z.ai, MoonshotAI, Google e Qwen. Para quem escolhe um modelo apenas pelo preço visto hoje, o risco é montar uma arquitetura com custo que muda antes do próximo ciclo de cobrança.
O GLM 5.2 expõe a volatilidade
O caso mais extremo é o GLM 5.2. O mesmo modelo aparece com uma alta de 104,5%, de US$ 1,54 para US$ 3,15 por milhão de tokens, e também com uma queda de 51,1%, de US$ 3,15 para US$ 1,54. O registro do dia, portanto, não descreve uma trajetória estável: ele captura oscilações bruscas no catálogo.
O GLM 5.1 também ficou mais barato, passando de US$ 4,40 para US$ 2,992, queda de 32%. Já o GLM 4.6 recuou de US$ 2,20 para US$ 2, uma redução de 9,1%.
Na MoonshotAI, o Kimi K2.6 foi de US$ 2,44 para US$ 4, alta de 63,9%, e também aparece no sentido contrário, de US$ 4 para US$ 2,36, queda de 41%. A mensagem para uma equipe de produção é direta: não basta comparar fornecedores; é preciso acompanhar a tarifa do identificador exato usado pela aplicação.
Qwen 3.5 sobe, mas não de forma linear
A linha Qwen 3.5 teve reajustes para cima. O Qwen3.5-35B-A3B passou de US$ 1 para US$ 1,25 por milhão de tokens, alta de 25%. O Qwen3.5 397B A17B foi de US$ 3 para US$ 3,60, aumento de 20%.
O mesmo modelo de 397B A17B também registra uma queda posterior de US$ 3,60 para US$ 3, redução de 16,7%. Assim como no GLM 5.2, a sequência sugere que o preço disponível no catálogo pode variar rapidamente. Se a escolha depende de margem apertada, o valor atual precisa entrar nos testes de orçamento e não apenas na documentação inicial da integração.
DeepSeek V4 Pro chega com foco em raciocínio
O Artificial Analysis registrou a estreia de três configurações do DeepSeek V4 Pro. A versão Reasoning, Max Effort marcou 45,3 no índice de inteligência; a Reasoning, High Effort ficou em 43,7; e a Non-reasoning, em 31,9. Todas aparecem com preço de US$ 0,544 por milhão de tokens no índice.
O resultado mais eficiente não é o maior índice absoluto do catálogo. No ranking de custo-benefício do Artificial Analysis, o DeepSeek V4 Pro 0813 Reasoning, Max Effort aparece com índice 53 e preço de US$ 0,544. O DeepSeek V4 Flash 0731 Reasoning, Max Effort lidera essa lista com índice 51,8 a US$ 0,175.
Isso vale para quem precisa de raciocínio em tarefas de alto volume e aceita avaliar qualidade caso a caso. Não muda a decisão de quem precisa do melhor índice geral: o topo continua com Claude Opus 5 Adaptive Reasoning, Max Effort, com 63,1 a US$ 10 por milhão de tokens. O Grok 4.6 high marca 60,9 a US$ 3, uma alternativa mais barata entre os seis primeiros colocados.
Gemini 3.7 Flash mira volume
O Google lançou o Gemini 3.7 Flash e sua versão batch. A versão regular custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 de saída, com janela de contexto de 1.048.576 tokens. O batch custa US$ 0,188 na entrada e US$ 0,938 na saída, mantendo a mesma janela.
O modelo estreou com nota de código de 76,121 e nota agêntica de 45,105 no Artificial Analysis. A opção batch não tem essas notas registradas. Para processamento assíncrono, a tarifa reduzida pode ser mais relevante que a diferença de desempenho; para respostas interativas, a versão regular é a comparação apropriada.
O catálogo passou a reunir 547 modelos de 67 criadores. No recorte do dia, foram dois lançamentos e dez estreias no índice de benchmarks, além das 12 mudanças de preço. Para você, a implicação prática é revisar hoje os limites de gasto, o identificador fixado e a rota de fallback: uma troca automática de versão pode alterar a conta sem mudar uma linha do prompt.
Fixe o identificador do modelo e monitore o preço antes de colocar GLM, Qwen ou Gemini em uma rota de produção.
Perguntas frequentes
Quanto custa o DeepSeek V4 Pro no benchmark?
O DeepSeek V4 Pro aparece no Artificial Analysis a US$ 0,544 por milhão de tokens nas configurações Reasoning, Max Effort, Reasoning, High Effort e Non-reasoning. A versão Max Effort 0813 tem índice de inteligência 53 no ranking de custo-benefício.
O preço do GLM 5.2 subiu ou caiu?
Os dois movimentos aparecem no registro do dia. O GLM 5.2 foi de US$ 1,54 para US$ 3,15, alta de 104,5%, e também de US$ 3,15 para US$ 1,54, queda de 51,1%, o que indica forte volatilidade no catálogo.
Qual é o preço do Gemini 3.7 Flash?
No OpenRouter, a versão regular custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 de saída. A versão batch custa US$ 0,188 na entrada e US$ 0,938 na saída.