FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

OpenRouter reajusta modelos em até 88,9% em um dia

GLM 5.2, Kimi K2.6 e DeepSeek V4 Flash aparecem entre os principais movimentos de preço. Para quem usa API em produção, a fatura pode mudar sem troca de modelo.

Redação FalaVIP IA 4 min de leitura
US$ 3,74por milhão de tokens de saída no GLM 5.2
88,9%de alta registrada no GLM 5.2
US$ 0,28por milhão de tokens de saída no DeepSeek V4 Flash 0731

Se você usa modelos de IA em produção, a alteração mais importante do dia não é um lançamento: é a possibilidade de pagar muito mais pelo mesmo endpoint. Os preços listados no OpenRouter mostram movimentos de até 88,9% em um intervalo de um dia, com impacto direto em integrações que não mudaram código nem volume.

O maior aumento registrado foi o do Z.ai: GLM 5.2, que passou de US$ 1,98 para US$ 3,74 por milhão de tokens de saída. A alta é de 88,9%. O Kimi K2.6, da MoonshotAI, também aparece com avanço expressivo, de US$ 2,36 para US$ 4, uma variação de 69,5%.

A lista ainda inclui o DeepSeek V4 Flash 0731, de US$ 0,18 para US$ 0,28 por milhão de tokens, alta de 55,6%. O GLM 5.1 subiu de US$ 2,992 para US$ 4,40, enquanto o Qwen3.5-35B-A3B avançou de US$ 1,25 para US$ 1,80.

A mesma lista também registra quedas

A movimentação não foi apenas de alta. O próprio Kimi K2.6 aparece novamente com uma queda de US$ 4 para US$ 2,36, ou 41%. O registro do DeepSeek V4 Flash Latest mostra redução de US$ 0,252 para US$ 0,16, queda de 36,7%.

Essa duplicidade é o ponto que impede uma leitura simplista da tabela. O mesmo modelo aparece associado a movimentos opostos no dia. Isso pode refletir momentos diferentes de atualização, variantes de rota ou registros distintos no catálogo. O dado disponível confirma a oscilação, mas não explica sua causa.

Também há registros conflitantes para o GLM 5.2: uma alteração de US$ 1,54 para US$ 1,98, alta de 28,6%, além do movimento de US$ 1,98 para US$ 3,74. No Llama 4 Maverick, da Meta, aparecem alta de 14,9%, de US$ 0,696 para US$ 0,80, e queda de 13%, no sentido inverso. A recomendação prática é conferir o preço vigente do identificador usado na aplicação, e não calcular a fatura apenas com base em uma variação isolada.

O que mudou — e o que não mudou

O reajuste altera o custo de uso. Não há, nos dados do dia, indicação de mudança nas capacidades dos modelos afetados, na janela de contexto ou no desempenho de benchmark. Portanto, trocar o modelo por uma opção mais barata pode alterar qualidade, latência ou comportamento, mas manter o modelo sem revisar o orçamento também deixou de ser uma decisão neutra.

O catálogo do OpenRouter reúne 549 modelos de 68 criadores. Nesse universo, houve 12 mudanças de preço em um único dia. Isso torna arriscado tratar o preço exibido no momento da integração como uma constante contratual, especialmente em produtos com alto volume de saída ou uso intensivo de raciocínio.

Para equipes pequenas, a consequência é objetiva: custos estimados com uma tarifa antiga podem subestimar a despesa mensal. Vale separar o consumo por modelo, registrar o preço efetivamente usado em cada período e criar um limite de gasto que acione uma revisão de rota ou de provedor.

Qwen3.8 chega com alternativa de contexto longo

O dia também teve dois lançamentos. O Qwen3.8 27B custa US$ 0,425 por milhão de tokens de entrada e US$ 2,55 por milhão de tokens de saída no OpenRouter. O modelo tem janela de contexto de 1.000.000 de tokens, pesos abertos e 27 bilhões de parâmetros.

O Artificial Analysis atribui ao Qwen3.8 27B nota de 68,075 em código e 50,877 em tarefas agênticas. Não há nota de inteligência geral registrada para ele nos dados do dia. A combinação de contexto amplo e pesos abertos interessa a quem precisa processar documentos extensos ou quer mais controle sobre a implantação, mas não transforma o modelo automaticamente em substituto direto para GLM, Kimi ou DeepSeek.

No índice do Artificial Analysis, o Qwen3.8 2.4T A95B estreou com nota de inteligência de 57,7 e preço de US$ 3 por milhão de tokens. O Gemini 3.7 Flash apareceu em três configurações, com notas de 56, 53,4 e 50,9, todas a US$ 1,50.

Para quem a mudança pesa

Se você mantém um chatbot de baixo volume, a diferença pode caber no orçamento, dependendo do consumo. Para uma API com muitas respostas longas, agentes que executam várias etapas ou automações que usam modelos Flash como padrão, uma alta de 55,6% ou 69,5% muda a projeção imediatamente.

A oscilação também não afeta todos os usuários da mesma forma. Quem usa uma camada própria de abstração e pode alternar entre modelos tem espaço para testar alternativas. Quem fixou um identificador, depende de uma qualidade específica ou não monitora o preço por requisição fica mais exposto.

A revisão necessária agora é financeira e operacional: confirme a tarifa atual no OpenRouter, compare o custo por tarefa — não apenas por token — e defina uma rota de fallback antes que a próxima atualização apareça na fatura.

Em uma frase

Se o modelo está em produção, confira hoje o preço vigente no OpenRouter e prepare uma alternativa antes de projetar o próximo ciclo de cobrança.

Perguntas frequentes

Qual modelo teve a maior alta de preço no OpenRouter?

O GLM 5.2, da Z.ai, teve a maior alta registrada: passou de US$ 1,98 para US$ 3,74 por milhão de tokens de saída, variação de 88,9%.

O DeepSeek V4 Flash ficou mais caro ou mais barato?

Depende do identificador considerado. O DeepSeek V4 Flash 0731 subiu de US$ 0,18 para US$ 0,28, enquanto o DeepSeek V4 Flash Latest caiu de US$ 0,252 para US$ 0,16.

Qual é o preço do Qwen3.8 27B?

No OpenRouter, o Qwen3.8 27B custa US$ 0,425 por milhão de tokens de entrada e US$ 2,55 por milhão de tokens de saída. A janela de contexto é de 1.000.000 de tokens.

Leia também