FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

OpenRouter eleva preços de Kimi, DeepSeek e Qwen em até 75,4%

O Kimi K2.6 passou a custar US$ 4 por milhão de tokens de saída. Mas a mesma lista também registra quedas, inclusive no DeepSeek V4 Flash 0731.

Redação FalaVIP IA 3 min de leitura
US$ 4,00por milhão de tokens de saída do Kimi K2.6
75,4%de alta no preço do Kimi K2.6
13mudanças de preço registradas no dia

Se você usa o Kimi K2.6 em produção, o preço por milhão de tokens de saída subiu de US$ 2,28 para US$ 4 no OpenRouter em 24 de agosto de 2026. A alta é de 75,4% e muda diretamente a conta de aplicações que geram muito texto, código ou respostas longas.

A lista do OpenRouter registra aumentos relevantes também para o DeepSeek V4 Flash 0731 e o Qwen3.5 397B A17B. Mas há uma tensão importante no anúncio: a lista não mostra apenas encarecimentos. São 13 mudanças no total, com reduções em alguns modelos e até duas movimentações registradas para o mesmo DeepSeek no mesmo dia.

Kimi lidera a alta do dia

O MoonshotAI Kimi K2.6 teve o maior aumento entre os modelos destacados: de US$ 2,28 para US$ 4 por milhão de tokens, avanço de 75,4%. Para quem paga a API, isso significa que o mesmo volume de saída passa a custar mais, sem qualquer mudança de arquitetura necessária para que a fatura aumente.

O Kimi K2.5 também ficou mais caro. O preço saiu de US$ 2,25 para US$ 3 por milhão de tokens, alta de 33,3%. Se a aplicação alterna entre as duas versões, o orçamento precisa considerar as duas novas tarifas, e não apenas o modelo usado com mais frequência.

DeepSeek tem aumento, queda e preço final menor

O caso mais confuso é o DeepSeek V4 Flash 0731. Uma alteração registrada no OpenRouter elevou o preço de US$ 0,18 para US$ 0,28 por milhão de tokens, alta de 55,6%. Outra entrada para o mesmo identificador registra uma redução de US$ 0,28 para US$ 0,132, queda de 53%.

A leitura prática é que não basta olhar para o percentual da alta isoladamente. Na própria sequência de registros do dia, o valor termina abaixo do preço inicial informado: US$ 0,132 contra US$ 0,18. A lista também mostra o DeepSeek V4 Flash 0423 subindo de US$ 0,098 para US$ 0,115, aumento de 17,5%.

No V4 Pro 0423, o preço passou de US$ 0,794 para US$ 1,052, alta de 32,6%, e depois aparece uma redução de US$ 1,052 para US$ 1,044, queda de 0,8%. Isso reforça que uma comparação de preço precisa verificar o identificador exato e a tarifa vigente, em vez de tratar “DeepSeek V4” como uma única linha de produto.

Qwen3.5 encarece, mas a família não segue uma só direção

O Qwen3.5 397B A17B subiu de US$ 2,34 para US$ 3,60 por milhão de tokens, avanço de 53,8%. É uma alta suficiente para alterar o custo de fluxos que usam o modelo como padrão para tarefas complexas.

Ao mesmo tempo, o Qwen3.6 27B caiu de US$ 3,60 para US$ 3,20, redução de 11,1%. O Qwen3 30B A3B também recuou, de US$ 0,52 para US$ 0,50, queda de 3,8%. Portanto, a decisão não é simplesmente trocar “Qwen” por outro modelo da mesma família: cada identificador tem sua própria tarifa.

Quem precisa refazer o orçamento

O impacto maior recai sobre produtos com alto volume de saída, uso frequente de raciocínio ou agentes que fazem várias chamadas por tarefa. Também vale para equipes que fixaram o orçamento com base nos preços antigos do Kimi K2.6, do DeepSeek V4 Pro 0423 ou do Qwen3.5 397B A17B.

Se você usa esses modelos apenas em testes de baixo volume, a mudança pode ter efeito financeiro pequeno. Para sistemas em produção, porém, a revisão deve incluir roteamento, limites de saída, cache e modelos alternativos. O Artificial Analysis lista o DeepSeek V4 Flash 0731 em uma posição de custo-benefício com preço de US$ 0,66 por milhão de tokens na configuração de raciocínio e esforço máximo, mas essa é uma configuração específica e não substitui automaticamente a tarifa básica observada no OpenRouter.

O catálogo do OpenRouter reúne 557 modelos de 70 criadores. Essa amplitude ajuda a criar fallback, mas também aumenta o risco de uma troca aparentemente simples alterar qualidade, latência ou comportamento do produto. O mesmo Artificial Analysis coloca o GPT-5.6 Luna (max) a US$ 0,45 por milhão de tokens em sua lista de custo-benefício, enquanto o Grok 4.6 (high) aparece a US$ 3 entre os modelos no topo de inteligência; preço menor, sozinho, não prova equivalência.

Antes de aceitar o novo custo, compare o desempenho do modelo atual com alternativas no seu próprio fluxo. Depois, atualize o roteador e os alertas de faturamento: no OpenRouter, o preço que importa para sua margem é o do identificador exato usado em produção.

Em uma frase

Se o modelo sustenta uma parte relevante do seu tráfego, congele o orçamento antigo e revalide tarifa, fallback e margem antes da próxima fatura.

Perguntas frequentes

Quanto subiu o preço do Kimi K2.6 no OpenRouter?

O preço passou de US$ 2,28 para US$ 4 por milhão de tokens de saída. A variação registrada é de 75,4%.

O DeepSeek V4 Flash 0731 ficou mais caro ou mais barato?

Os registros do OpenRouter mostram os dois movimentos no dia: uma alta de US$ 0,18 para US$ 0,28 e uma queda posterior de US$ 0,28 para US$ 0,132. Por isso, é necessário confirmar a tarifa vigente do identificador antes de projetar custos.

Quais modelos da Qwen ficaram mais caros?

O Qwen3.5 397B A17B subiu de US$ 2,34 para US$ 3,60 por milhão de tokens, alta de 53,8%. Já o Qwen3.6 27B e o Qwen3 30B A3B tiveram reduções registradas.

Leia também