FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Kimi K2.5 cai 25%, mas DeepSeek V4 Pro encarece

O OpenRouter registra cortes para Kimi K2.5 e Llama 4 Maverick, enquanto o Apodex 1.1 estreia no índice com IQ 44. O movimento do DeepSeek mostra que o preço do dia pode esconder uma sequência instável.

Redação FalaVIP IA 4 min de leitura
US$ 2,25por milhão de tokens do Kimi K2.5 após queda de 25%
US$ 0,696por milhão de tokens do Llama 4 Maverick após queda de 13%
IQ 44pontuação do Apodex 1.1 no Artificial Analysis

Se você usa o MoonshotAI Kimi K2.5 em produção, o preço listado no OpenRouter caiu de US$ 3 para US$ 2,25 por milhão de tokens nesta segunda-feira (31). É uma redução de 25% que pode mexer na fatura de aplicações com tráfego alto. O Meta Llama 4 Maverick também ficou mais barato: de US$ 0,80 para US$ 0,696 por milhão, queda de 13%.

A leitura não é de uma queda uniforme no mercado. No mesmo dia, o DeepSeek V4 Pro 0423 aparece em uma sequência de ajustes que começa em US$ 0,835, sobe para US$ 3,20 e depois recua para US$ 2,069 por milhão de tokens. O DeepSeek V4 Flash 0423 também tem registros de alta e baixa. Para quem escolhe modelo pelo preço exibido hoje, a estabilidade da tabela passa a ser tão importante quanto o valor final.

Os cortes que afetam volume

O Kimi K2.5 é o corte mais expressivo entre os modelos destacados no panorama. A redução de US$ 3 para US$ 2,25 baixa o custo unitário em um quarto, segundo os preços do OpenRouter. Se você roda classificação, atendimento automatizado, geração de conteúdo ou outras tarefas repetitivas, o efeito potencial aparece diretamente no custo por milhão de tokens.

O Llama 4 Maverick parte de uma base muito menor. Mesmo com a queda de 13%, o preço listado passa de US$ 0,80 para US$ 0,696 por milhão. Para uma operação já construída em torno do modelo, isso reduz o custo sem exigir troca de fornecedor ou migração de prompts. Para quem está comparando modelos do zero, porém, preço não informa sozinho qualidade, latência ou adequação à tarefa.

O dado vale principalmente para workloads de alto volume e para equipes que já usam esses modelos. Se a sua aplicação tem pouco tráfego, a economia absoluta tende a ser menor. Se o gargalo está em qualidade, velocidade, limites de contexto ou ferramentas, a redução não resolve esse problema.

O preço do DeepSeek ficou mais difícil de ler

O caso do DeepSeek V4 Pro 0423 exige cautela. O OpenRouter registra primeiro uma alta de US$ 0,835 para US$ 3,20, descrita como variação de 283,5%. Depois, o valor recua de US$ 3,20 para US$ 2,069, uma queda de 35,4%.

O número relevante para uma nova contratação é o preço final listado no registro: US$ 2,069 por milhão. Mas a sequência mostra que uma fotografia do dia pode não representar o comportamento do preço ao longo do período. Se você está projetando orçamento ou definindo alertas de custo, vale acompanhar alterações e não apenas copiar o valor atual para uma planilha.

O Tencent Hy3 repete o padrão, em escala menor: sobe de US$ 0,33 para US$ 0,528 e depois volta a US$ 0,33. Já o DeepSeek V4 Flash 0423 aparece com alta de US$ 0,158 para US$ 0,177 e, em seguida, queda para US$ 0,165. O Google Gemini 3.5 Flash sobe de US$ 9 para US$ 9,90. O Qwen3.8 2.4T A95B em lote recua de US$ 6,25 para US$ 6.

Apodex estreia, não apenas ajusta preço

O Apodex 1.1 estreou no índice do Artificial Analysis com pontuação IQ 44 e preço de US$ 0,975 por milhão de tokens. A formulação de “ajuste” fica incompleta: o registro disponível é de uma estreia no benchmark, não de uma comparação de preço anterior do próprio modelo.

Isso muda a decisão. Há um preço e uma nota inicial, mas não há histórico apresentado que permita dizer se o Apodex 1.1 ficou mais barato ou mais caro. O IQ 44 também não o coloca entre os líderes listados pelo Artificial Analysis. O topo do índice chega a IQ 63,1 no Claude Opus 5 com raciocínio adaptativo e esforço máximo, a US$ 10 por milhão.

Para quem busca custo-benefício, a própria lista do Artificial Analysis traz Qwen3.8-Flash-Next com IQ 55,8 a US$ 0,23 e GLM-5.3-Flash com IQ 57,5 a US$ 0,238. Esses valores não substituem um teste com seus prompts, mas mostram por que o preço de US$ 0,975 do Apodex 1.1 precisa ser avaliado junto da qualidade entregue.

Quem deve agir hoje

O corte do Kimi K2.5 interessa a quem já paga US$ 3 por milhão e tem volume suficiente para sentir a diferença. O Llama 4 Maverick merece revisão de orçamento para equipes que procuram uma opção de menor custo por token. O Apodex 1.1 serve como candidato a teste, não como escolha automática: a estreia no índice ainda não traz histórico de preço ou desempenho operacional.

O catálogo do OpenRouter reúne 565 modelos de 70 criadores. Você não precisa revisar todos, mas deve comparar o preço atualizado, a nota disponível e o custo real do seu fluxo antes de trocar o modelo em produção. A consequência prática é simples: atualize a tabela de custos do Kimi e do Llama, trate os valores do DeepSeek como voláteis e faça um teste controlado do Apodex antes de colocá-lo diante de usuários.

Em uma frase

Atualize agora os custos do Kimi K2.5 e do Llama 4 Maverick, mas só considere o Apodex 1.1 após validar qualidade e preço no seu próprio tráfego.

Perguntas frequentes

Quanto custa o Kimi K2.5 no OpenRouter?

O MoonshotAI Kimi K2.5 está listado a US$ 2,25 por milhão de tokens, após queda de US$ 3. A variação registrada pelo OpenRouter é de menos 25%.

O Apodex 1.1 ficou mais barato?

Não há comparação anterior de preço no registro disponível. O Apodex 1.1 estreou no Artificial Analysis com IQ 44 e preço de US$ 0,975 por milhão de tokens.

Qual modelo teve a maior queda de preço no dia?

Entre os cortes destacados, o Kimi K2.5 teve a maior redução percentual, de 25%, segundo o OpenRouter. O DeepSeek V4 Pro também recuou 35,4% em um segundo ajuste, mas antes havia subido de US$ 0,835 para US$ 3,20.

Leia também