FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Meta corta 20% no Muse Glimmer; DeepSeek Pro cai 17,6%

Os preços listados no OpenRouter recuaram para modelos usados em cargas intensivas, mas a janela de dois dias também trouxe aumentos de até 100%. A economia depende do modelo escolhido e da divisão entre entrada e saída.

Redação FalaVIP IA 3 min de leitura
20%redução no preço listado do Meta Muse Glimmer 30B
17,6%redução em uma das alterações do DeepSeek V4 Pro
US$ 1,20preço listado por milhão no Meta Muse Glimmer 30B após a queda

Se você usa modelos pesados em produção, a queda mais relevante dos últimos dois dias foi de 20%: o Meta Muse Glimmer 30B passou de US$ 1,50 para US$ 1,20 por milhão de tokens, segundo os preços listados no OpenRouter. O DeepSeek V4 Pro também ficou mais barato, mas a redução registrada para ele foi de 17,6%, de US$ 1,382 para US$ 1,139.

A diferença importa. O anúncio implícito de “até 20%” vale para o Muse Glimmer, não para todos os modelos Pro. E a fatura não cai automaticamente na mesma proporção: o valor final depende do volume processado, do tipo de token cobrado e do modelo que a aplicação realmente chama.

O que ficou mais barato

O Meta Muse Glimmer 30B teve uma redução de 20% em 29 de agosto. No mesmo dia, o DeepSeek V4 Pro 0423 apareceu com uma queda de 17,6%, de US$ 1,382 para US$ 1,139 por milhão. O histórico também registra outras reduções do DeepSeek V4 Pro: de US$ 1,524 para US$ 1,382, de US$ 1,139 para US$ 0,976 e, em 30 de agosto, de US$ 0,976 para US$ 0,835.

Esses registros mostram que o preço do DeepSeek mudou várias vezes no intervalo analisado. Não é seguro tratar todas as linhas como uma única redução acumulada sem saber se representam o mesmo fornecedor, rota ou atualização de tarifa. Para quem controla custo, o número operacional é o preço atualmente exibido para o identificador usado na aplicação.

Também recuaram o NVIDIA Nemotron 3.5 Lightning, de US$ 0,25 para US$ 0,20 por milhão, e o Mistral Devstral 2 2512, de US$ 2,20 para US$ 2. O Arcee AI Trinity Large Thinking passou de US$ 0,85 para US$ 0,80. O DeepSeek V4 Flash 0423 teve pequenas quedas, chegando a US$ 0,158 em um dos registros.

A conta não caiu em toda parte

O mesmo período trouxe aumentos fortes. O Google Gemini 3.7 Flash dobrou de US$ 1,875 para US$ 3,75 por milhão. O DeepSeek V4 Flash 0731 também subiu 100%, de US$ 0,09 para US$ 0,18. O Tencent Hy3 avançou 60%, de US$ 0,33 para US$ 0,528.

O Qwen3 VL 30B A3B Instruct aumentou 15,4%, de US$ 0,52 para US$ 0,60. O DeepSeek V3.2 aparece com movimentos opostos no mesmo dia: uma alta de 5,3%, de US$ 0,38 para US$ 0,40, e uma queda de 5%, de US$ 0,40 para US$ 0,38. Ao todo, foram 20 mudanças de preço no catálogo acompanhado.

A leitura prática é simples: trocar o modelo pode reduzir a fatura, mas permanecer no mesmo provedor não garante estabilidade. O catálogo reúne 563 modelos de 70 criadores, e as tarifas podem se mover em direções diferentes até dentro da mesma família.

Para quem a queda vale

A redução interessa principalmente a quem já usa o Meta Muse Glimmer 30B ou o DeepSeek V4 Pro em tarefas de alto volume, como geração de código, análise de documentos, agentes e processamento em lote. Se o modelo atende aos requisitos de qualidade, o corte abre espaço para aumentar o volume sem elevar o orçamento na mesma proporção ou para manter o volume e reduzir despesa.

Para quem usa Gemini 3.7 Flash, DeepSeek V4 Flash 0731, Tencent Hy3 ou Qwen3 VL 30B A3B Instruct, a notícia é o oposto: os registros apontam aumento. Para quem está em outro modelo, nada muda diretamente. A mudança só afeta sua fatura se o identificador ou a rota de cobrança usados pela aplicação forem os mesmos.

Também não há base para concluir que os modelos ficaram melhores ou piores. O Artificial Analysis não registrou estreias de benchmark no intervalo de dois dias, e as mudanças fornecidas são de preço. Uma tarifa menor não substitui testes de qualidade, latência, taxa de erro e capacidade de seguir ferramentas.

Como transformar o corte em economia

Primeiro, confira no OpenRouter o preço efetivo do identificador usado em produção. Depois, separe as métricas por modelo e por tipo de uso. Uma aplicação que alterna entre entrada longa, respostas extensas e chamadas de agente pode consumir a mesma tarifa de formas muito diferentes.

Faça um teste controlado com o Muse Glimmer 30B ou o DeepSeek V4 Pro antes de alterar o roteamento. Compare custo, qualidade e número de chamadas necessárias para concluir a tarefa. Se a economia exigir mais tentativas, o corte nominal pode desaparecer na fatura.

A oportunidade, portanto, é de otimização, não de migração automática: use os modelos que caíram para renegociar o custo por tarefa, mas mantenha um limite de gasto e monitore os preços antes de transformar uma tarifa de hoje em dependência de produção.

Em uma frase

Se você já usa Meta Muse Glimmer 30B ou DeepSeek V4 Pro, teste o novo preço no roteamento de produção, mas só conte a economia depois de medir o custo por tarefa.

Perguntas frequentes

Quanto caiu o preço do Meta Muse Glimmer 30B?

O preço listado no OpenRouter caiu 20%, de US$ 1,50 para US$ 1,20 por milhão de tokens. A redução vale diretamente para quem usa esse identificador e essa tarifa.

O DeepSeek V4 Pro ficou 20% mais barato?

Não exatamente. Uma das alterações registradas foi de 17,6%, de US$ 1,382 para US$ 1,139 por milhão; outros cortes do mesmo modelo também aparecem nos registros de 29 e 30 de agosto.

Todos os modelos de API ficaram mais baratos?

Não. O Gemini 3.7 Flash e o DeepSeek V4 Flash 0731 subiram 100%, enquanto o Tencent Hy3 aumentou 60%. O efeito depende do modelo e do identificador usado na aplicação.

Leia também