Llama 3.1 e DeepSeek V4 Pro oscilam até 81,1% no OpenRouter
Os dois modelos populares aparecem com altas e quedas no mesmo período, enquanto o catálogo registra 20 mudanças de preço. Para quem roda API em produção, o valor escolhido hoje pode não ser o valor da próxima fatura.
Se você usa o Meta Llama 3.1 70B Instruct ou o DeepSeek V4 Pro 0813 em produção, o preço exibido no OpenRouter não está se comportando como uma tarifa estática. O Llama aparece com uma alta de 80%, de US$ 0,40 para US$ 0,72 por milhão de tokens. O DeepSeek V4 Pro 0813 registra alta de 81,1%, de US$ 1,738 para US$ 3,148 por milhão.
O ponto que muda a decisão é a reversão. O mesmo conjunto de registros também mostra o Llama caindo 44,4%, de US$ 0,72 para US$ 0,40, e o DeepSeek recuando 44,8%, de US$ 3,148 para US$ 1,738. A oscilação não é apenas uma diferença entre modelos ou fornecedores. Ela aparece no histórico de preços do mesmo produto.
A alta não conta a história inteira
Os preços listados no OpenRouter mostram movimentos em sentidos opostos para os modelos mais relevantes desta pauta. No caso do DeepSeek V4 Pro 0813, há registros de alta e de queda em 10 e 11 de setembro. Para o Llama 3.1 70B Instruct, os dois movimentos aparecem em 11 de setembro.
Isso cria um problema operacional simples: uma aplicação que calcula custo com base no preço visto durante um teste pode chegar à produção com uma referência diferente. O impacto depende do volume de tokens, da proporção entre entrada e saída e do modelo escolhido, mas o catálogo já indica que a tabela pode mudar dentro da janela de dois dias analisada.
A oscilação também não ficou restrita a esses dois nomes. O Google Gemma 4 26B A4B caiu 35,3%, de US$ 0,34 para US$ 0,22 por milhão. O DeepSeek V3 subiu 15,6%, de US$ 0,89 para US$ 1,029. O MiniMax M2.5 avançou 11,1%, de US$ 1,08 para US$ 1,20.
O catálogo está se mexendo em várias faixas
O OpenRouter registrou 20 mudanças de preço no período, além de 9 lançamentos. O catálogo reúne 594 modelos de 70 criadores. Para quem escolhe uma API, isso significa que comparar apenas o preço de entrada não basta: é preciso acompanhar o identificador exato, a data e o preço vigente.
Há ainda movimentos menores dentro da própria família DeepSeek. O DeepSeek V4 Pro 0423 aparece com alta de 9,8%, de US$ 1,74 para US$ 1,911, e também com quedas de 9,3% e 8,9% em registros distintos. O DeepSeek V4 Flash 0423 oscila entre altas de 5,5% e 1,8% e quedas de 3,3%, 1,7% e 0,7%.
Esses registros não permitem tratar todos os valores como uma única tarifa consolidada. Eles mostram alterações de preço listadas para variantes e momentos diferentes. Para o responsável pela fatura, essa distinção é importante: “DeepSeek V4 Pro” não identifica necessariamente o mesmo item que “DeepSeek V4 Pro 0813” ou “DeepSeek V4 Pro 0423”.
Quem ganha uma alternativa mais barata
A instabilidade pesa mais para quem mantém tráfego contínuo, contratos com margem apertada ou roteamento automático entre modelos. Se o sistema troca de fornecedor conforme disponibilidade, uma mudança de preço pode alterar o custo sem que o código da aplicação mude.
Para cargas novas, há opções com preços menores no catálogo. O DeepSeek V4.1 Flash aparece com US$ 0,15 por milhão de tokens de entrada e US$ 0,60 de saída. O Ling 3.0 Flash VL está listado a US$ 0,06 de entrada e US$ 0,18 de saída, enquanto a variante gratuita aparece com US$ 0 para os dois campos.
Essas alternativas não tornam o Llama ou o DeepSeek V4 Pro equivalentes a modelos mais baratos. O índice do Artificial Analysis registra o DeepSeek V4.1 Flash com nota de inteligência de 39,5 e o Ling 3.0 Flash VL com 24,8. São referências para comparação, não uma garantia de desempenho igual na tarefa da sua aplicação.
O que muda na escolha do modelo
A notícia vale diretamente para quem usa esses modelos em produção ou faz orçamento com preços do OpenRouter. Também interessa a quem monitora margem por cliente, define limites de gasto ou usa um gateway com seleção automática de modelos.
Para quem roda inferência local, mantém pesos próprios ou não utiliza o OpenRouter, essas alterações não mudam a fatura diretamente. Também não há, nos dados disponíveis, informação de que a capacidade, a janela de contexto ou o desempenho do Llama 3.1 70B tenham mudado junto com o preço.
A prática mais segura é registrar o identificador do modelo, o preço de entrada e o de saída, além da data da consulta. Se o custo for crítico, o limite de gasto precisa considerar mais de um cenário de preço. A oscilação de 80% no Llama e de 81,1% no DeepSeek mostra por quê: escolher o modelo é apenas metade da decisão; a outra metade é saber qual preço está valendo quando a requisição chega.
Se você usa Llama 3.1 70B ou DeepSeek V4 Pro em produção, fixe o identificador e monitore o preço antes de transformar a tarifa atual em previsão de fatura.
Perguntas frequentes
O preço do Llama 3.1 70B mudou no OpenRouter?
Sim. O Meta Llama 3.1 70B Instruct aparece com alta de 80%, de US$ 0,40 para US$ 0,72 por milhão de tokens, e também com uma queda de 44,4%, de US$ 0,72 para US$ 0,40, em registros de 11 de setembro.
Quanto subiu o DeepSeek V4 Pro 0813?
O registro de alta mostra avanço de 81,1%, de US$ 1,738 para US$ 3,148 por milhão de tokens. Também há registro de queda de 44,8%, de US$ 3,148 para US$ 1,738.
Quem precisa se preocupar com essas mudanças de preço?
Empresas que usam esses modelos em produção, fazem roteamento por API ou calculam margem por volume de tokens são as mais expostas. Quem roda modelos localmente ou não utiliza o OpenRouter não tem impacto direto na fatura por causa dessas alterações.