Llama 3.1 70B cai 44,4%, enquanto rivais elevam preços
O modelo da Meta passou a custar US$ 0,40 por milhão no OpenRouter. No mesmo intervalo, Tencent e Google tiveram altas, mas a lista também revela cortes fortes em DeepSeek e Qwen.
Se você usa o Llama 3.1 70B Instruct em produção, a conta caiu 44,4%: o preço listado no OpenRouter passou de US$ 0,72 para US$ 0,40 por milhão de tokens em 13 de setembro. Esse é o movimento que muda uma decisão de infraestrutura agora — e não uma nova capacidade anunciada para o modelo.
A queda acontece enquanto parte dos concorrentes fica mais cara. O Tencent Hy3 subiu de US$ 0,33 para US$ 0,528 por milhão, alta de 60% em uma das alterações registradas. O Gemma 4 26B A4B, do Google, avançou de US$ 0,22 para US$ 0,30, aumento de 36,4%.
O quadro, porém, não é uma alta generalizada. A mesma janela de dois dias reúne cortes agressivos, aumentos expressivos e até movimentos opostos para o mesmo modelo. Para quem paga a fatura da API, comparar o preço atual é mais importante do que presumir uma tendência única do mercado.
O corte do Llama é o número que pesa na fatura
A redução leva o Llama 3.1 70B Instruct a um preço inferior ao anterior em US$ 0,32 por milhão de tokens. Em uma aplicação com alto volume, a diferença se multiplica diretamente pelo tráfego faturado. O novo valor também deixa o modelo da Meta em uma faixa mais competitiva para tarefas que não exigem modelos de ponta mais caros.
Isso não significa, por si só, que o Llama ficou mais inteligente ou mais adequado para qualquer fluxo. Não há lançamento nem estreia em benchmark registrados nesta atualização. Também não há, nos dados disponíveis, uma mudança de qualidade, velocidade ou janela de contexto associada ao corte.
Para uma equipe que já validou o comportamento do Llama 3.1 70B, a alteração favorece manter ou ampliar o uso. Para quem está escolhendo um modelo novo, o preço reduzido é um motivo para testar, não uma prova de superioridade técnica.
Tencent e Google mostram o outro lado
O Hy3 apresenta a maior alta entre os modelos destacados, de 60%, mas a própria sequência de preços mostra por que é arriscado olhar apenas para uma variação isolada: também há um registro em que o modelo caiu de US$ 0,528 para US$ 0,33, redução de 37,5%. A leitura mais segura é de volatilidade, não de uma direção permanente.
O Gemma 4 26B A4B teve um movimento mais simples no período: passou de US$ 0,22 para US$ 0,30, alta de 36,4%. O Muse Glimmer 30B, da Meta, subiu na mesma proporção, de US$ 1,10 para US$ 1,50 por milhão.
A diferença prática é grande. O Llama 3.1 70B terminou a alteração em US$ 0,40, enquanto o Gemma 4 26B A4B ficou em US$ 0,30. O preço não resolve a escolha sozinho: custo de migração, qualidade das respostas e compatibilidade com o sistema continuam fora dessa comparação.
DeepSeek e Qwen impedem uma leitura simples
As maiores altas da lista estão no DeepSeek. O V4 Pro 0423 passou de US$ 1,639 para US$ 3,20 por milhão, aumento de 95,3%. O V4 Flash 0423 avançou de US$ 0,095 para US$ 0,177, alta de 86,1%. O V4 Pro 0813 subiu 69,7%, de US$ 1,738 para US$ 2,95.
Na direção oposta, o Qwen3 14B caiu 73,6%, de US$ 0,91 para US$ 0,24. O Qwen3 30B A3B Instruct 2507 recuou 35,7%, de US$ 0,30 para US$ 0,193. O Nemotron 3 Ultra também ficou mais barato, com redução de 23,2%, de US$ 3,125 para US$ 2,40.
Os preços listados no OpenRouter, portanto, apontam para uma disputa que pode alterar rapidamente a economia de uma aplicação. Um modelo barato hoje pode deixar de ser a opção mais econômica após uma atualização de tabela; um modelo que parecia caro pode ganhar espaço depois de um corte.
Para quem isso muda algo
A queda do Llama vale principalmente para quem já usa o modelo, está perto do limite de orçamento ou pode trocar um provedor sem refazer toda a avaliação. Também interessa a equipes que mantêm roteadores de modelos e conseguem redirecionar tráfego conforme o preço.
A mudança não altera nada para quem depende de recursos ausentes no Llama 3.1 70B, precisa de uma janela ou desempenho específicos, ou contratou preço fixo fora do OpenRouter. Também não há base para concluir que o Llama supera Tencent, Google, DeepSeek ou Qwen em inteligência: as notas do Artificial Analysis não trazem uma alteração para esses modelos nesta atualização.
A decisão mais prudente é atualizar a tabela interna de custos, recalcular os cenários de tráfego e repetir os testes com o preço atual antes de mexer na produção. O desconto do Llama é real; tratá-lo como sinal de que todos os modelos ficarão mais baratos seria o erro caro.
Se você já validou o Llama 3.1 70B, o preço de US$ 0,40 por milhão justifica recalcular a rota de produção agora, mas sem abandonar testes de qualidade.
Perguntas frequentes
Quanto custa o Llama 3.1 70B Instruct no OpenRouter?
O preço listado passou a US$ 0,40 por milhão de tokens. Antes, era de US$ 0,72, uma redução de 44,4%.
O Tencent Hy3 ficou mais caro ou mais barato?
Os registros mostram os dois movimentos. Em uma alteração, o Hy3 subiu 60%, de US$ 0,33 para US$ 0,528; em outra, caiu 37,5%, de US$ 0,528 para US$ 0,33.
O Gemma 4 26B ficou mais caro?
Sim. O preço listado no OpenRouter passou de US$ 0,22 para US$ 0,30 por milhão de tokens, alta de 36,4%.