DeepSeek V4 Pro sobe 95,3% e puxa choque nos preços
O preço listado do modelo quase dobrou, enquanto o Llama 3.1 70B avançou 80%. No mesmo dia, Qwen3 e versões do DeepSeek V4 Flash ficaram mais baratas.
Se você usa o DeepSeek V4 Pro em produção, a mudança que importa nesta sexta-feira é direta: o preço listado no OpenRouter saltou de US$ 1,639 para US$ 3,20 por milhão de tokens. A alta é de 95,3%. O modelo quase dobrou de preço em um único dia.
A conta não subiu apenas para um modelo. O Llama 3.1 70B Instruct passou de US$ 0,40 para US$ 0,72 por milhão de tokens, avanço de 80%. O Tencent Hy3 também apareceu em uma alta de 60%, de US$ 0,33 para US$ 0,528.
O retrato do dia é menos uma tabela estável e mais um mercado com alterações simultâneas. O OpenRouter registrou 20 mudanças de preço, além de dois lançamentos, entre 596 modelos de 71 criadores.
O que muda na sua fatura
O número do DeepSeek V4 Pro é o ponto central porque afeta diretamente quem usa o modelo em rotas de produção, agentes ou tarefas de maior complexidade. A diferença entre US$ 1,639 e US$ 3,20 por milhão de tokens representa quase o dobro do custo listado para o mesmo volume de uso.
Isso não significa que toda chamada ao modelo ficará automaticamente 95,3% mais cara em qualquer configuração. O registro disponível informa a variação do preço listado no OpenRouter, mas não separa, neste item, se o valor corresponde à entrada ou à saída. Para planejar a fatura, é preciso conferir qual campo da rota escolhida está sendo aplicado e medir a divisão entre tokens de entrada e de saída.
Para uma aplicação que gera muito texto, a alta do Llama 3.1 70B merece a mesma atenção. O modelo sai de US$ 0,40 para US$ 0,72 por milhão de tokens. Já quem usa o Qwen3 235B A22B Instruct 2507 encontra o movimento oposto: o preço caiu de US$ 0,88 para US$ 0,35, uma redução de 60,2%.
Há quedas no mesmo pacote
A DeepSeek não aparece apenas do lado das altas. O DeepSeek V4 Flash 0731 caiu de US$ 0,18 para US$ 0,08 por milhão de tokens, redução de 55,6%. A variante DeepSeek V4 Flash Latest também foi registrada com queda de 50%, de US$ 0,16 para US$ 0,08.
Outra versão, o DeepSeek V4 Flash 0423, recuou de US$ 0,17 para US$ 0,134, queda de 21,5%. O Qwen3.8 27B caiu 15%, de US$ 3 para US$ 2,55.
Os registros também mostram movimentos conflitantes para alguns identificadores. O Tencent Hy3 aparece tanto em uma alta de US$ 0,33 para US$ 0,528 quanto em uma queda de US$ 0,528 para US$ 0,33. O MiniMax M2.5 aparece subindo de US$ 1,08 para US$ 1,20 e, em outro registro, caindo de US$ 1,20 para US$ 1,08. Isso impede tratar todas as linhas como uma única trajetória líquida sem conferir a rota e o horário exibidos no OpenRouter.
Lançamentos baratos, mas não equivalentes
Os dois lançamentos do dia são o Schematron V2 Turbo e o Schematron V2 Small, ambos da inference-net. O Turbo custa US$ 0,03 por milhão de tokens de entrada e US$ 0,15 de saída, com janela de contexto de 128 mil tokens. O Small custa US$ 0,05 na entrada e US$ 0,23 na saída, também com contexto de 128 mil tokens.
Esses preços chamam atenção para tarefas estruturadas e sensíveis a custo. Mas não há, nos dados disponíveis, notas de inteligência, código ou uso agêntico para os dois modelos. Também não há estreias de benchmark no dia. Portanto, preço baixo não basta para justificar uma migração de uma aplicação crítica.
Quem deve agir agora
A alta do DeepSeek V4 Pro vale para quem tem tráfego ativo nessa rota, sobretudo se o modelo está fixado em produção e não existe limite de gasto por modelo. O Llama 3.1 70B exige revisão semelhante. Para esses usuários, vale comparar o custo por tarefa, não apenas o preço nominal, e acompanhar a parcela de tokens de saída.
Para quem usa Qwen3 235B, DeepSeek V4 Flash ou Qwen3.8 27B, o dia trouxe redução no preço listado. Ainda assim, a presença de alterações opostas no mesmo catálogo mostra que não é seguro atualizar planilhas uma vez e esquecer o assunto.
As notas do Artificial Analysis também ajudam a separar preço de capacidade. No topo de inteligência, o Claude Fable 5.1 aparece com índice 53,4 na configuração max with fallback e preço de US$ 20 por milhão de tokens; o GPT-6 Astra max aparece com índice 52,8 e o mesmo preço. Esses números não indicam que o DeepSeek V4 Pro tenha liderado inteligência, código ou desempenho agêntico: não há nota correspondente para ele nos dados deste dia.
Para o leitor que paga a fatura, a decisão prática é clara: congele o preço atual de cada rota, configure alertas e reavalie o fallback antes que uma mudança de 95,3% chegue ao fechamento do mês.
Se você usa DeepSeek V4 Pro ou Llama 3.1 70B em produção, revise hoje o orçamento e a rota de fallback; se usa Qwen3 ou DeepSeek V4 Flash, confirme a queda antes de alterar contratos ou limites.
Perguntas frequentes
Quanto subiu o preço do DeepSeek V4 Pro?
O preço listado no OpenRouter passou de US$ 1,639 para US$ 3,20 por milhão de tokens, alta de 95,3%. O registro não informa, nesse item, se o valor corresponde à entrada ou à saída.
O Llama 3.1 70B também ficou mais caro?
Sim. O preço listado passou de US$ 0,40 para US$ 0,72 por milhão de tokens, avanço de 80%. A mudança afeta quem usa essa rota em produção ou como fallback.
Quais modelos ficaram mais baratos?
O Qwen3 235B A22B Instruct 2507 caiu 60,2%, de US$ 0,88 para US$ 0,35 por milhão de tokens. O DeepSeek V4 Flash 0731 caiu 55,6%, de US$ 0,18 para US$ 0,08.