Qwen3 14B sobe 279%, enquanto DeepSeek V4 Pro corta no batch
O OpenRouter registrou 20 mudanças de preço em dois dias. A conta, porém, separa o salto do Qwen3 dos cortes — e revela que o desconto do DeepSeek V3.1 não aparece como tarifa batch.
Se você usa o Qwen3 14B em produção, o custo de saída subiu de US$ 0,24 para US$ 0,91 por milhão de tokens no OpenRouter. É um aumento de 279,2% em um único reajuste. O movimento acontece no mesmo intervalo em que o DeepSeek V4 Pro batch cai pela metade, de US$ 3,96 para US$ 1,98 por milhão de tokens.
A diferença muda a decisão de roteamento. Mas há uma ressalva importante: o corte atribuído ao DeepSeek V3.1 não está identificado como batch na listagem. O preço do modelo cai de US$ 1,65 para US$ 0,95 por milhão, uma redução de 42,4%.
O salto que pesa na fatura
Os preços listados no OpenRouter mostram uma rodada concentrada de alterações entre 8 e 9 de setembro. O Qwen3 14B lidera os aumentos, seguido pelo Granite 4.2 8B, da IBM, que passa de US$ 0,15 para US$ 0,25 por milhão, alta de 66,7%.
O Qwen3 235B A22B Instruct 2507 também encarece: de US$ 0,55 para US$ 0,88 por milhão, avanço de 60%. Já o Qwen3.5 397B A17B sobe de US$ 2,34 para US$ 3,50, alta de 49,6%.
Para quem mantém uma aplicação com tráfego constante, a mudança do Qwen3 14B é a mais direta. O mesmo volume de tokens que custava US$ 240 passa a custar US$ 910 em uma operação de um bilhão de tokens de saída. Esse cálculo usa apenas a tarifa por milhão e não inclui outros componentes de uma aplicação.
DeepSeek tem corte, alta e versões diferentes
O DeepSeek V4 Pro exige mais cuidado porque aparece em registros diferentes. Na versão identificada como 0813, o preço regular passa de US$ 1,98 para US$ 3,148 por milhão, alta de 59%. Em outro registro do mesmo modelo, a tarifa cai de US$ 3,148 para US$ 1,738, redução de 44,8%.
A versão batch é mais clara: sai de US$ 3,96 para US$ 1,98 por milhão, corte de 50%. O preço final do batch fica, portanto, abaixo do valor regular de US$ 3,148 registrado antes, mas os registros não permitem tratar todas as mudanças como uma única tabela linear.
O DeepSeek V3.1 também fica mais barato, de US$ 1,65 para US$ 0,95 por milhão. Só que o identificador informado não tem o sufixo “:batch”. A promessa de cortes de até 50% no batch vale para o V4 Pro batch; para o V3.1, o que aparece é uma redução regular de 42,4%.
Batch é a variável que muda o cálculo
Se o seu sistema processa tarefas que não precisam de resposta imediata, o batch passa a ser a alternativa mais atraente no V4 Pro. O corte reduz a tarifa listada de US$ 3,96 para US$ 1,98 por milhão de tokens. Isso pode alterar o modelo escolhido para classificação, geração em lote e outras filas assíncronas.
A vantagem não se aplica automaticamente a uma API interativa. Se o produto precisa responder ao usuário na hora, a referência correta é a variante regular disponível para o fluxo escolhido. Misturar o preço batch com o preço de inferência imediata pode produzir uma projeção de fatura errada.
O mesmo período trouxe outros movimentos na direção oposta. O DeepSeek V4 Flash 0731 cai de US$ 0,28 para US$ 0,18 por milhão na versão regular, mas a variante batch sobe de US$ 0,28 para US$ 0,33. O DeepSeek V3 0324 aumenta de US$ 1 para US$ 1,14.
Quem precisa revisar o roteador
A revisão é obrigatória para quem usa Qwen3 14B ou algum dos modelos DeepSeek afetados com tarifa fixada manualmente. O preço do Qwen3 14B deixa de ser uma referência barata para cargas de produção sem que o nome do modelo mude.
Para quem usa Gemini, Mercury ou os modelos gratuitos da Nex AGI, esses reajustes específicos não alteram a tarifa do endpoint escolhido. O Mercury 2.5 aparece com US$ 0,04 por milhão de entrada, US$ 0,15 de saída e janela de contexto de 260.000 tokens. Os modelos Nex-N2.5-Mini e Nex-N2.5-Pro aparecem com entrada e saída gratuitas e contexto de 262.144 tokens.
O catálogo também registra três lançamentos no período de dois dias e uma estreia no índice da Artificial Analysis: o MiniCPM5-2B, com nota de inteligência de 14,3 e sem preço informado. Esses dados ajudam a mapear oferta, mas não compensam automaticamente um reajuste em um modelo que já está integrado ao seu produto.
Na prática, o próximo passo é separar no orçamento três rotas: Qwen3 14B regular, DeepSeek V4 Pro regular e DeepSeek V4 Pro batch. Só depois de classificar cada chamada por urgência você saberá se o corte reduz a fatura ou se o aumento do modelo usado em tempo real continuará dominando o custo.
Recalcule o roteamento por variante: o Qwen3 14B ficou 279,2% mais caro, enquanto o DeepSeek V4 Pro batch caiu 50%, mas o V3.1 não aparece com tarifa batch.
Perguntas frequentes
Quanto subiu o preço do Qwen3 14B no OpenRouter?
O preço passou de US$ 0,24 para US$ 0,91 por milhão de tokens. A variação registrada é de 279,2%.
O DeepSeek V4 Pro ficou 50% mais barato?
A versão batch caiu de US$ 3,96 para US$ 1,98 por milhão de tokens, redução de 50%. A versão regular aparece em registros diferentes, com alta de 59% em um deles e queda de 44,8% em outro.
O DeepSeek V3.1 tem preço batch reduzido?
A listagem mostra o DeepSeek V3.1 caindo de US$ 1,65 para US$ 0,95 por milhão, redução de 42,4%. O registro não identifica essa tarifa como batch.