Qwen3 14B cai 73,6%, enquanto DeepSeek V4 encarece até 95,3%
O Qwen3 14B passou a custar US$ 0,24 por milhão de tokens. Nas variantes DeepSeek V4, porém, há altas de até 95,3% em apenas dois dias.
Se você usa o Qwen3 14B em produção, a conta caiu quase três quartos: o preço passou de US$ 0,91 para US$ 0,24 por milhão de tokens no OpenRouter. A redução é de 73,6% e muda a posição do modelo para cargas de trabalho sensíveis a custo.
A outra metade da notícia é menos confortável. O DeepSeek V4 está ficando mais caro em algumas variantes. O V4 Pro 0423 subiu de US$ 1,639 para US$ 3,20 por milhão de tokens, alta de 95,3%. O V4 Flash 0423 avançou de US$ 0,095 para US$ 0,177, aumento de 86,1%.
A promessa de uma queda geral de preços em modelos abertos, portanto, não aparece na fatura. O movimento é desigual: Qwen reduz, DeepSeek eleva e outros modelos alternam altas e baixas.
Qwen3 14B vira uma opção mais agressiva
O novo preço do Qwen3 14B é o dado mais relevante para quem roda classificação, extração, atendimento automatizado ou geração em grande volume. A tarifa caiu de US$ 0,91 para US$ 0,24 por milhão de tokens no OpenRouter.
Na prática, uma aplicação que já dependia desse modelo passa a ter mais espaço para aumentar volume sem elevar o orçamento na mesma proporção. Também fica mais barato testar o Qwen3 14B como alternativa a modelos que custam mais por token.
Isso vale para quem já usa o Qwen3 14B ou consegue migrar para ele sem alterar requisitos de qualidade, latência e comportamento. Não muda nada para quem está preso a um modelo específico por compatibilidade, avaliação interna ou exigência de saída. A queda de preço, sozinha, não prova equivalência de desempenho.
O Qwen3 30B A3B Instruct 2507 também caiu, de US$ 0,30 para US$ 0,193 por milhão de tokens, redução de 35,7%. É um movimento na mesma direção, mas não substitui uma comparação própria para cada tarefa.
DeepSeek V4 encarece em várias frentes
A linha DeepSeek V4 exige mais atenção porque as mudanças não são iguais entre versões. O V4 Pro 0423 foi de US$ 1,639 para US$ 3,20 por milhão de tokens em 12 de setembro. Dois dias depois, o V4 Pro 0813 passou de US$ 1,738 para US$ 2,95, alta de 69,7%.
No segmento Flash, o V4 Flash 0423 chegou a US$ 0,177, ante US$ 0,095 anteriormente. A alta foi de 86,1%. Já o V4 Flash 0731 avançou de US$ 0,08 para US$ 0,12, aumento de 50%.
Há um detalhe importante: a trajetória recente não é uma linha reta para todas as versões. O V4 Flash 0423 também aparece em registros anteriores com pequenas quedas, de US$ 0,134 para US$ 0,131 e depois de US$ 0,10 para US$ 0,095. O V4 Pro 0813 teve oscilações próximas da estabilidade antes da alta de 69,7%.
Por isso, não basta tratar “DeepSeek V4” como um único produto. A versão exata no identificador da API agora influencia diretamente a fatura.
O que mudou — e o que não mudou
Os preços listados no OpenRouter mostram mudanças de tarifa, não lançamentos de modelos. Não há estreia de benchmark registrada no período, e os índices de inteligência, código e desempenho agêntico do Artificial Analysis não aparecem alterados nos dados disponíveis.
Isso significa que a decisão de trocar de modelo não deve ser tomada apenas pelo percentual anunciado. A redução do Qwen3 14B é concreta para o orçamento, mas ainda exige validação da qualidade na tarefa real. Do lado do DeepSeek, a alta pode tornar uma configuração existente significativamente mais cara mesmo sem qualquer mudança funcional percebida pela aplicação.
O período também teve outras quedas: o Llama 3.1 70B Instruct passou de US$ 0,72 para US$ 0,40 por milhão de tokens, enquanto o Nemotron 3 Ultra caiu de US$ 3,125 para US$ 2,40. Houve altas menores, como a do Gemma 4 26B A4B, de US$ 0,22 para US$ 0,30.
Para quem a mudança importa
A queda do Qwen3 14B interessa sobretudo a equipes que pagam por volume e podem aceitar um modelo de porte menor para tarefas bem delimitadas. O efeito é direto em pipelines com muitas requisições, processamento em lote e automações cujo custo por chamada domina a margem.
As altas do DeepSeek V4 atingem quem fixou o identificador Pro ou Flash na produção. Se a aplicação usa roteamento automático ou outro provedor, a mudança do OpenRouter pode não aparecer na mesma proporção. Também não muda nada para quem não usa essas variantes ou já mantém um contrato de preço diferente.
A decisão prática é revisar o identificador exato no código, recalcular a fatura com o novo preço e rodar testes antes de trocar o Qwen3 14B ou abandonar o DeepSeek V4. O corte de 73,6% abre espaço para experimentar; a alta de até 95,3% exige verificar agora se o modelo escolhido ainda cabe no orçamento.
Se você paga por volume, teste o Qwen3 14B como alternativa de baixo custo e revise imediatamente qualquer integração com DeepSeek V4.
Perguntas frequentes
Quanto custa o Qwen3 14B na API?
O Qwen3 14B passou a custar US$ 0,24 por milhão de tokens no OpenRouter, ante US$ 0,91. A redução registrada foi de 73,6%.
Quanto subiu o DeepSeek V4 Pro?
O DeepSeek V4 Pro 0423 subiu de US$ 1,639 para US$ 3,20 por milhão de tokens, alta de 95,3%. A variante V4 Pro 0813 aumentou 69,7% e passou a US$ 2,95.
O DeepSeek V4 Flash ficou mais caro?
Sim, em algumas versões. O V4 Flash 0423 subiu 86,1%, para US$ 0,177 por milhão de tokens, enquanto o V4 Flash 0731 aumentou 50%, para US$ 0,12.