FalaVIP IA o que os modelos custam,
medido todo dia
Preços

Qwen3 14B cai 73,6%, enquanto DeepSeek V4 encarece até 95,3%

O Qwen3 14B passou a custar US$ 0,24 por milhão de tokens. Nas variantes DeepSeek V4, porém, há altas de até 95,3% em apenas dois dias.

Redação FalaVIP IA 4 min de leitura
73,6%queda no preço do Qwen3 14B
US$ 0,24por milhão de tokens do Qwen3 14B
95,3%alta do DeepSeek V4 Pro 0423

Se você usa o Qwen3 14B em produção, a conta caiu quase três quartos: o preço passou de US$ 0,91 para US$ 0,24 por milhão de tokens no OpenRouter. A redução é de 73,6% e muda a posição do modelo para cargas de trabalho sensíveis a custo.

A outra metade da notícia é menos confortável. O DeepSeek V4 está ficando mais caro em algumas variantes. O V4 Pro 0423 subiu de US$ 1,639 para US$ 3,20 por milhão de tokens, alta de 95,3%. O V4 Flash 0423 avançou de US$ 0,095 para US$ 0,177, aumento de 86,1%.

A promessa de uma queda geral de preços em modelos abertos, portanto, não aparece na fatura. O movimento é desigual: Qwen reduz, DeepSeek eleva e outros modelos alternam altas e baixas.

Qwen3 14B vira uma opção mais agressiva

O novo preço do Qwen3 14B é o dado mais relevante para quem roda classificação, extração, atendimento automatizado ou geração em grande volume. A tarifa caiu de US$ 0,91 para US$ 0,24 por milhão de tokens no OpenRouter.

Na prática, uma aplicação que já dependia desse modelo passa a ter mais espaço para aumentar volume sem elevar o orçamento na mesma proporção. Também fica mais barato testar o Qwen3 14B como alternativa a modelos que custam mais por token.

Isso vale para quem já usa o Qwen3 14B ou consegue migrar para ele sem alterar requisitos de qualidade, latência e comportamento. Não muda nada para quem está preso a um modelo específico por compatibilidade, avaliação interna ou exigência de saída. A queda de preço, sozinha, não prova equivalência de desempenho.

O Qwen3 30B A3B Instruct 2507 também caiu, de US$ 0,30 para US$ 0,193 por milhão de tokens, redução de 35,7%. É um movimento na mesma direção, mas não substitui uma comparação própria para cada tarefa.

DeepSeek V4 encarece em várias frentes

A linha DeepSeek V4 exige mais atenção porque as mudanças não são iguais entre versões. O V4 Pro 0423 foi de US$ 1,639 para US$ 3,20 por milhão de tokens em 12 de setembro. Dois dias depois, o V4 Pro 0813 passou de US$ 1,738 para US$ 2,95, alta de 69,7%.

No segmento Flash, o V4 Flash 0423 chegou a US$ 0,177, ante US$ 0,095 anteriormente. A alta foi de 86,1%. Já o V4 Flash 0731 avançou de US$ 0,08 para US$ 0,12, aumento de 50%.

Há um detalhe importante: a trajetória recente não é uma linha reta para todas as versões. O V4 Flash 0423 também aparece em registros anteriores com pequenas quedas, de US$ 0,134 para US$ 0,131 e depois de US$ 0,10 para US$ 0,095. O V4 Pro 0813 teve oscilações próximas da estabilidade antes da alta de 69,7%.

Por isso, não basta tratar “DeepSeek V4” como um único produto. A versão exata no identificador da API agora influencia diretamente a fatura.

O que mudou — e o que não mudou

Os preços listados no OpenRouter mostram mudanças de tarifa, não lançamentos de modelos. Não há estreia de benchmark registrada no período, e os índices de inteligência, código e desempenho agêntico do Artificial Analysis não aparecem alterados nos dados disponíveis.

Isso significa que a decisão de trocar de modelo não deve ser tomada apenas pelo percentual anunciado. A redução do Qwen3 14B é concreta para o orçamento, mas ainda exige validação da qualidade na tarefa real. Do lado do DeepSeek, a alta pode tornar uma configuração existente significativamente mais cara mesmo sem qualquer mudança funcional percebida pela aplicação.

O período também teve outras quedas: o Llama 3.1 70B Instruct passou de US$ 0,72 para US$ 0,40 por milhão de tokens, enquanto o Nemotron 3 Ultra caiu de US$ 3,125 para US$ 2,40. Houve altas menores, como a do Gemma 4 26B A4B, de US$ 0,22 para US$ 0,30.

Para quem a mudança importa

A queda do Qwen3 14B interessa sobretudo a equipes que pagam por volume e podem aceitar um modelo de porte menor para tarefas bem delimitadas. O efeito é direto em pipelines com muitas requisições, processamento em lote e automações cujo custo por chamada domina a margem.

As altas do DeepSeek V4 atingem quem fixou o identificador Pro ou Flash na produção. Se a aplicação usa roteamento automático ou outro provedor, a mudança do OpenRouter pode não aparecer na mesma proporção. Também não muda nada para quem não usa essas variantes ou já mantém um contrato de preço diferente.

A decisão prática é revisar o identificador exato no código, recalcular a fatura com o novo preço e rodar testes antes de trocar o Qwen3 14B ou abandonar o DeepSeek V4. O corte de 73,6% abre espaço para experimentar; a alta de até 95,3% exige verificar agora se o modelo escolhido ainda cabe no orçamento.

Em uma frase

Se você paga por volume, teste o Qwen3 14B como alternativa de baixo custo e revise imediatamente qualquer integração com DeepSeek V4.

Perguntas frequentes

Quanto custa o Qwen3 14B na API?

O Qwen3 14B passou a custar US$ 0,24 por milhão de tokens no OpenRouter, ante US$ 0,91. A redução registrada foi de 73,6%.

Quanto subiu o DeepSeek V4 Pro?

O DeepSeek V4 Pro 0423 subiu de US$ 1,639 para US$ 3,20 por milhão de tokens, alta de 95,3%. A variante V4 Pro 0813 aumentou 69,7% e passou a US$ 2,95.

O DeepSeek V4 Flash ficou mais caro?

Sim, em algumas versões. O V4 Flash 0423 subiu 86,1%, para US$ 0,177 por milhão de tokens, enquanto o V4 Flash 0731 aumentou 50%, para US$ 0,12.

Leia também