FalaVIP IA o que os modelos custam,
medido todo dia
Preços

Qwen3 14B quase quadruplica de preço e chega a US$ 0,91

O custo listado no OpenRouter saltou 279,2% em dois dias, pressionando aplicações que usam modelos médios em alto volume. A mudança pesa mais no orçamento do que qualquer novidade de lançamento no período.

Redação FalaVIP IA 3 min de leitura
US$ 0,91por milhão de tokens do Qwen3 14B
279,2%de aumento no preço do Qwen3 14B
US$ 0,24preço anterior por milhão de tokens

O Qwen3 14B ficou 279,2% mais caro no OpenRouter em 4 de setembro. O preço passou de US$ 0,24 para US$ 0,91 por milhão de tokens. Na prática, o modelo quase quadruplicou de custo — e a mudança atinge diretamente quem escolheu uma opção intermediária para processar grandes volumes sem pagar a tarifa de modelos de ponta.

Se você usa o Qwen3 14B em produção, o número que importa é US$ 0,91. Não é uma alta marginal para absorver com uma pequena folga no orçamento. É uma alteração que pode exigir revisão de limites, roteamento e previsão de gastos.

O que mudou na conta

Os preços listados no OpenRouter mostram uma elevação de US$ 0,24 para US$ 0,91 por milhão de tokens. A variação registrada é de 279,2%. O catálogo não apresenta, nos dados disponíveis, uma explicação para o reajuste nem uma mudança de capacidade associada ao Qwen3 14B.

Isso separa o fato do marketing: o modelo não aparece como lançamento neste recorte, e não há uma nova nota de inteligência, código ou desempenho agêntico associada a ele. O que mudou de forma comprovável é o preço cobrado pelo uso.

Para uma equipe que escolheu o modelo pelo equilíbrio entre custo e escala, essa diferença altera a premissa econômica da aplicação. O mesmo volume de tokens que cabia em um orçamento calculado com US$ 0,24 passa a ser faturado pela nova tarifa. O impacto final depende da proporção de entrada e saída e do volume processado, mas a unidade de preço já subiu o suficiente para invalidar projeções baseadas no valor anterior.

A alta não está isolada

O período também registrou mudanças relevantes no DeepSeek V4 Pro 0813. O preço listado passou de US$ 1,738 para US$ 3,362 em uma das alterações de 6 de setembro, alta de 93,4%. Nos registros de 5 de setembro, o mesmo modelo aparece tanto subindo de US$ 1,738 para US$ 3,362 quanto recuando de US$ 3,362 para US$ 1,738.

Essa divergência nos registros reforça um ponto operacional: não basta escolher um modelo e arquivar a tarifa. Se a aplicação depende de um provedor agregado, o preço precisa ser acompanhado e validado antes de decisões de capacidade ou de margem.

Outras versões do DeepSeek V4 Pro 0423 tiveram reduções no período, incluindo uma alteração de US$ 1,679 para US$ 1,497 em 6 de setembro. O DeepSeek V4 Flash 0423 também recuou de US$ 0,168 para US$ 0,164. Portanto, a movimentação não é uma alta uniforme em todo o catálogo.

O que os lançamentos acrescentam — e o que não acrescentam

O recorte inclui cinco lançamentos. Entre eles estão GPT-6 Astra e GPT-6 Astra Pro, lançados em 4 de setembro, ambos com preço de US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. As versões batch custam US$ 5 na entrada e US$ 25 na saída.

Esses modelos têm janela de contexto de 1.050.000 tokens. O Ling 3.0 Flash Sante aparece com entrada e saída gratuitas e contexto de 262.144 tokens. Nenhum desses lançamentos, porém, muda automaticamente a conta de quem roda Qwen3 14B. São alternativas de catálogo, não uma explicação para o reajuste do Qwen.

As notas de inteligência do Artificial Analysis colocam outros modelos no topo: Claude Fable 5.1 aparece com nota 56,8 e preço de US$ 20 por milhão de tokens, enquanto GPT-6 Astra aparece com nota 54,7 e o mesmo preço. Esses números servem para comparar modelos avaliados, mas não há nota do Artificial Analysis para o Qwen3 14B nos dados disponíveis.

Para quem a mudança vale

A alta é relevante para você se o Qwen3 14B está em uma fila de classificação, resumo, extração, atendimento ou outra tarefa repetitiva com grande volume de tokens. Também importa para quem usa o modelo como fallback: mesmo acionado apenas em determinados fluxos, o novo preço entra na projeção de custo desses caminhos.

Para quem não usa Qwen3 14B, a mudança não altera a fatura diretamente. Também não há efeito automático para quem trabalha exclusivamente com modelos gratuitos, como o Ling 3.0 Flash Sante, ou com outro endpoint cujo preço não mudou. Ainda assim, a oscilação mostra por que uma arquitetura dependente de um único preço de referência fica exposta.

A decisão prática é revisar agora o custo por milhão de tokens no roteador, atualizar o orçamento e testar alternativas antes de manter o Qwen3 14B como padrão. O preço antigo de US$ 0,24 não deve continuar como premissa de planejamento.

Em uma frase

Se o Qwen3 14B está no seu fluxo, refaça a projeção com US$ 0,91 por milhão de tokens e valide uma rota alternativa antes do próximo ciclo de faturamento.

Perguntas frequentes

Quanto custa o Qwen3 14B no OpenRouter?

O Qwen3 14B está listado a US$ 0,91 por milhão de tokens. Antes, o preço registrado era de US$ 0,24 por milhão.

Quanto subiu o preço do Qwen3 14B?

A alta registrada foi de 279,2%. O valor passou de US$ 0,24 para US$ 0,91 por milhão de tokens.

A mudança afeta todos os modelos Qwen?

Não. Os dados registram a alteração especificamente para o Qwen3 14B. O Qwen3.5 Plus 2026-02-15 aparece com US$ 0,26 na entrada e US$ 1,56 na saída, enquanto o Qwen3.5 Plus 2026-04-20 aparece com US$ 0,30 e US$ 1,80.

Leia também