FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Qwen3 14B ficou quase 4 vezes mais caro de um dia para o outro

Enquanto Z.ai cortou pela metade o GLM 5.2 e o Google barateou o Gemma 4 31B, dois modelos da Qwen subiram sem aviso claro.

Redação FalaVIP IA 3 min de leitura
3,79xde aumento no preço de saída do Qwen3 14B
US$ 0,91novo preço por milhão de tokens de saída do Qwen3 14B
0,38xrazão do corte no Z.ai GLM 5.2

Se você roda Qwen3 14B em produção, abre o painel de billing hoje. O modelo da Qwen saltou de US$ 0,24 para US$ 0,91 por milhão de tokens de saída — um aumento de 3,79x em 24 horas, sem comunicado explicando o motivo. O preço de entrada também subiu, de US$ 0,12 para US$ 0,2275 por milhão.

O dia teve oito mudanças, e elas apontam em direções opostas

Das oito alterações de preço registradas em 18 de julho, quatro foram alta e quatro foram corte. O movimento mais agressivo foi o do Qwen3 14B; o mais agressivo na direção contrária foi o do Z.ai GLM 5.2, que caiu para 0,38x do que custava na véspera — preço de entrada de US$ 0,3486 para US$ 0,3486? Não, leia de novo: caiu de US$ 0,9268 para US$ 0,3486, e a saída de US$ 2,9128 para US$ 1,0956. Em seguida o mesmo GLM 5.2 sofreu um segundo corte no mesmo dia, chegando a US$ 0,2912 de entrada e US$ 0,9152 de saída.

Variação do preço de saída (%)
Qwen3 14B279GLM 5.2-62Qwen3.5-27B67Gemma 4 31B-33Weaver (alpha)-25Kimi K2.7 Code26GLM 5.2-16Qwen3 30B A3B4%

A Google também entrou no movimento de baixa com o Gemma 4 31B, que passou de US$ 0,22 para US$ 0,12 na entrada e de US$ 0,55 para US$ 0,37 na saída — uma redução de 33% na tarifa de saída. O Mancer: Weaver (alpha) cortou 25% no preço de saída, indo de US$ 1,00 para US$ 0,75.

Quem subiu e por que isso importa agora

Do lado das altas, além do Qwen3 14B, três outros modelos ficaram mais caros:

  • Qwen3.5-27B: de US$ 0,195 para US$ 0,26 na entrada; saída de US$ 1,56 para US$ 2,60 (+67%).
  • MoonshotAI: Kimi K2.7 Code: saída de US$ 3,50 para US$ 4,40 (+26%).
  • Qwen3 30B A3B: alta discreta de 4% na saída.
Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
Qwen3 14B0.240.91+279%
GLM 5.22.91281.0956-62%
Qwen3.5-27B1.562.6+67%
Gemma 4 31B0.550.37-33%
Weaver (alpha)10.75-25%
Kimi K2.7 Code3.54.4+26%
GLM 5.21.09560.9152-16%
Qwen3 30B A3B0.50.52+4%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

A Qwen, criadora chinesa, mexeu em três modelos no mesmo dia — dois para cima e um quase imperceptível. Não há nota pública explicando a recomposição; o catálogo apenas registra o delta.

Para quem cada mudança vale alguma coisa

Se você roda o Qwen3 14B em classificação, sumarização ou qualquer tarefa com alto volume de tokens de saída, o impacto na fatura é direto: cada milhão de tokens que custava US$ 0,24 agora custa US$ 0,91. Em um pipeline que gasta 100 milhões de tokens de saída por mês, a conta pula de US$ 24 para US$ 91 — quase quatro vezes. Vale revisar o roteamento e testar substitutos antes do fechamento do mês.

Se o seu caso é o Z.ai GLM 5.2, o cenário é o oposto: a saída caiu de US$ 2,9128 para US$ 0,9152 em dois cortes sucessivos. Para workloads que dependiam dele e estavam sendo racionadas por custo, essa é a janela para aumentar o uso.

Para o Google Gemma 4 31B, o corte de 33% na saída reposiciona o modelo entre os mais baratos da família Gemma com mais de 30B de parâmetros — vale comparar com alternativas como o DeepSeek V4 Pro 0423, que aparece no piso do catálogo a US$ 1,74 por milhão de tokens de saída.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Grok 4.555.86
Entre os 509 modelos disponíveis no catálogo nesta data.

O tabuleiro em 18 de julho

O catálogo soma 509 modelos listados hoje (piso — modelos removidos depois não aparecem) e 65 criadores diferentes. No topo de inteligência estão Anthropic Claude Fable 5 (IQ 62,073), OpenAI GPT-5.6 Sol (IQ 60,93) e MoonshotAI Kimi K3 (IQ 59,699). Entre os mais baratos acima de IQ 45, o MiniMax M3 e o OpenAI GPT-5.6 Luna empatam em US$ 1,20 por milhão de tokens de saída — referência útil para quem está recalculando roteamento depois deste dia.

O que fazer com isso amanhã

Pegue a lista de modelos que você efetivamente consome, meça quanto cada um representa na fatura de tokens de saída e refaça o cálculo com os preços novos. Para o Qwen3 14B, teste alternativas de preço parecido antes de migrar de fato — pular de fornecedor por causa de um único dia de alta pode ser precipitado se a mudança for revertida em 48 horas. Para o GLM 5.2 e o Gemma 4 31B, a janela de preço está aberta e vale travar uso extra enquanto durar.

Em uma frase

Audite hoje quais modelos da Qwen estão na sua rota: o 14B ficou quase 4x mais caro em 24h, e sem aviso — quem não revisar a fatura vai pagar a conta sem perceber.

Perguntas frequentes

O Qwen3 14B realmente ficou 4 vezes mais caro?

Sim, no preço de saída: passou de US$ 0,24 para US$ 0,91 por milhão de tokens em 18 de julho de 2026, uma variação de 3,79x em um único dia. O preço de entrada também subiu, de US$ 0,12 para US$ 0,2275.

Quais modelos ficaram mais baratos no mesmo dia?

Quatro modelos tiveram corte: Z.ai GLM 5.2 (dois cortes sucessivos, chegando a 0,31x do preço original), Google Gemma 4 31B (–33% na saída), Mancer Weaver alpha (–25% na saída) e, entre os menos relevantes, o próprio GLM 5.2 em ajuste adicional.

Vale trocar de modelo por causa dessa mudança?

Depende do volume. Se o Qwen3 14B representa uma fração pequena da sua fatura, o impacto é marginal. Se ele é peça central, vale testar substitutos como DeepSeek V4 Pro 0423 ou o MiniMax M3 antes de migrar de fato — preços em catálogos assim costumam oscilar em ambas as direções dentro de poucos dias.

Leia também