Qwen3 14B ficou quase 4 vezes mais caro de um dia para o outro
Enquanto Z.ai cortou pela metade o GLM 5.2 e o Google barateou o Gemma 4 31B, dois modelos da Qwen subiram sem aviso claro.
Se você roda Qwen3 14B em produção, abre o painel de billing hoje. O modelo da Qwen saltou de US$ 0,24 para US$ 0,91 por milhão de tokens de saída — um aumento de 3,79x em 24 horas, sem comunicado explicando o motivo. O preço de entrada também subiu, de US$ 0,12 para US$ 0,2275 por milhão.
O dia teve oito mudanças, e elas apontam em direções opostas
Das oito alterações de preço registradas em 18 de julho, quatro foram alta e quatro foram corte. O movimento mais agressivo foi o do Qwen3 14B; o mais agressivo na direção contrária foi o do Z.ai GLM 5.2, que caiu para 0,38x do que custava na véspera — preço de entrada de US$ 0,3486 para US$ 0,3486? Não, leia de novo: caiu de US$ 0,9268 para US$ 0,3486, e a saída de US$ 2,9128 para US$ 1,0956. Em seguida o mesmo GLM 5.2 sofreu um segundo corte no mesmo dia, chegando a US$ 0,2912 de entrada e US$ 0,9152 de saída.
A Google também entrou no movimento de baixa com o Gemma 4 31B, que passou de US$ 0,22 para US$ 0,12 na entrada e de US$ 0,55 para US$ 0,37 na saída — uma redução de 33% na tarifa de saída. O Mancer: Weaver (alpha) cortou 25% no preço de saída, indo de US$ 1,00 para US$ 0,75.
Quem subiu e por que isso importa agora
Do lado das altas, além do Qwen3 14B, três outros modelos ficaram mais caros:
- Qwen3.5-27B: de US$ 0,195 para US$ 0,26 na entrada; saída de US$ 1,56 para US$ 2,60 (+67%).
- MoonshotAI: Kimi K2.7 Code: saída de US$ 3,50 para US$ 4,40 (+26%).
- Qwen3 30B A3B: alta discreta de 4% na saída.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| Qwen3 14B | 0.24 | 0.91 | +279% |
| GLM 5.2 | 2.9128 | 1.0956 | -62% |
| Qwen3.5-27B | 1.56 | 2.6 | +67% |
| Gemma 4 31B | 0.55 | 0.37 | -33% |
| Weaver (alpha) | 1 | 0.75 | -25% |
| Kimi K2.7 Code | 3.5 | 4.4 | +26% |
| GLM 5.2 | 1.0956 | 0.9152 | -16% |
| Qwen3 30B A3B | 0.5 | 0.52 | +4% |
A Qwen, criadora chinesa, mexeu em três modelos no mesmo dia — dois para cima e um quase imperceptível. Não há nota pública explicando a recomposição; o catálogo apenas registra o delta.
Para quem cada mudança vale alguma coisa
Se você roda o Qwen3 14B em classificação, sumarização ou qualquer tarefa com alto volume de tokens de saída, o impacto na fatura é direto: cada milhão de tokens que custava US$ 0,24 agora custa US$ 0,91. Em um pipeline que gasta 100 milhões de tokens de saída por mês, a conta pula de US$ 24 para US$ 91 — quase quatro vezes. Vale revisar o roteamento e testar substitutos antes do fechamento do mês.
Se o seu caso é o Z.ai GLM 5.2, o cenário é o oposto: a saída caiu de US$ 2,9128 para US$ 0,9152 em dois cortes sucessivos. Para workloads que dependiam dele e estavam sendo racionadas por custo, essa é a janela para aumentar o uso.
Para o Google Gemma 4 31B, o corte de 33% na saída reposiciona o modelo entre os mais baratos da família Gemma com mais de 30B de parâmetros — vale comparar com alternativas como o DeepSeek V4 Pro 0423, que aparece no piso do catálogo a US$ 1,74 por milhão de tokens de saída.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
| Grok 4.5 | 55.8 | 6 |
O tabuleiro em 18 de julho
O catálogo soma 509 modelos listados hoje (piso — modelos removidos depois não aparecem) e 65 criadores diferentes. No topo de inteligência estão Anthropic Claude Fable 5 (IQ 62,073), OpenAI GPT-5.6 Sol (IQ 60,93) e MoonshotAI Kimi K3 (IQ 59,699). Entre os mais baratos acima de IQ 45, o MiniMax M3 e o OpenAI GPT-5.6 Luna empatam em US$ 1,20 por milhão de tokens de saída — referência útil para quem está recalculando roteamento depois deste dia.
O que fazer com isso amanhã
Pegue a lista de modelos que você efetivamente consome, meça quanto cada um representa na fatura de tokens de saída e refaça o cálculo com os preços novos. Para o Qwen3 14B, teste alternativas de preço parecido antes de migrar de fato — pular de fornecedor por causa de um único dia de alta pode ser precipitado se a mudança for revertida em 48 horas. Para o GLM 5.2 e o Gemma 4 31B, a janela de preço está aberta e vale travar uso extra enquanto durar.
Audite hoje quais modelos da Qwen estão na sua rota: o 14B ficou quase 4x mais caro em 24h, e sem aviso — quem não revisar a fatura vai pagar a conta sem perceber.
Perguntas frequentes
O Qwen3 14B realmente ficou 4 vezes mais caro?
Sim, no preço de saída: passou de US$ 0,24 para US$ 0,91 por milhão de tokens em 18 de julho de 2026, uma variação de 3,79x em um único dia. O preço de entrada também subiu, de US$ 0,12 para US$ 0,2275.
Quais modelos ficaram mais baratos no mesmo dia?
Quatro modelos tiveram corte: Z.ai GLM 5.2 (dois cortes sucessivos, chegando a 0,31x do preço original), Google Gemma 4 31B (–33% na saída), Mancer Weaver alpha (–25% na saída) e, entre os menos relevantes, o próprio GLM 5.2 em ajuste adicional.
Vale trocar de modelo por causa dessa mudança?
Depende do volume. Se o Qwen3 14B representa uma fração pequena da sua fatura, o impacto é marginal. Se ele é peça central, vale testar substitutos como DeepSeek V4 Pro 0423 ou o MiniMax M3 antes de migrar de fato — preços em catálogos assim costumam oscilar em ambas as direções dentro de poucos dias.