GLM 5.2 quase quadruplica de preço num dia, e Z.ai já recua
Qwen3 Thinking também dobrou hoje; dos três cortes registrados, só um pesa de verdade
Se você roda GLM 5.2 no piloto automático, dá uma olhada na fatura antes de agosto: o token de entrada quase quadruplicou em poucas horas — de US$ 0,2408 para US$ 0,9688 por milhão. O de saída subiu junto, de US$ 0,7568 para US$ 3,0448. É o maior salto do catálogo no dia 20 de julho de 2026. E o detalhe que muda tudo: a Z.ai voltou atrás no mesmo dia.
Um hike de 4x em duas etapas
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 0.7568 | 3.0448 | +302% |
| Qwen3 235B A22B Thinking 250 | 1.495 | 3 | +101% |
| GLM 5 | 3.15 | 2.55 | -19% |
| GLM 5.2 | 3.0448 | 2.992 | -2% |
| Kimi K2.7 Code | 3.8 | 3.75 | -1% |
A Z.ai mexeu no GLM 5.2 duas vezes nas últimas 24 horas. A primeira tacada multiplicou o preço de saída por 4,02 — o maior ratio do dia. Logo depois a empresa republicou a tabela: input de US$ 0,9688 para US$ 0,952, output de US$ 3,0448 para US$ 2,992. Diferença pequena no papel, mas ela confirma que o primeiro número foi publicado cedo demais.
Para quem usava GLM 5.2 a US$ 0,24 por milhão de input, a conta nova está em outro patamar. Em volume de produção, isso muda totalmente a economia de um chatbot ou de um pipeline de classificação rodando 24/7.
O Qwen Thinking também dobrou — e ninguém recuou
O segundo hike do dia foi no Qwen3 235B A22B Thinking 2507, o modelo raciocinante da Qwen. Input dobrou: de US$ 0,1495 para US$ 0,30. Output dobrou: de US$ 1,495 para US$ 3,00. Sem recuo — a marcação nova está valendo.
Modelos com sufixo "thinking" cobram caro porque geram cadeia de raciocínio antes da resposta. Se você estava usando o Qwen3 esperando um atalho barato, atualize a planilha antes do próximo ciclo de cobrança.
Três cortes que quase não existem
Do outro lado, três modelos tiveram redução. Só uma delas pesa de verdade:
- Z.ai GLM 5: output caiu de US$ 3,15 para US$ 2,55. Input não mexeu. Corte real de 19% só na saída.
- Z.ai GLM 5.2: ratio 0,98 — é o ajuste pós-hike descrito acima.
- MoonshotAI Kimi K2.7 Code: caiu de US$ 0,85/3,80 para US$ 0,82/3,75. Variação de 1% no output.
Quem apostou nesses cortes como "promoção do dia" não vai economizar nada significativo — exceto quem já estava pagando caro pelo GLM 5 puro e ignora o GLM 5.2 novo.
O topo continua o mesmo — e isso é bom contexto
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
| Grok 4.5 | 55.8 | 6 |
No topo por inteligência hoje, o Claude Fable 5 segue em primeiro com IQ 62,073 e US$ 50 por milhão de saída — sem mexer no preço. Logo abaixo vêm GPT-5.6 Sol (IQ 60,93, US$ 10/M), Kimi K3 (IQ 59,699, US$ 15/M), GPT-5.6 Terra (US$ 12/M) e Grok 4.5 (US$ 6/M). Nenhum desses cinco líderes de IQ mudou de tabela hoje.
No nicho "barato e capaz" (acima de IQ 45), as opções estáveis são:
- GPT-5.6 Luna (OpenAI): IQ 52,318 por US$ 1,20/M de saída.
- MiniMax M3: IQ 45,397 por US$ 1,20/M de saída.
- DeepSeek V4 Pro 0423: IQ 45,268 por US$ 1,74/M de saída.
Mesmo com Qwen e Z.ai reajustando para cima, dá para rodar modelos acima de IQ 45 entre US$ 1,20 e US$ 1,74 por milhão de tokens de saída. É o seguro de quem não quer acordar com a fatura trocada.
Para quem isso muda alguma coisa
Para quem usava GLM 5.2: a conta vai subir quase quatro vezes na saída. Teste migrar parte da carga para o GLM 5 "puro" (que teve output reduzido) ou para o GPT-5.6 Luna — IQ parecido, preço tabelado.
Para quem usava Qwen3 Thinking esperando economia: o atalho acabou. Compare US$ 3/M do Qwen com US$ 10/M do GPT-5.6 Sol antes de decidir se mantém a integração.
Para quem roda qualquer outro modelo do catálogo: nada muda hoje, mas o episódio é lembrete prático: preço não é atributo estável, e um mesmo modelo pode mudar de tabela duas vezes no mesmo dia.
Trave o preço na chamada sempre que a API permitir e mantenha um fallback de preço tabelado (como o GPT-5.6 Luna, a US$ 1,20/M de saída) antes de fechar a próxima fatura.
Perguntas frequentes
O GLM 5.2 voltou ao preço antigo depois do recuo da Z.ai?
Não. O recuo foi só de US$ 0,9688 para US$ 0,952 no input e de US$ 3,0448 para US$ 2,992 no output. Em relação a ontem, o salto continua próximo de quatro vezes — o reposicionamento de tabela foi, na prática, uma correção do número publicado na primeira tacada.
Vale trocar o Qwen3 Thinking 2507 pelo GPT-5.6 Sol agora?
Depende do consumo de tokens. O Qwen Thinking custa US$ 3/M de saída hoje; o GPT-5.6 Sol custa US$ 10/M. Se a tarefa exige raciocínio pesado e o volume é baixo, a diferença absoluta pode ser tolerável; se é alto, a comparação tem que ser feita token a token, não só pelo preço por milhão.
Por que a Z.ai mexeu duas vezes no GLM 5.2 no mesmo dia?
Não dá para cravar o motivo com os dados públicos do catálogo. O padrão — publicar tabela com salto de 4x e republicar minutos depois com correção pequena — sugere ajuste publicado cedo demais, mas a empresa não emitiu nota sobre o episódio.