GLM 5.2 ficou até 21% mais barato em dois cortes seguidos no mesmo dia
A Z.ai mexeu duas vezes no preço em 24 horas — e a queda acumulada muda o cálculo de quem já usa o modelo chinês como plano intermediário.
Dois cortes no mesmo modelo, no mesmo dia
Se você acompanha preço de API como quem acompanha cotação de dólar, o dia 2 de agosto de 2026 entrou para a lista. A Z.ai promoveu dois cortes consecutivos no GLM 5.2 — um pela madrugada e outro no fim do dia. O efeito acumulado não é pequeno: o token de saída foi de US$ 1,3200 para US$ 0,8932 por milhão, uma queda de cerca de 32% em 24 horas se você comparar o ponto de partida com o ponto de chegada. Já o token de entrada caiu de US$ 0,4200 para US$ 0,2842, recuo de pouco mais de 32% no acumulado.
O detalhe que importa é que ninguém avisou que viria o segundo corte. Quem olhou o catálogo pela manhã achou que tinha visto o movimento do dia; quem olhou à noite encontrou um preço ainda menor.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 1.1308 | 0.8932 | -21% |
| GLM 5.2 | 1.32 | 1.1308 | -14% |
O que exatamente ficou mais barato?
O GLM 5.2 é um modelo chinês da Z.ai que vinha sendo usado como opção intermediária — não é o mais barato do mercado, nem o mais inteligente. O corte de preço muda o lugar dele na prateleira. Para entender a magnitude, vale comparar com quem está na mesma faixa de capacidade:
- DeepSeek V4 Flash 0731: cobra US$ 0,18 por milhão de tokens de saída.
- MiniMax M3: US$ 1,20 por milhão de tokens de saída.
- GPT-5.6 Luna (OpenAI): US$ 1,20 por milhão de tokens de saída.
Depois do segundo corte, o GLM 5.2 saiu de US$ 1,32 para US$ 0,8932 — ou seja, ficou mais barato que o MiniMax M3 e que o GPT-5.6 Luna, e se aproximou da faixa da DeepSeek. É a primeira vez, olhando para o catálogo de hoje, que o GLM 5.2 deixa de ser uma escolha de nicho e entra na briga direta por volume.
Para quem isso muda alguma coisa
Se você roda o GLM 5.2 em produção há semanas, o recálculo é automático: o mesmo tráfego, a mesma chamada, agora custa menos. Em fluxos de resumo, classificação ou geração em massa, a economia aparece no fim do mês sem você ter trocado uma linha de código.
Se você estava olhando o modelo para um projeto novo, a conta mudou de sinal. Um pipeline que parecia caro demais em julho agora cabe no orçamento de agosto. Vale fazer o exercício: pegue o gasto projetado em tokens de saída, multiplique por 0,68 (o fator do corte acumulado) e veja o que sobra.
Se você nunca considerou o GLM 5.2 porque o preço não fechava, agora fecha. Mas com uma ressalva importante: preço é o que mudou; capacidade, latência e comportamento em português continuam sendo os mesmos de ontem. Não é o momento de assumir que o modelo virou outra coisa — é o momento de assumir que ficou mais barato para fazer o que já fazia.
Para quem não muda nada
Se o seu trabalho depende de raciocínio pesado — código complexo, planejamento multi-etapa, análise de documentos longos — o topo do mercado continua outro. O Claude Opus 5 lidera o ranking de inteligência do catálogo, com IQ 63,053, cobrando US$ 25 por milhão de tokens de saída. O Claude Fable 5 vem logo atrás, a US$ 50. O GLM 5.2 não está nessa briga, e o corte de preço não o coloca lá.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
Se você já está na DeepSeek V4 Flash 0731, que continua sendo a opção mais barata acima de IQ 45 (US$ 0,18 por milhão de tokens de saída), o corte do GLM 5.2 não te tira do lugar — ainda assim, é a referência de piso.
O tabuleiro hoje
A Z.ai é uma das 67 criadoras listadas no catálogo de hoje, que soma mais de 528 modelos. Em um mercado com 46 lançamentos nos últimos 30 dias, mexer no preço duas vezes em 24 horas é um sinal claro: a chinesa quer volume, e está disposta a cortar margem para conseguir. Resta ver se o corte fica ou se é promoção de curtíssimo prazo — o histórico desse tipo de movimento costuma ser o segundo cenário.
Por ora, a recomendação prática é direta: se o GLM 5.2 já estava no seu radar, revalide o preço no painel antes de fechar a próxima fatura. Dois cortes no mesmo dia significam que o número que você anotou ontem provavelmente já está errado.
Revalie o preço do GLM 5.2 antes de fechar o mês — dois cortes em 24 horas derrubaram o token de saída para US$ 0,8932, mas o modelo segue sendo intermediário em capacidade.
Perguntas frequentes
Quanto custa o GLM 5.2 depois dos cortes de agosto de 2026?
Após o segundo corte do dia 2 de agosto, o GLM 5.2 passou a cobrar US$ 0,2842 por milhão de tokens de entrada e US$ 0,8932 por milhão de tokens de saída. O preço de saída acumulou uma queda de cerca de 32% em 24 horas.
O GLM 5.2 é o modelo mais barato do mercado?
Não. O modelo mais barato acima de IQ 45 continua sendo o DeepSeek V4 Flash 0731, a US$ 0,18 por milhão de tokens de saída. Depois do corte, o GLM 5.2 se aproxima dessa faixa, mas ainda não é o piso do mercado.
O corte de preço muda a capacidade do GLM 5.2?
Não. O que mudou foi apenas o preço por token — entrada e saída. Capacidade, latência e comportamento do modelo permanecem os mesmos. O corte torna o modelo mais competitivo em custo, não em qualidade.