FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 ficou até 21% mais barato em dois cortes seguidos no mesmo dia

A Z.ai mexeu duas vezes no preço em 24 horas — e a queda acumulada muda o cálculo de quem já usa o modelo chinês como plano intermediário.

Redação FalaVIP IA 3 min de leitura
21%de queda acumulada no preço de saída entre o corte das 00h e o das 23h
US$ 0,8932por milhão de tokens de saída após o segundo corte
US$ 0,2842por milhão de tokens de entrada após o segundo corte

Dois cortes no mesmo modelo, no mesmo dia

Se você acompanha preço de API como quem acompanha cotação de dólar, o dia 2 de agosto de 2026 entrou para a lista. A Z.ai promoveu dois cortes consecutivos no GLM 5.2 — um pela madrugada e outro no fim do dia. O efeito acumulado não é pequeno: o token de saída foi de US$ 1,3200 para US$ 0,8932 por milhão, uma queda de cerca de 32% em 24 horas se você comparar o ponto de partida com o ponto de chegada. Já o token de entrada caiu de US$ 0,4200 para US$ 0,2842, recuo de pouco mais de 32% no acumulado.

O detalhe que importa é que ninguém avisou que viria o segundo corte. Quem olhou o catálogo pela manhã achou que tinha visto o movimento do dia; quem olhou à noite encontrou um preço ainda menor.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.21.13080.8932-21%
GLM 5.21.321.1308-14%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

O que exatamente ficou mais barato?

O GLM 5.2 é um modelo chinês da Z.ai que vinha sendo usado como opção intermediária — não é o mais barato do mercado, nem o mais inteligente. O corte de preço muda o lugar dele na prateleira. Para entender a magnitude, vale comparar com quem está na mesma faixa de capacidade:

  • DeepSeek V4 Flash 0731: cobra US$ 0,18 por milhão de tokens de saída.
  • MiniMax M3: US$ 1,20 por milhão de tokens de saída.
  • GPT-5.6 Luna (OpenAI): US$ 1,20 por milhão de tokens de saída.

Depois do segundo corte, o GLM 5.2 saiu de US$ 1,32 para US$ 0,8932 — ou seja, ficou mais barato que o MiniMax M3 e que o GPT-5.6 Luna, e se aproximou da faixa da DeepSeek. É a primeira vez, olhando para o catálogo de hoje, que o GLM 5.2 deixa de ser uma escolha de nicho e entra na briga direta por volume.

Para quem isso muda alguma coisa

Se você roda o GLM 5.2 em produção há semanas, o recálculo é automático: o mesmo tráfego, a mesma chamada, agora custa menos. Em fluxos de resumo, classificação ou geração em massa, a economia aparece no fim do mês sem você ter trocado uma linha de código.

Se você estava olhando o modelo para um projeto novo, a conta mudou de sinal. Um pipeline que parecia caro demais em julho agora cabe no orçamento de agosto. Vale fazer o exercício: pegue o gasto projetado em tokens de saída, multiplique por 0,68 (o fator do corte acumulado) e veja o que sobra.

Se você nunca considerou o GLM 5.2 porque o preço não fechava, agora fecha. Mas com uma ressalva importante: preço é o que mudou; capacidade, latência e comportamento em português continuam sendo os mesmos de ontem. Não é o momento de assumir que o modelo virou outra coisa — é o momento de assumir que ficou mais barato para fazer o que já fazia.

Variação do preço de saída (%)
GLM 5.2-21GLM 5.2-14%

Para quem não muda nada

Se o seu trabalho depende de raciocínio pesado — código complexo, planejamento multi-etapa, análise de documentos longos — o topo do mercado continua outro. O Claude Opus 5 lidera o ranking de inteligência do catálogo, com IQ 63,053, cobrando US$ 25 por milhão de tokens de saída. O Claude Fable 5 vem logo atrás, a US$ 50. O GLM 5.2 não está nessa briga, e o corte de preço não o coloca lá.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 528 modelos disponíveis no catálogo nesta data.

Se você já está na DeepSeek V4 Flash 0731, que continua sendo a opção mais barata acima de IQ 45 (US$ 0,18 por milhão de tokens de saída), o corte do GLM 5.2 não te tira do lugar — ainda assim, é a referência de piso.

O tabuleiro hoje

A Z.ai é uma das 67 criadoras listadas no catálogo de hoje, que soma mais de 528 modelos. Em um mercado com 46 lançamentos nos últimos 30 dias, mexer no preço duas vezes em 24 horas é um sinal claro: a chinesa quer volume, e está disposta a cortar margem para conseguir. Resta ver se o corte fica ou se é promoção de curtíssimo prazo — o histórico desse tipo de movimento costuma ser o segundo cenário.

Por ora, a recomendação prática é direta: se o GLM 5.2 já estava no seu radar, revalide o preço no painel antes de fechar a próxima fatura. Dois cortes no mesmo dia significam que o número que você anotou ontem provavelmente já está errado.

Em uma frase

Revalie o preço do GLM 5.2 antes de fechar o mês — dois cortes em 24 horas derrubaram o token de saída para US$ 0,8932, mas o modelo segue sendo intermediário em capacidade.

Perguntas frequentes

Quanto custa o GLM 5.2 depois dos cortes de agosto de 2026?

Após o segundo corte do dia 2 de agosto, o GLM 5.2 passou a cobrar US$ 0,2842 por milhão de tokens de entrada e US$ 0,8932 por milhão de tokens de saída. O preço de saída acumulou uma queda de cerca de 32% em 24 horas.

O GLM 5.2 é o modelo mais barato do mercado?

Não. O modelo mais barato acima de IQ 45 continua sendo o DeepSeek V4 Flash 0731, a US$ 0,18 por milhão de tokens de saída. Depois do corte, o GLM 5.2 se aproxima dessa faixa, mas ainda não é o piso do mercado.

O corte de preço muda a capacidade do GLM 5.2?

Não. O que mudou foi apenas o preço por token — entrada e saída. Capacidade, latência e comportamento do modelo permanecem os mesmos. O corte torna o modelo mais competitivo em custo, não em qualidade.

Leia também