FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 da Z.ai ficou 21% mais barato em dois cortes seguidos

Modelo chinês de alto IQ derruba preço de saída pela segunda vez em 24 horas e entra no radar de quem paga a conta da API

Redação FalaVIP IA 3 min de leitura
US$ 1,804por milhão de tokens de saída (depois do segundo corte)
21%queda acumulada em 24 horas
IQ 52,6terceiro modelo mais inteligente do catálogo hoje

O corte que ninguém viu no release

Ontem o Z.ai: GLM 5.2 custava US$ 2,288 por milhão de tokens de saída. Hoje custa US$ 1,804. Em números de boleto, isso é 21% mais barato em menos de 24 horas — e não foi um corte único, foram dois: o preço já tinha baixado de US$ 2,42 para US$ 2,288, e agora desceu mais um andar.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.22.2881.804-21%
GLM 5.22.422.288-5%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Parece ajuste de tabela, e talvez seja. Mas a sequência importa: o GLM 5.2 não é um modelo qualquer. Pelo snapshot de inteligência do catálogo, ele é o terceiro mais bem colocado, atrás só do Claude Fable 5 e do Claude Sonnet 5, ambos da Anthropic. Quando um modelo desse calibre corta preço duas vezes em sequência, o efeito não é só no checkout — é na lista de compras.

O que exatamente ficou mais barato

O corte atinge o preço de saída, ou seja, o que você paga pelo que o modelo escreve. O preço de entrada também caiu, mas em proporção menor: de US$ 0,728 para US$ 0,574 por milhão de tokens lidos. Para um chatbot comum, onde a entrada costuma ser maior que a saída, esse movimento ajuda menos do que parece. Para um agente que gera muito texto — geração de código, relatórios longos, pipelines de dados —, é onde a economia aparece de verdade.

Variação do preço de saída (%)
GLM 5.2-21GLM 5.2-5%

Traduzindo o marketing: "ficou mais barato" significa que cada milhão de tokens que o GLM 5.2 cospe na resposta agora custa US$ 1,804 em vez de US$ 2,288. Não houve mudança de contexto, de janela ou de capacidade anunciada junto com o corte.

Onde o GLM 5.2 se encaixa no tabuleiro

Olhe o topo do catálogo hoje: Claude Fable 5 lidera com IQ 62 e custa US$ 50 por milhão de tokens de saída — quase 28 vezes o preço atual do GLM 5.2. Claude Sonnet 5 vem em segundo com IQ 55 e US$ 10 por milhão. O Gemini 3.1 Pro Preview está em quarto com IQ 47,7 e US$ 12.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Claude Sonnet 555.310
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
Entre os 482 modelos disponíveis no catálogo nesta data.

O Z.ai é chinês, vem de uma fornecedor que não está no clube das big techs ocidentais, e mesmo assim entrega IQ 52,6 cobrando US$ 1,804. Para workloads que não exigem o topo absoluto da régua, a conta de API começa a ficar esquisita: por que pagar US$ 10 no Sonnet 5 se o GLM 5.2 entrega IQ próximo por uma fração?

A resposta curta é a mesma de sempre: ecossistema, latência, suporte, conformidade. O GLM 5.2 não substitui o Sonnet 5 em todos os cenários — só nos que cabem.

Para quem isso muda a decisão

Se você roda o Claude Sonnet 5 em produção e o orçamento está apertando, vale testar o GLM 5.2 nas mesmas tarefas e medir qualidade antes de migrar. A diferença de IQ é pequena (55 contra 52,6) e a diferença de preço é enorme.

Se você já usa o DeepSeek V4 Pro 0423 — outro modelo chinês, IQ 45,2, US$ 1,74 por milhão de saída —, o GLM 5.2 não é mais barato, mas é mais inteligente por um acréscimo pequeno. A decisão passa a ser de qualidade por dólar, não de custo puro.

Se você está no topo da pirâmide, pagando caro no Claude Fable 5 ou no Sonnet 5 porque precisa do melhor IQ possível, nada muda. O corte de preço não cria um substituto, só cria uma opção intermediária mais barata.

O sinal por trás do movimento

Dois cortes em 24 horas não são acidente. Alguém na Z.ai está olhando para a tabela de preços dos concorrentes e ajustando em tempo real. É a dinâmica normal de um mercado com mais de 480 modelos listados e 62 fornecedores brigando por cada workload.

A implicação prática é direta: quem escolhe modelo pela fatura precisa revalidar a tabela de preços com frequência, porque ela virou variável de curto prazo. E quem está rodando o GLM 5.2 em produção pode respirar — pelo menos até o próximo corte, que pode ser para cima.

Em uma frase

Revalide o preço do GLM 5.2 antes de fechar o mês: dois cortes em 24 horas mudaram a conta, e o modelo agora disputa espaço com o Sonnet 5 em workloads de IQ intermediário.

Perguntas frequentes

Quanto custa o GLM 5.2 hoje?

O preço de saída é US$ 1,804 por milhão de tokens e o de entrada é US$ 0,574, depois de dois cortes consecutivos em 4 e 5 de julho de 2026. Antes dos cortes, a saída custava US$ 2,42.

O GLM 5.2 substitui o Claude Sonnet 5?

Não em todos os cenários. O Sonnet 5 tem IQ 55,2 contra 52,6 do GLM 5.2, mas custa cerca de 5,5 vezes mais por milhão de tokens de saída. Para tarefas que não exigem o topo da régua, vale testar o GLM 5.2 e medir qualidade antes de migrar.

Por que a Z.ai cortou preço duas vezes em 24 horas?

Os dados não explicam o motivo, mas o padrão sugere ajuste competitivo: o GLM 5.2 ocupa a terceira posição em IQ no catálogo e o preço anterior ficava distante do DeepSeek V4 Pro, seu concorrente chinês mais próximo.

Leia também