FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 derruba 23% no preço de saída e vira o melhor custo-benefício acima de IQ 50

Quatro modelos ficaram mais baratos em 22 de junho; nenhum subiu. A Z.ai liderou o corte e empurrou o GLM 5.2 para o topo da lista de quem busca inteligência por dólar.

Redação FalaVIP IA 3 min de leitura
US$ 3,08preço de saída do GLM 5.2 após o corte
-23%redução no preço de saída do GLM 5.2 (de US$ 4 para US$ 3,08)
4 modelosficaram mais baratos em 22/06/2026; nenhum subiu

Ontem você pagava US$ 4 por milhão de tokens de saída no GLM 5.2. Hoje paga US$ 3,08. É um corte de 23% em um único dia, sem mudança de modelo, sem mudança de capacidade — só o número na fatura.

E não foi o único. Quatro modelos ficaram mais baratos nas últimas 24 horas. Nenhum subiu. É o tipo de dia em que vale reabrir o dashboard de custos antes de processar o próximo lote.

O corte que muda a conta

A Z.ai mexeu duas vezes no GLM 5.2 em 24 horas — e nas duas para baixo. O preço de entrada caiu de US$ 1,20 para US$ 1 por milhão de tokens (uma redução de cerca de 17%). O de saída, o que mais pesa em workloads de geração de texto longo, caiu de US$ 4,10 para US$ 4 e depois para US$ 3,08. No agregado do dia, o índice de preço do modelo recuou 23%.

Variação do preço de saída (%)
GLM 5.2-23MoonshotAI Kimi Latest-3Kimi K2.6-3GLM 5.2-2%

Para colocar em perspectiva: o GLM 5.2 é o segundo modelo mais inteligente do catálogo hoje, com IQ 52,6, atrás apenas do Claude Fable 5 (IQ 62). E agora custa menos da metade do que custava para entregar esse nível de raciocínio.

Quem mais mexeu no preço

A MoonshotAI também ajustou, mas com bisturi fino. Tanto o Kimi K2.6 quanto o Kimi Latest saíram de US$ 3,50 para US$ 3,41 por milhão de tokens de saída — uma queda de 3%. O preço de entrada ficou parado em US$ 0,66. É quase um arredondamento, não uma estratégia agressiva. Mas em volumes altos, 3% é 3%.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.243.08-23%
MoonshotAI Kimi Latest3.53.41-3%
Kimi K2.63.53.41-3%
GLM 5.24.14-2%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Nenhum dos quatro modelos alterados é o mais barato do catálogo. Quem lidera essa lista segue sendo o MiniMax M3, a US$ 1,20 por milhão de tokens de saída, com IQ 45,4. O GLM 5.2 agora aparece na terceira posição entre os modelos com IQ acima de 45 — atrás do M3 e do DeepSeek V4 Pro (US$ 1,74), mas bem à frente de qualquer coisa da OpenAI, Anthropic ou Google em termos de inteligência por dólar.

Como isso se compara ao topo do mercado

Para entender o tamanho do corte, vale olhar quem está na frente e quanto custa. O Claude Fable 5, da Anthropic, lidera em inteligência com IQ 62,07 — e cobra US$ 50 por milhão de tokens de saída. O Gemini 3.1 Pro Preview, do Google, vem em terceiro com IQ 47,74 e sai por US$ 12. O GPT-5.3-Codex, da OpenAI, fecha o top 5 com IQ 45,51 e preço de US$ 14.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Em outras palavras: o GLM 5.2 agora entrega IQ 52,6 por US$ 3,08 de saída. O Claude Fable 5 entrega IQ 62,07 por US$ 50. A diferença de inteligência é de 9,5 pontos de IQ. A diferença de preço é de 16 vezes. Cada ponto de IQ acima do GLM 5.2 no Claude Fable custa, proporcionalmente, mais de US$ 5 por milhão de tokens.

Para quem isso vale — e para quem não muda nada

Se você roda o GLM 5.2 hoje, a conta de amanhã vai ser menor sem você ter feito nada. Vale conferir se o roteamento automático da sua plataforma já captou o novo preço ou se você precisa atualizar a referência manualmente.

Se você está pagando US$ 12 a US$ 50 por milhão em um modelo da OpenAI, Anthropic ou Google para tarefas que não exigem o topo absoluto de raciocínio, o GLM 5.2 virou o candidato óbvio para um teste A/B. Não é troca cega — é teste com métrica de qualidade amarrada.

Se você já usa o MiniMax M3 ou o DeepSeek V4 Pro porque preço é o critério número um, nada muda. Eles seguem mais baratos. A diferença é que agora existe uma terceira opção entre eles e o topo caro, com inteligência intermediária e preço que não assusta.

Se você está em workload com muito input e pouco output (classificação, embedding-like, extração), os cortes de entrada são menos relevantes — o GLM 5.2 caiu só 17% nesse lado, e o Kimi nem mexeu.

O que fazer agora

Rode um lote pequeno do seu caso de uso real no GLM 5.2 com o preço novo. Compare qualidade e latência contra o que você usa hoje. Se a diferença de qualidade for aceitável, a economia começa amanhã. Se não for, você ainda tem os mesmos modelos de antes — só com mais uma opção na mesa.

Em uma frase

Quem roda GLM 5.2 ganha 23% de economia automática; quem paga caro em modelo topo de linha tem agora um candidato intermediário forte para testar antes do próximo ciclo de cobrança.

Perguntas frequentes

Quais modelos ficaram mais baratos em 22 de junho de 2026?

Quatro modelos: GLM 5.2 (Z.ai), Kimi K2.6 e Kimi Latest (MoonshotAI), em mais um ajuste do próprio GLM 5.2. O destaque é o GLM 5.2, que teve corte de 23% no preço de saída, de US$ 4 para US$ 3,08 por milhão de tokens.

O GLM 5.2 ficou mais barato que o Claude Fable 5?

Sim, em preço. O GLM 5.2 sai por US$ 3,08 por milhão de tokens de saída, contra US$ 50 do Claude Fable 5. Em inteligência, porém, o Claude segue na frente, com IQ 62,07 contra 52,64 do GLM 5.2 — a diferença de cerca de 9,5 pontos de IQ custa 16 vezes mais.

Vale trocar meu modelo atual pelo GLM 5.2 depois desse corte?

Depende do seu critério. Se preço é o fator principal, o MiniMax M3 e o DeepSeek V4 Pro seguem mais baratos. Se você quer equilíbrio entre inteligência e custo, o GLM 5.2 virou a melhor opção intermediária — vale testar com um lote pequeno do seu caso real antes de migrar.

Leia também