FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 da Z.ai corta preço de saída pela metade em um dia

Único corte real do dia veio da chinesa Z.ai; Kimi da Moonshot mal se mexeu e segue irrelevante para a conta

Redação FalaVIP IA 3 min de leitura
US$ 1,32por milhão de tokens de saída do GLM 5.2
-56%queda no preço de saída do GLM 5.2
US$ 0,42por milhão de tokens de entrada do GLM 5.2

Você abriu o painel de preços hoje esperando mais um ajuste cosmético e encontrou outra coisa: o GLM 5.2 da chinesa Z.ai está cobrando US$ 1,32 por milhão de tokens de saída, contra US$ 3,00 que custava ontem. Em um único dia, o preço caiu 56%. É o único corte real entre as três mudanças de tabela registradas em 8 de julho de 2026 — e, por isso, é o que muda a sua conta.

O que efetivamente mudou hoje

Das três alterações no catálogo, só uma mexe de verdade no bolso. O GLM 5.2 passou de US$ 0,93 para US$ 0,42 por milhão de tokens de entrada (queda de 55%) e de US$ 3,00 para US$ 1,32 por milhão de tokens de saída. Os dois modelos da MoonshotAI — Kimi Latest e Kimi K2.6 — tiveram ajuste de um centavo na entrada (de US$ 0,66 para US$ 0,65) e mantiveram a saída em US$ 3,41. Variação de 1% arredondado para baixo. Não é corte, é arredondamento de tabela.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.231.32-56%
MoonshotAI Kimi Latest3.413.410%
Kimi K2.63.413.410%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Por que o GLM 5.2 importa e o Kimi não

A diferença entre os dois movimentos é a diferença entre marketing e irrelevância. O GLM 5.2 já aparecia no ranking de modelos acima de IQ 45 com melhor custo — terceiro colocado, atrás do MiniMax M3 e do DeepSeek V4 Pro. Com o corte, ele deixa de ser uma opção intermediária e vira candidato sério a default em qualquer pipeline que gera muito texto: chatbots, sumarização, extração, geração de código em massa. O Kimi, por outro lado, não figura nem entre os mais baratos nem entre os mais inteligentes do catálogo. Mexer um centavo no preço de entrada é trocar a placa da loja sem mudar o produto.

Variação do preço de saída (%)
GLM 5.2-56MoonshotAI Kimi Latest0Kimi K2.60%

Onde o GLM 5.2 se encaixa no tabuleiro

Olhando o topo por inteligência hoje, a liderança segue com a Anthropic: Claude Fable 5 marca 62,073 de IQ e custa US$ 50 por milhão de tokens de saída — 38 vezes mais caro que o GLM 5.2 ficou. O SpaceXAI Grok 4.5 vem em segundo (55,759) cobrando US$ 6. Logo abaixo, o Claude Sonnet 5 (55,261) sai a US$ 10. O Gemini 3.1 Pro Preview do Google (47,738) cobra US$ 12. O GLM 5.2, com IQ 52,641, agora entrega mais inteligência que o Gemini 3.1 Pro Preview por quase um décimo do preço de saída. É a maior distância entre capacidade e custo entre os modelos chineses e americanos listados hoje.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Grok 4.555.86
Claude Sonnet 555.310
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Entre os 488 modelos disponíveis no catálogo nesta data.

Para quem esse corte vale — e para quem não muda nada

Vale para você se está rodando workload com alto volume de tokens de saída: atendimento, geração de conteúdo, agentes que escrevem bastante antes de devolver a resposta. Vale também se você já usava o GLM 5.2 e estava descontente com a relação custo/benefício — agora a conta cai pela metade sem trocar de modelo. Vale ainda se você está decidindo entre MiniMax M3 (US$ 1,20 de saída, IQ 45,397) e DeepSeek V4 Pro (US$ 1,74 de saída, IQ 45,268): o GLM 5.2 entra nesse mesmo patamar de preço com IQ visivelmente mais alto.

Não muda nada para quem já paga Claude Fable 5 ou Grok 4.5 esperando o melhor da categoria — o corte da Z.ai não derruba o topo da pirâmide, só reorganiza o meio. Também não muda nada para workloads dominados por tokens de entrada, onde a queda foi proporcional mas o impacto absoluto é menor. E não muda nada para quem precisa de recursos que o GLM 5.2 não entrega, como contexto enorme ou ferramentas específicas — preço não compra capacidade que não existe.

O que fazer com isso hoje

Se você tem um pipeline em produção usando GLM 5.2, o efeito é automático: a próxima fatura já reflete o novo preço. Se você está avaliando qual modelo chinês usar como default, refaça a conta com US$ 1,32 de saída e provavelmente vai descobrir que o GLM 5.2 virou a melhor opção da faixa intermediária — acima do MiniMax M3 em inteligência, abaixo do DeepSeek V4 Pro em preço. E se você está pagando Anthropic ou Google para tarefas que não exigem o topo absoluto, vale rodar um piloto de duas semanas no GLM 5.2 antes do próximo ciclo de cobrança. A diferença entre US$ 12 e US$ 1,32 por milhão de tokens de saída é o tipo de número que aparece na reunião de diretoria.

Em uma frase

Se você gera muito texto via API, troque para o GLM 5.2 agora: é o melhor IQ pelo menor preço de saída entre os modelos chineses listados hoje.

Perguntas frequentes

Quanto custa o GLM 5.2 depois do corte de julho de 2026?

O GLM 5.2 da Z.ai passou a custar US$ 0,42 por milhão de tokens de entrada e US$ 1,32 por milhão de tokens de saída em 8 de julho de 2026, queda de 55% e 56% respectivamente em relação ao dia anterior.

O Kimi K2.6 também ficou mais barato hoje?

Tecnicamente sim, mas na prática não: o preço de entrada caiu de US$ 0,66 para US$ 0,65 e o de saída permaneceu em US$ 3,41. É um arredondamento de tabela, não um corte real.

O GLM 5.2 é melhor que o Claude Fable 5?

Não em inteligência absoluta: o Claude Fable 5 lidera o ranking com IQ 62,073 contra 52,641 do GLM 5.2. Mas o GLM 5.2 custa cerca de 38 vezes menos por milhão de tokens de saída, o que o torna a escolha racional para workloads onde o topo de capacidade não é obrigatório.

Leia também