GLM 5.2 da Z.ai corta preço de saída pela metade em um dia
Único corte real do dia veio da chinesa Z.ai; Kimi da Moonshot mal se mexeu e segue irrelevante para a conta
Você abriu o painel de preços hoje esperando mais um ajuste cosmético e encontrou outra coisa: o GLM 5.2 da chinesa Z.ai está cobrando US$ 1,32 por milhão de tokens de saída, contra US$ 3,00 que custava ontem. Em um único dia, o preço caiu 56%. É o único corte real entre as três mudanças de tabela registradas em 8 de julho de 2026 — e, por isso, é o que muda a sua conta.
O que efetivamente mudou hoje
Das três alterações no catálogo, só uma mexe de verdade no bolso. O GLM 5.2 passou de US$ 0,93 para US$ 0,42 por milhão de tokens de entrada (queda de 55%) e de US$ 3,00 para US$ 1,32 por milhão de tokens de saída. Os dois modelos da MoonshotAI — Kimi Latest e Kimi K2.6 — tiveram ajuste de um centavo na entrada (de US$ 0,66 para US$ 0,65) e mantiveram a saída em US$ 3,41. Variação de 1% arredondado para baixo. Não é corte, é arredondamento de tabela.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 3 | 1.32 | -56% |
| MoonshotAI Kimi Latest | 3.41 | 3.41 | 0% |
| Kimi K2.6 | 3.41 | 3.41 | 0% |
Por que o GLM 5.2 importa e o Kimi não
A diferença entre os dois movimentos é a diferença entre marketing e irrelevância. O GLM 5.2 já aparecia no ranking de modelos acima de IQ 45 com melhor custo — terceiro colocado, atrás do MiniMax M3 e do DeepSeek V4 Pro. Com o corte, ele deixa de ser uma opção intermediária e vira candidato sério a default em qualquer pipeline que gera muito texto: chatbots, sumarização, extração, geração de código em massa. O Kimi, por outro lado, não figura nem entre os mais baratos nem entre os mais inteligentes do catálogo. Mexer um centavo no preço de entrada é trocar a placa da loja sem mudar o produto.
Onde o GLM 5.2 se encaixa no tabuleiro
Olhando o topo por inteligência hoje, a liderança segue com a Anthropic: Claude Fable 5 marca 62,073 de IQ e custa US$ 50 por milhão de tokens de saída — 38 vezes mais caro que o GLM 5.2 ficou. O SpaceXAI Grok 4.5 vem em segundo (55,759) cobrando US$ 6. Logo abaixo, o Claude Sonnet 5 (55,261) sai a US$ 10. O Gemini 3.1 Pro Preview do Google (47,738) cobra US$ 12. O GLM 5.2, com IQ 52,641, agora entrega mais inteligência que o Gemini 3.1 Pro Preview por quase um décimo do preço de saída. É a maior distância entre capacidade e custo entre os modelos chineses e americanos listados hoje.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| Grok 4.5 | 55.8 | 6 |
| Claude Sonnet 5 | 55.3 | 10 |
| GLM 5.2 | 52.6 | 3.036 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
Para quem esse corte vale — e para quem não muda nada
Vale para você se está rodando workload com alto volume de tokens de saída: atendimento, geração de conteúdo, agentes que escrevem bastante antes de devolver a resposta. Vale também se você já usava o GLM 5.2 e estava descontente com a relação custo/benefício — agora a conta cai pela metade sem trocar de modelo. Vale ainda se você está decidindo entre MiniMax M3 (US$ 1,20 de saída, IQ 45,397) e DeepSeek V4 Pro (US$ 1,74 de saída, IQ 45,268): o GLM 5.2 entra nesse mesmo patamar de preço com IQ visivelmente mais alto.
Não muda nada para quem já paga Claude Fable 5 ou Grok 4.5 esperando o melhor da categoria — o corte da Z.ai não derruba o topo da pirâmide, só reorganiza o meio. Também não muda nada para workloads dominados por tokens de entrada, onde a queda foi proporcional mas o impacto absoluto é menor. E não muda nada para quem precisa de recursos que o GLM 5.2 não entrega, como contexto enorme ou ferramentas específicas — preço não compra capacidade que não existe.
O que fazer com isso hoje
Se você tem um pipeline em produção usando GLM 5.2, o efeito é automático: a próxima fatura já reflete o novo preço. Se você está avaliando qual modelo chinês usar como default, refaça a conta com US$ 1,32 de saída e provavelmente vai descobrir que o GLM 5.2 virou a melhor opção da faixa intermediária — acima do MiniMax M3 em inteligência, abaixo do DeepSeek V4 Pro em preço. E se você está pagando Anthropic ou Google para tarefas que não exigem o topo absoluto, vale rodar um piloto de duas semanas no GLM 5.2 antes do próximo ciclo de cobrança. A diferença entre US$ 12 e US$ 1,32 por milhão de tokens de saída é o tipo de número que aparece na reunião de diretoria.
Se você gera muito texto via API, troque para o GLM 5.2 agora: é o melhor IQ pelo menor preço de saída entre os modelos chineses listados hoje.
Perguntas frequentes
Quanto custa o GLM 5.2 depois do corte de julho de 2026?
O GLM 5.2 da Z.ai passou a custar US$ 0,42 por milhão de tokens de entrada e US$ 1,32 por milhão de tokens de saída em 8 de julho de 2026, queda de 55% e 56% respectivamente em relação ao dia anterior.
O Kimi K2.6 também ficou mais barato hoje?
Tecnicamente sim, mas na prática não: o preço de entrada caiu de US$ 0,66 para US$ 0,65 e o de saída permaneceu em US$ 3,41. É um arredondamento de tabela, não um corte real.
O GLM 5.2 é melhor que o Claude Fable 5?
Não em inteligência absoluta: o Claude Fable 5 lidera o ranking com IQ 62,073 contra 52,641 do GLM 5.2. Mas o GLM 5.2 custa cerca de 38 vezes menos por milhão de tokens de saída, o que o torna a escolha racional para workloads onde o topo de capacidade não é obrigatório.