Z.ai derruba GLM 5.2 em 25% e três modelos chineses ficam mais baratos
Nenhum laboratório americano entrou na lista de cortes do dia. A queda veio toda da China, e o movimento diz algo sobre quem está brigando por preço agora.
A queda do dia tem nome chinês
Em um único dia, três laboratórios chineses mexeram no preço. O corte mais agressivo veio da Z.ai: o GLM 5.2 passou de US$ 1,76 para US$ 1,32 por milhão de tokens de saída — 25% mais barato de uma vez. Para quem roda o modelo em volume, isso é a diferença entre uma fatura que assusta e uma que cabe no orçamento sem precisar de aprovação do financeiro.
A entrada também caiu: de US$ 0,54 para US$ 0,42 por milhão. Não é corte cosmético, é corte estrutural. A Z.ai está dizendo que quer brigar por carga de trabalho, não por holofote de lançamento.
DeepSeek afina, MoonshotAI quase não mexe
A DeepSeek aproveitou a mesma janela para ajustar dois modelos. O V4 Flash 0423 — a versão rápida e barata da família — caiu de US$ 0,18 para US$ 0,168 por milhão de tokens de saída, cerca de 7% de desconto. O V3.2 recuou de US$ 0,3432 para US$ 0,3218, queda de 6%. Nenhum dos dois é corte de manchete, mas num modelo que já custava pouco, cada ponto percentual economizado vira dinheiro real no fim do mês quando o volume é grande.
Do outro lado, a MoonshotAI mexeu em três modelos — Kimi K2.6, Kimi K2.7 Code e Kimi Latest. As variações ficaram em 1% ou menos. Tecnicamente, o K2.6 até subiu um centavo na entrada: foi de US$ 0,65 para US$ 0,66 por milhão. São ajustes cosméticos, não decisão de mercado, e o usuário final provavelmente nem percebe no extrato.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 1.76 | 1.32 | -25% |
| DeepSeek V4 Flash 0423 | 0.18 | 0.168 | -7% |
| DeepSeek V3.2 | 0.3432 | 0.3218 | -6% |
| Kimi K2.6 | 3.41 | 3.41 | 0% |
| MoonshotAI Kimi Latest | 3.41 | 3.41 | 0% |
| Kimi K2.7 Code | 3.5 | 3.49 | 0% |
Quem não aparece na lista diz mais do que quem aparece
A lista de hoje tem seis alterações e zero aumentos relevantes. Mais importante: nenhum modelo americano — nem Anthropic, nem OpenAI, nem SpaceXAI — entrou na dança. O Claude Fable 5, topo do catálogo de inteligência com IQ 62,073, continua a US$ 50 por milhão de tokens de saída. O GPT-5.6 Sol, segundo colocado, segue a US$ 10. O Grok 4.5 da SpaceXAI está em US$ 6. Os líderes do topo não se mexem, e isso não é acaso.
A conta é simples: quem está no topo cobra caro porque pode. O único jeito de forçar uma Anthropic ou uma OpenAI a reduzir o preço é alguém entregar uma fração decente da qualidade por uma fração muito menor do custo. É exatamente o que a Z.ai está tentando fazer com o GLM 5.2 — e o que a DeepSeek, no segmento de baixo custo, já faz há algum tempo.
O calendário pesa
O contexto ajuda a entender por que o movimento veio agora. O catálogo tem mais de 502 modelos, vindos de 63 criadores, com 37 lançamentos só nos últimos 30 dias. Em um mercado desse tamanho, ninguém consegue descansar. Os laboratórios chineses estão escolhendo preço como argumento de venda. Os americanos, por enquanto, não precisam — porque o topo do ranking de inteligência ainda é deles.
Para quem isso muda alguma coisa
Se você já roda o GLM 5.2 em produção, o recado é prático: revise o dashboard de billing hoje. A queda vale para os tokens consumidos a partir de agora, e ninguém te devolve o que já foi cobrado.
Se você usa Claude Sonnet 5 ou GPT-5.6 Sol como padrão, nada muda no seu extrato. Mas a queda abre uma porta nova: rodar parte do workload no GLM 5.2 e manter o topo só para as tarefas mais pesadas ficou mais barato. A estratégia de "modelo top para o crítico, modelo chinês para o resto" ganha atratividade a cada corte desse tipo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| GPT-5.6 Terra | 56.6 | 12 |
| Grok 4.5 | 55.8 | 6 |
| Claude Sonnet 5 | 55.3 | 10 |
Se você está comparando opções chinesas entre si, a Z.ai está agressiva. Se está avaliando custo-benefício entre fronteiras, a diferença entre o topo americano e o meio chinês só faz crescer.
Quem roda GLM 5.2 em produção ganha 25% no output a partir de hoje; quem está nos topos americanos paga a mesma conta, mas ganha uma nova opção barata para workload secundário.
Perguntas frequentes
GLM 5.2 ficou mais barato a partir de quando?
A partir de 10 de julho de 2026. O novo preço vale para os tokens consumidos depois da virada do dia; o catálogo não publica reembolso retroativo.
Algum modelo americano ficou mais barato hoje?
Nenhum. Os seis modelos que mexeram em preço hoje são de laboratórios chineses (Z.ai, DeepSeek e MoonshotAI). O topo americano ficou parado.
Vale migrar do Claude Sonnet 5 para o GLM 5.2?
Depende do workload. O GLM 5.2 custa US$ 1,32 por milhão de tokens de saída contra US$ 10 do Sonnet 5, mas o topo do ranking de inteligência segue americano. Para tarefas críticas, teste antes de migrar.