FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Z.ai derruba GLM 5.2 em 25% e três modelos chineses ficam mais baratos

Nenhum laboratório americano entrou na lista de cortes do dia. A queda veio toda da China, e o movimento diz algo sobre quem está brigando por preço agora.

Redação FalaVIP IA 3 min de leitura
US$ 1,32por milhão de tokens de saída no GLM 5.2 (era US$ 1,76)
25%de corte no preço de saída do GLM 5.2
US$ 50preço de saída do Claude Fable 5, líder de inteligência no catálogo

A queda do dia tem nome chinês

Em um único dia, três laboratórios chineses mexeram no preço. O corte mais agressivo veio da Z.ai: o GLM 5.2 passou de US$ 1,76 para US$ 1,32 por milhão de tokens de saída — 25% mais barato de uma vez. Para quem roda o modelo em volume, isso é a diferença entre uma fatura que assusta e uma que cabe no orçamento sem precisar de aprovação do financeiro.

A entrada também caiu: de US$ 0,54 para US$ 0,42 por milhão. Não é corte cosmético, é corte estrutural. A Z.ai está dizendo que quer brigar por carga de trabalho, não por holofote de lançamento.

Variação do preço de saída (%)
GLM 5.2-25DeepSeek V4 Flash 0423-7DeepSeek V3.2-6Kimi K2.60MoonshotAI Kimi Latest0Kimi K2.7 Code0%

DeepSeek afina, MoonshotAI quase não mexe

A DeepSeek aproveitou a mesma janela para ajustar dois modelos. O V4 Flash 0423 — a versão rápida e barata da família — caiu de US$ 0,18 para US$ 0,168 por milhão de tokens de saída, cerca de 7% de desconto. O V3.2 recuou de US$ 0,3432 para US$ 0,3218, queda de 6%. Nenhum dos dois é corte de manchete, mas num modelo que já custava pouco, cada ponto percentual economizado vira dinheiro real no fim do mês quando o volume é grande.

Do outro lado, a MoonshotAI mexeu em três modelos — Kimi K2.6, Kimi K2.7 Code e Kimi Latest. As variações ficaram em 1% ou menos. Tecnicamente, o K2.6 até subiu um centavo na entrada: foi de US$ 0,65 para US$ 0,66 por milhão. São ajustes cosméticos, não decisão de mercado, e o usuário final provavelmente nem percebe no extrato.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.21.761.32-25%
DeepSeek V4 Flash 04230.180.168-7%
DeepSeek V3.20.34320.3218-6%
Kimi K2.63.413.410%
MoonshotAI Kimi Latest3.413.410%
Kimi K2.7 Code3.53.490%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Quem não aparece na lista diz mais do que quem aparece

A lista de hoje tem seis alterações e zero aumentos relevantes. Mais importante: nenhum modelo americano — nem Anthropic, nem OpenAI, nem SpaceXAI — entrou na dança. O Claude Fable 5, topo do catálogo de inteligência com IQ 62,073, continua a US$ 50 por milhão de tokens de saída. O GPT-5.6 Sol, segundo colocado, segue a US$ 10. O Grok 4.5 da SpaceXAI está em US$ 6. Os líderes do topo não se mexem, e isso não é acaso.

A conta é simples: quem está no topo cobra caro porque pode. O único jeito de forçar uma Anthropic ou uma OpenAI a reduzir o preço é alguém entregar uma fração decente da qualidade por uma fração muito menor do custo. É exatamente o que a Z.ai está tentando fazer com o GLM 5.2 — e o que a DeepSeek, no segmento de baixo custo, já faz há algum tempo.

O calendário pesa

O contexto ajuda a entender por que o movimento veio agora. O catálogo tem mais de 502 modelos, vindos de 63 criadores, com 37 lançamentos só nos últimos 30 dias. Em um mercado desse tamanho, ninguém consegue descansar. Os laboratórios chineses estão escolhendo preço como argumento de venda. Os americanos, por enquanto, não precisam — porque o topo do ranking de inteligência ainda é deles.

Para quem isso muda alguma coisa

Se você já roda o GLM 5.2 em produção, o recado é prático: revise o dashboard de billing hoje. A queda vale para os tokens consumidos a partir de agora, e ninguém te devolve o que já foi cobrado.

Se você usa Claude Sonnet 5 ou GPT-5.6 Sol como padrão, nada muda no seu extrato. Mas a queda abre uma porta nova: rodar parte do workload no GLM 5.2 e manter o topo só para as tarefas mais pesadas ficou mais barato. A estratégia de "modelo top para o crítico, modelo chinês para o resto" ganha atratividade a cada corte desse tipo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
GPT-5.6 Terra56.612
Grok 4.555.86
Claude Sonnet 555.310
Entre os 502 modelos disponíveis no catálogo nesta data.

Se você está comparando opções chinesas entre si, a Z.ai está agressiva. Se está avaliando custo-benefício entre fronteiras, a diferença entre o topo americano e o meio chinês só faz crescer.

Em uma frase

Quem roda GLM 5.2 em produção ganha 25% no output a partir de hoje; quem está nos topos americanos paga a mesma conta, mas ganha uma nova opção barata para workload secundário.

Perguntas frequentes

GLM 5.2 ficou mais barato a partir de quando?

A partir de 10 de julho de 2026. O novo preço vale para os tokens consumidos depois da virada do dia; o catálogo não publica reembolso retroativo.

Algum modelo americano ficou mais barato hoje?

Nenhum. Os seis modelos que mexeram em preço hoje são de laboratórios chineses (Z.ai, DeepSeek e MoonshotAI). O topo americano ficou parado.

Vale migrar do Claude Sonnet 5 para o GLM 5.2?

Depende do workload. O GLM 5.2 custa US$ 1,32 por milhão de tokens de saída contra US$ 10 do Sonnet 5, mas o topo do ranking de inteligência segue americano. Para tarefas críticas, teste antes de migrar.

Leia também