FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

GLM 5.2 quase quadruplica de preço num dia, e Z.ai já recua

Qwen3 Thinking também dobrou hoje; dos três cortes registrados, só um pesa de verdade

Redação FalaVIP IA 3 min de leitura
4,02xmaior salto do dia, na saída do GLM 5.2
US$ 3,04preço de saída por milhão de tokens do GLM 5.2 após o hike
US$ 1,20preço de saída por milhão do GPT-5.6 Luna, alternativa estável com IQ 52,3

Se você roda GLM 5.2 no piloto automático, dá uma olhada na fatura antes de agosto: o token de entrada quase quadruplicou em poucas horas — de US$ 0,2408 para US$ 0,9688 por milhão. O de saída subiu junto, de US$ 0,7568 para US$ 3,0448. É o maior salto do catálogo no dia 20 de julho de 2026. E o detalhe que muda tudo: a Z.ai voltou atrás no mesmo dia.

Um hike de 4x em duas etapas

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
GLM 5.20.75683.0448+302%
Qwen3 235B A22B Thinking 2501.4953+101%
GLM 53.152.55-19%
GLM 5.23.04482.992-2%
Kimi K2.7 Code3.83.75-1%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

A Z.ai mexeu no GLM 5.2 duas vezes nas últimas 24 horas. A primeira tacada multiplicou o preço de saída por 4,02 — o maior ratio do dia. Logo depois a empresa republicou a tabela: input de US$ 0,9688 para US$ 0,952, output de US$ 3,0448 para US$ 2,992. Diferença pequena no papel, mas ela confirma que o primeiro número foi publicado cedo demais.

Para quem usava GLM 5.2 a US$ 0,24 por milhão de input, a conta nova está em outro patamar. Em volume de produção, isso muda totalmente a economia de um chatbot ou de um pipeline de classificação rodando 24/7.

O Qwen Thinking também dobrou — e ninguém recuou

O segundo hike do dia foi no Qwen3 235B A22B Thinking 2507, o modelo raciocinante da Qwen. Input dobrou: de US$ 0,1495 para US$ 0,30. Output dobrou: de US$ 1,495 para US$ 3,00. Sem recuo — a marcação nova está valendo.

Variação do preço de saída (%)
GLM 5.2302Qwen3 235B A22B Thinking 250101GLM 5-19GLM 5.2-2Kimi K2.7 Code-1%

Modelos com sufixo "thinking" cobram caro porque geram cadeia de raciocínio antes da resposta. Se você estava usando o Qwen3 esperando um atalho barato, atualize a planilha antes do próximo ciclo de cobrança.

Três cortes que quase não existem

Do outro lado, três modelos tiveram redução. Só uma delas pesa de verdade:

  • Z.ai GLM 5: output caiu de US$ 3,15 para US$ 2,55. Input não mexeu. Corte real de 19% só na saída.
  • Z.ai GLM 5.2: ratio 0,98 — é o ajuste pós-hike descrito acima.
  • MoonshotAI Kimi K2.7 Code: caiu de US$ 0,85/3,80 para US$ 0,82/3,75. Variação de 1% no output.

Quem apostou nesses cortes como "promoção do dia" não vai economizar nada significativo — exceto quem já estava pagando caro pelo GLM 5 puro e ignora o GLM 5.2 novo.

O topo continua o mesmo — e isso é bom contexto

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Grok 4.555.86
Entre os 510 modelos disponíveis no catálogo nesta data.

No topo por inteligência hoje, o Claude Fable 5 segue em primeiro com IQ 62,073 e US$ 50 por milhão de saída — sem mexer no preço. Logo abaixo vêm GPT-5.6 Sol (IQ 60,93, US$ 10/M), Kimi K3 (IQ 59,699, US$ 15/M), GPT-5.6 Terra (US$ 12/M) e Grok 4.5 (US$ 6/M). Nenhum desses cinco líderes de IQ mudou de tabela hoje.

No nicho "barato e capaz" (acima de IQ 45), as opções estáveis são:

  • GPT-5.6 Luna (OpenAI): IQ 52,318 por US$ 1,20/M de saída.
  • MiniMax M3: IQ 45,397 por US$ 1,20/M de saída.
  • DeepSeek V4 Pro 0423: IQ 45,268 por US$ 1,74/M de saída.

Mesmo com Qwen e Z.ai reajustando para cima, dá para rodar modelos acima de IQ 45 entre US$ 1,20 e US$ 1,74 por milhão de tokens de saída. É o seguro de quem não quer acordar com a fatura trocada.

Para quem isso muda alguma coisa

Para quem usava GLM 5.2: a conta vai subir quase quatro vezes na saída. Teste migrar parte da carga para o GLM 5 "puro" (que teve output reduzido) ou para o GPT-5.6 Luna — IQ parecido, preço tabelado.

Para quem usava Qwen3 Thinking esperando economia: o atalho acabou. Compare US$ 3/M do Qwen com US$ 10/M do GPT-5.6 Sol antes de decidir se mantém a integração.

Para quem roda qualquer outro modelo do catálogo: nada muda hoje, mas o episódio é lembrete prático: preço não é atributo estável, e um mesmo modelo pode mudar de tabela duas vezes no mesmo dia.

Em uma frase

Trave o preço na chamada sempre que a API permitir e mantenha um fallback de preço tabelado (como o GPT-5.6 Luna, a US$ 1,20/M de saída) antes de fechar a próxima fatura.

Perguntas frequentes

O GLM 5.2 voltou ao preço antigo depois do recuo da Z.ai?

Não. O recuo foi só de US$ 0,9688 para US$ 0,952 no input e de US$ 3,0448 para US$ 2,992 no output. Em relação a ontem, o salto continua próximo de quatro vezes — o reposicionamento de tabela foi, na prática, uma correção do número publicado na primeira tacada.

Vale trocar o Qwen3 Thinking 2507 pelo GPT-5.6 Sol agora?

Depende do consumo de tokens. O Qwen Thinking custa US$ 3/M de saída hoje; o GPT-5.6 Sol custa US$ 10/M. Se a tarefa exige raciocínio pesado e o volume é baixo, a diferença absoluta pode ser tolerável; se é alto, a comparação tem que ser feita token a token, não só pelo preço por milhão.

Por que a Z.ai mexeu duas vezes no GLM 5.2 no mesmo dia?

Não dá para cravar o motivo com os dados públicos do catálogo. O padrão — publicar tabela com salto de 4x e republicar minutos depois com correção pequena — sugere ajuste publicado cedo demais, mas a empresa não emitiu nota sobre o episódio.

Leia também