GLM 5.2 cai até 43% e MiniMax M2.7 sobe 11% no mesmo dia
Cortes e aumentos no mesmo dia: o que isso faz com quem escolheu LLM só pelo preço.
Se você abriu o painel de custos hoje esperando só mais um dia de cortes generalizados, achou metade do que procurava. A Z.ai mexeu no GLM 5.2 em três faixas de uma vez — a mais barata, com queda de 43% no preço de saída. Ao mesmo tempo, a MiniMax subiu o M2.7 em 11%. É o tipo de dia em que a planilha muda sem você trocar de modelo.
O corte do dia
A Z.ai cortou o GLM 5.2 em três camadas no mesmo anúncio. A faixa mais barata — a entrada do modelo — saiu de US$ 0,3178 por milhão de tokens de entrada para US$ 0,182 (queda de 43% na entrada). A saída caiu na mesma proporção: de US$ 0,9988 para US$ 0,572 por milhão. As outras duas faixas também desceram, em 24% e 21%.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 0.9988 | 0.572 | -43% |
| GLM 5.2 | 1.3156 | 0.9988 | -24% |
| GLM 5.2 | 1.6676 | 1.3156 | -21% |
| MiniMax M2.7 | 1.08 | 1.2 | +11% |
| DeepSeek V3.2 | 0.4 | 0.38 | -5% |
| DeepSeek V3.2 | 0.38 | 0.4 | +5% |
| Inkling | 4.05 | 4.05 | 0% |
| DeepSeek V4 Flash Latest | 0.18 | 0.1792 | 0% |
O efeito prático: o GLM 5.2 na faixa mais barata agora cobra US$ 0,57 por milhão de tokens de saída. Para comparar, o DeepSeek V4 Flash, que lidera a lista dos mais baratos acima de IQ 45 no catálogo de mais de 530 modelos, cobra US$ 0,18. O GLM 5.2 não virou o mais barato da categoria — mas entrou no território em que cada projeto precisa comparar de novo antes de assumir que "barato é DeepSeek".
A contramão
Nem tudo caiu hoje. O MiniMax M2.7 foi na direção oposta: preço de entrada subiu de US$ 0,27 para US$ 0,30 por milhão, e o de saída foi de US$ 1,08 para US$ 1,20 — 11% nas duas pontas.
Pode parecer pouco, mas é o tipo de movimento que pega quem automatizou a escolha do modelo por preço e esqueceu de revisitar. E tem um detalhe que chama atenção: o M2.7 agora custa o mesmo, em saída, que o MiniMax M3 (US$ 1,20 por milhão). Dois modelos do mesmo criador, no mesmo preço de saída, em faixas de inteligência diferentes. Para quem já usa MiniMax, a pergunta é simples: vale pagar o mesmo para subir do M2.7 para o M3?
Movimentos pequenos que também mexem
O DeepSeek V3.2 oscilou. Primeiro caiu (entrada de US$ 0,269 para US$ 0,26; saída de US$ 0,40 para US$ 0,38), depois voltou quase ao valor anterior (entrada de volta para US$ 0,269; saída para US$ 0,40). Cinco por cento para cada lado — mais um ajuste fino do que uma mudança real.
A Thinking Machines cortou o Inkling em 5% na entrada (de US$ 1,00 para US$ 0,95 por milhão) e manteve a saída em US$ 4,05. Quem processa muito contexto de entrada sente; quem só cospe saída não vê diferença.
O DeepSeek V4 Flash — o mais barato acima de IQ 45 — também levou um corte mínimo: entrada de US$ 0,09 para US$ 0,0896; saída de US$ 0,18 para US$ 0,1792. Variação abaixo de meio centavo por milhão. Mais uma calibragem para manter a ponta do que uma mudança que chega na fatura.
Onde isso deixa o panorama
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| Qwen3.8 Max | 58.1 | 6 |
O topo por inteligência segue o mesmo de sempre — e segue caro. Claude Opus 5 a US$ 25 por milhão de saída; Claude Fable 5 a US$ 50; GPT-5.6 Sol a US$ 10; Kimi K3 a US$ 15; Qwen3.8 Max a US$ 6. Os cortes de hoje não mexeram nessa fila. O que mudou foi a faixa intermediária, onde mora a maioria das aplicações em produção.
Para dimensionar: cada milhão de tokens de saída no GLM 5.2 (faixa mais barata) sai por US$ 0,57. No Opus 5, sai por US$ 25. Um milhão no topo custa o mesmo que quase 44 milhões na faixa do GLM 5.2. O multiplicador entre andares continua brutal.
Para quem vale — e para quem não muda nada
Se você roda produção pesada com Z.ai ou cogitava rodar, vale revisar a faixa que está contratando; o corte foi grande o suficiente para reposicionar o modelo dentro da sua categoria. Se você escolheu MiniMax M2.7 por preço, vale conferir se a conta ainda fecha depois do aumento. Para quem usa Claude Opus ou qualquer modelo do topo da lista por inteligência, nada muda — o dia de hoje não foi sobre esse andar.
E para projetos pequenos, que gastam poucos milhões de tokens por mês, a variação na fatura é pequena demais para compensar o trabalho de migrar.
Revise a faixa de preço que está contratando hoje: Z.ai reposicionou o GLM 5.2 em três níveis e a MiniMax subiu o M2.7 — quem escolheu LLM só pelo menor preço pode estar apontando para o modelo errado.
Perguntas frequentes
Quanto caiu o GLM 5.2 hoje?
A Z.ai cortou o GLM 5.2 em três faixas no mesmo dia. Na faixa mais barata, a queda foi de 43% no preço de saída — de US$ 0,9988 para US$ 0,572 por milhão de tokens. As outras duas faixas caíram 24% e 21%.
Por que o MiniMax M2.7 subiu de preço?
Os dados do catálogo só registram a mudança, não o motivo. O M2.7 passou de US$ 1,08 para US$ 1,20 por milhão de tokens de saída (11% de aumento) e agora cobra o mesmo que o MiniMax M3.
O GLM 5.2 ficou mais barato que o DeepSeek?
Não. Mesmo na faixa mais barata após o corte, o GLM 5.2 cobra US$ 0,57 por milhão de tokens de saída. O DeepSeek V4 Flash, líder da lista dos mais baratos acima de IQ 45, cobra US$ 0,18. O GLM mudou de faixa, mas não virou o mais barato da categoria.