FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

M2.7 da MiniMax zerou; GLM 5.2 da Z.ai subiu 58% no mesmo dia

Três mudanças em um único dia expõem como o preço de modelo de IA virou variável diária — e onde a conta de API dói mais.

Redação FalaVIP IA 3 min de leitura
US$ 0,00preço do M2.7 por milhão de tokens
+58%preço de saída do GLM 5.2 em 6 de julho
US$ 1,20preço do M3 por milhão de tokens de saída

De graça e mais caro no mesmo dia

Sabe aquela planilha de custo de API que você atualiza a cada trimestre? Hoje ela precisa de revisão. Em 6 de julho de 2026, três mudanças de preço foram registradas no catálogo: o M2.7 da MiniMax foi a zero em input e output, e o GLM 5.2 da Z.ai levou dois reajustes para cima em sequência, no mesmo dia.

Variação do preço de saída (%)
MiniMax M2.7-100GLM 5.232GLM 5.220%

O sinal é direto: preço de modelo virou variável diária. E o movimento de hoje mostra os dois extremos da mesa — o que some do orçamento e o que entra nele.

M2.7 da MiniMax: agora custa zero

A mudança mais barulhenta é também a mais simples. O M2.7 saiu de US$ 0,18 por milhão de tokens de entrada e US$ 0,72 por milhão de tokens de saída para US$ 0 nos dois lados. Corte de 100%.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
MiniMax M2.70.720-100%
GLM 5.22.1562.8556+32%
GLM 5.21.8042.156+20%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Na prática, qualquer chamada ao M2.7 deixa de aparecer na fatura. Para quem já usava, é dinheiro devolvido. Para quem olhava o modelo de longe por causa do preço, a barreira de entrada sumiu.

Tem um porém. O M2.7 não é o carro-chefe da MiniMax. O M3, da mesma casa, é o que aparece entre os mais baratos acima de IQ 45, a US$ 1,20 por milhão de tokens de saída. O M2.7 serve para tarefas mais simples, mas é outro produto.

Para quem vale: integrações em volume, classificadores, parsers, geração de rascunhos. Para quem não muda nada: quem mira em raciocínio pesado, em Sonnet 5, Gemini 3.1 Pro ou no próprio M3.

Z.ai GLM 5.2: dois reajustes no mesmo turno

Do outro lado, o GLM 5.2 da Z.ai — terceiro colocado em inteligência no catálogo de hoje — levou duas altas em sequência. Primeiro, o preço de saída saltou de US$ 1,804 para US$ 2,156 por milhão (alta de 20%). Horas depois, novo reajuste: de US$ 2,156 para US$ 2,8556 (mais 32%).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Claude Sonnet 555.310
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
Entre os 484 modelos disponíveis no catálogo nesta data.

Somando as duas batidas, o token de saída ficou 58% mais caro do que estava no começo do dia. O input acompanhou: saiu de US$ 0,574 para US$ 0,9086 por milhão — alta acumulada de 58% também.

É o tipo de movimento que pega quem deixou o modelo no pipeline de produção. Se a sua chamada típica é pesada em output — respostas longas, geração de código, agentes que escrevem muito — a conta de julho não vai parecer com a de junho.

Para quem vale a revisão imediata: qualquer equipe que roteirou agentes ou fluxos RAG com GLM 5.2 pensando nele como o chinês barato e competente. Ele continua competitivo, segue entre os mais baratos acima de IQ 45, mas o título de barato ficou mais caro.

O tabuleiro de hoje

Com o reajuste, o ranking dos mais baratos acima de IQ 45 fica assim: M3 da MiniMax em US$ 1,20 por milhão de tokens de saída, DeepSeek V4 Pro em US$ 1,74, e GLM 5.2 da Z.ai bem acima do que estava ontem.

O M3 virou o novo padrão barato para quem quer qualidade sem estourar orçamento. O DeepSeek V4 Pro continua como alternativa chinesa na mesma faixa. E o GLM 5.2, mesmo reajustado, ainda entrega um salto de IQ em relação aos dois: está em 52,6, contra 45,4 do M3 e 45,3 do DeepSeek V4 Pro.

A diferença de 7 pontos de IQ é o que justifica o preço mais alto. Mas o cálculo ficou mais apertado: vale pagar mais que o dobro por 7 pontos a mais de inteligência? Depende do que o seu agente está fazendo — geração de código pesado e raciocínio longo tendem a compensar; tarefas de extração e formatação, nem tanto.

O que fazer agora

Se você roda GLM 5.2 em produção, rode um teste A/B com o M3 da MiniMax e o DeepSeek V4 Pro antes de renovar qualquer commitment. O reajuste não foi pequeno, e a distância para os concorrentes diretos encurtou.

Se você queria testar o M2.7 sem compromisso financeiro, hoje é o dia. Custo de experimentação zerou — e o único custo agora é o tempo de integração.

E se você mantém dashboard de custo de API, configure alerta de variação diária de preço. Não é mais coisa que muda uma vez por trimestre.

Em uma frase

Se você roda GLM 5.2 em produção, faça benchmark contra o M3 da MiniMax e o DeepSeek V4 Pro antes do próximo ciclo — o reajuste de hoje encostou os três concorrentes diretos.

Perguntas frequentes

Por que o M2.7 da MiniMax ficou de graça?

O motivo não foi divulgado. O fato é o que importa: o preço foi de US$ 0,18 por milhão de tokens de entrada e US$ 0,72 de saída para zero nos dois lados. O M3, modelo mais novo da mesma casa, segue pago a US$ 1,20 por milhão de tokens de saída.

Quanto subiu exatamente o GLM 5.2 da Z.ai?

O GLM 5.2 recebeu dois reajustes no mesmo dia, somando 58% de alta no preço de saída — de US$ 1,804 para US$ 2,8556 por milhão de tokens. O input acompanhou na mesma proporção, de US$ 0,574 para US$ 0,9086 por milhão.

Qual é o modelo mais barato hoje acima de IQ 45?

O M3 da MiniMax lidera a faixa, a US$ 1,20 por milhão de tokens de saída. Em segundo vem o DeepSeek V4 Pro, a US$ 1,74. O GLM 5.2 da Z.ai, mesmo após o reajuste, segue em terceiro lugar nessa faixa e mantém IQ mais alto (52,6) que os dois anteriores.

Leia também