FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Z.ai lança GLM 5.2 a US$ 3 por milhão e entra no top 2 de IQ

Mesma semana teve três variantes do modelo, dois geradores de imagem do Google e mais três cortes de preço no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 3,036por milhão de tokens de saída no GLM 5.2 standard
IQ 52,641segunda maior nota do catálogo, atrás só do Claude Fable 5
US$ 50preço por milhão de tokens de saída do Claude Fable 5

US$ 3 por milhão de tokens de saída. Esse é o preço que o GLM 5.2 da Z.ai cobra pelo tier standard, lançado no dia 16 de junho. No mesmo dia, a empresa soltou a versão gratuita e a batch. Resultado: o mesmo modelo três vezes na sua timeline, três pontos de preço, e uma pergunta que vale a pena fazer antes de renovar o contrato com o seu fornecedor atual.

Lançamentos da semana por criador
z-ai3google2cohere1modelos

Três GLM, um único alvo

A estratégia da Z.ai não é sutil: oferecer o mesmo modelo em três pontos de preço diferentes para fisgar o desenvolvedor em cada etapa do pipeline. A versão gratuita entra como porta de entrada para prototipagem. A batch, a US$ 4,40 por milhão, é para quem roda processamento em massa e não liga se a resposta demora mais. E a padrão, a US$ 3,036, mira quem precisa de qualidade no caminho síncrono.

Mas a história que vai para a fatura é outra. O GLM 5.2 standard marca IQ 52,641 no catálogo de hoje — a segunda maior nota entre os mais de 475 modelos listados. Atrás dele, só o Claude Fable 5 da Anthropic, que custa US$ 50 por milhão de tokens de saída. Traduzindo o release em linguagem de boleto: para cada dólar gasto com Claude Fable 5, você roda aproximadamente 16 vezes mais tokens com GLM 5.2.

Lançamentos entre 2026-06-15 e 2026-06-21
DataModeloCriadorInteligênciaSaída US$/M
2026-06-16GLM 5.2 (batch)z-ai4.4
2026-06-16GLM 5.2z-ai52.63.036
2026-06-16GLM 5.2 (free)z-ai0
2026-06-17North Mini Code (free)cohere20.20
2026-06-18Nano Banana Pro (Gemini 3 Prgoogle12
2026-06-18Nano Banana 2 (Gemini 3.1 Flgoogle3

Onde isso coloca a Z.ai no tabuleiro

O GLM 5.2 aparece simultaneamente no top 5 de inteligência e na lista dos mais baratos acima de IQ 45 — ao lado do DeepSeek V4 Pro 0423 (US$ 1,74 por milhão) e do MiniMax M3 (US$ 1,20 por milhão). Nenhum dos modelos americanos de fronteira cabe nos dois rankings. Anthropic, Google e OpenAI dominam o topo de IQ, mas não aparecem na foto do custo.

Se o seu critério é razão inteligência por dólar gasto, a faixa chinesa — Z.ai, DeepSeek e MiniMax — virou o centro de gravidade do mercado. Os modelos americanos seguem cobrando o prêmio de marca.

Google responde pela porta da imagem

No mesmo período, a Google lançou dois modelos de geração de imagem no dia 18: o Nano Banana Pro (Gemini 3 Pro Image) a US$ 12 por milhão de tokens de saída, e o Nano Banana 2 (Gemini 3.1 Flash Image) a US$ 3 por milhão. O catálogo não publicou IQ para nenhum dos dois — o que é coerente, porque benchmarks de imagem costumam usar métricas próprias.

A diferença prática: o Pro é quatro vezes mais caro que o Flash. Se você está usando geração de imagem em produção e ainda não separou as chamadas por complexidade, está queimando dinheiro. Imagens rascunho no Flash, imagens finais no Pro.

Cohere, cortes de preço e o resto da semana

A Cohere entrou na semana com o North Mini Code gratuito, IQ 20,169 — um modelo pequeno para tarefas de código, claramente posicionado para competir no segmento free tier onde a própria Z.ai está atacando.

Além dos seis lançamentos, o catálogo registrou cinco mudanças de preço entre 15 e 21 de junho: três cortes e zero aumentos. A tendência de baixa continua firme. Nenhuma empresa americana subiu tabela nesta semana.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

O que muda na sua pilha

Se você está rodando produção com Claude, GPT ou Gemini top de linha e o orçamento começou a apertar, esta é a semana para testar GLM 5.2. A diferença de IQ para o Claude Fable 5 é de cerca de 9 pontos em uma escala onde scores acima de 50 já não diferenciam bem os modelos entre si — e a conta cai por um fator de 16. Não troque tudo de uma vez. Pegue o caso de uso menos crítico, meça, e só então mova o resto.

Se você trabalha com geração de imagem, separe Pro de Flash antes de aumentar volume. E se está prototipando código sem querer gastar, North Mini Code gratuito e GLM 5.2 gratuito são opções reais a partir desta semana.

A semana que terminou em 21 de junho de 2026 foi, no fim das contas, uma semana em que a distância de preço entre modelo de fronteira e modelo acessível caiu mais um degrau. A conta agradece, e o fornecedor americano que não se mexeu também precisa agradecer menos.

Em uma frase

Teste GLM 5.2 no seu caso de uso menos crítico antes de renovar contrato anual com modelo americano top de linha; a diferença de IQ não compensa a diferença de preço de 16x.

Perguntas frequentes

GLM 5.2 é melhor que Claude Fable 5?

Não. O Claude Fable 5 marca IQ 62,073 contra 52,641 do GLM 5.2 no catálogo de hoje. A comparação que importa para a fatura é outra: o GLM 5.2 standard custa US$ 3,036 por milhão de tokens de saída, contra US$ 50 do Claude Fable 5 — cerca de 16 vezes menos.

Qual a diferença entre GLM 5.2 batch e o padrão?

A versão batch (US$ 4,40 por milhão) é otimizada para processamento assíncrono em massa, com latência maior. A padrão (US$ 3,036 por milhão) roda de forma síncrona e entrega resposta imediata. Use batch para jobs em fila, padrão para chamadas em tempo real.

Os modelos Nano Banana servem só para imagem?

O catálogo desta semana não publicou IQ nem outras métricas além do preço para o Nano Banana Pro (US$ 12 por milhão) e o Nano Banana 2 (US$ 3 por milhão). Ambos foram lançados como modelos de geração de imagem pela Google, e benchmarks desse segmento costumam usar métricas próprias, fora do índice de QI geral.

Leia também