FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GLM 5.2 grátis: o que você realmente leva por zero dólares

A versão free do modelo chinês mais barato acima de IQ 45 parece boa no preço — mas a economia existe de verdade ou é só isca?

Redação FalaVIP IA 3 min de leitura
US$ 0preço por milhão de tokens de entrada e saída
256ktokens de contexto
US$ 3,036por milhão de tokens na versão paga do GLM 5.2

Seis dias depois de aparecer no catálogo, o GLM 5.2 free já é a curiosidade mais clicada da semana. E o motivo é óbvio: o preço de tabela é zero. Em ambos os lados — entrada e saída. Sem asterisco miúdo no anúncio, sem "primeiro milhão grátis". Zero.

A pergunta que interessa, porém, é outra. Você troca o que?

O que o gratuito realmente é

O GLM 5.2 free é a mesma família do GLM 5.2 pago da Z.ai, lançado na mesma onda. Mesma origem chinesa, mesmo contexto de 256 mil tokens, mesma proposta de uso: raciocínio longo, agentes que rodam por horas, engenharia de software em escala de projeto. O que muda é só a conta no fim do mês — que, no free, não existe.

Para dimensionar o que isso significa na prática, olha o vizinho pago da lista: o GLM 5.2 completo custa US$ 3,036 por milhão de tokens de saída. É o terceiro colocado em inteligência no catálogo de hoje, com IQ 52,641, atrás só do Claude Fable 5 e à frente dos Gemini 3.1 Pro Preview e 3.5 Flash da Google. Não é um modelo qualquer disfarçado de brinde.

Onde o free entra no tabuleiro

Olha o recorte de modelos acima de IQ 45 mais baratos do catálogo nesta data. O ranking é claro: o MiniMax M3 lidera a US$ 1,20 por milhão de saída, o DeepSeek V4 Pro 0423 vem a US$ 1,74, e o GLM 5.2 pago aparece em terceiro a US$ 3,036. O free, por definição, entra abaixo de todos — no zero absoluto.

O detalhe que ninguém comenta: o catálogo tem hoje 475 modelos de 61 criadores, e 28 deles foram lançados nos últimos 30 dias. O free do GLM 5.2 está nesse bolo de novidades, mas é o único entre os três mais baratos com nota de inteligência acima de 52. Os outros dois — MiniMax M3 e DeepSeek V4 Pro — ficam na casa dos 45. É uma diferença relevante quando o trabalho envolve cadeia de raciocínio longa, não só completar frase.

Ficha técnica — GLM 5.2 (batch)
CampoValor
Identificadorz-ai/glm-5.2:batch
Criadorz-ai
Preço de entradaUS$ 1.40 / M tokens
Preço de saídaUS$ 4.40 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.260 / M (81% de desconto)
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Para quem vale — e para quem não muda nada

Vale para você se: está prototipando um agente que vai rodar muitas chamadas em sequência, precisa de contexto grande sem estourar o orçamento, ou quer testar a família GLM 5.2 antes de colocar em produção. Um workflow de agente que consome 500 mil tokens de saída por dia custa, no pago, quase US$ 1.500 por mês. No free, custa o tempo que você gasta configurando.

Não muda nada para você se: já roda em volume na API paga de outro modelo acima de IQ 50 e a conta cabe no orçamento. O free tem limitações típicas de tier gratuito — fila, rate limit, sem SLA — que tornam produção séria arriscada. Também não muda nada se você precisa de multimodalidade: o GLM 5.2 é text-to-text, ponto. Imagem, áudio, vídeo, procure em outro lugar.

E tem um porém honesto: a Z.ai não publicou nota de IQ, coding ou agentic especificamente para a versão free. Os números de benchmark que você vê circulando são do modelo pago. Na prática, a versão gratuita costuma entregar menos — e é razoável esperar o mesmo aqui.

O que fazer com isso

Se você está pagando caro por contexto longo em modelo chinês, teste o GLM 5.2 free esta semana em uma tarefa não-crítica. Meça latência, taxa de erro e qualidade de raciocínio. Se o resultado for próximo do pago, a economia é imediata: você não precisa mais daquela linha na fatura. Se for pior do que o esperado, você gastou algumas horas e zero dólares para descobrir — o que também é um resultado válido.

A versão paga continua sendo a referência da família. O free é a porta de entrada.

Em uma frase

Rode uma tarefa não-crítica no GLM 5.2 free antes de renovar qualquer contrato de API com modelo chinês de contexto longo — se a qualidade for próxima da versão paga, a economia aparece no mesmo mês.

Perguntas frequentes

O GLM 5.2 free tem os mesmos 256k tokens de contexto da versão paga?

Sim, segundo os dados do catálogo a janela de contexto é a mesma: 256 mil tokens. O que pode variar entre as versões é rate limit, latência e, na prática, a qualidade efetiva do raciocínio.

Posso usar o GLM 5.2 free em produção?

Não é recomendável. Tier gratuito costuma trazer fila, rate limit agressivo e sem SLA. Use para prototipar, testar e validar — não para servir usuário final em escala.

O GLM 5.2 free é multimodal?

Não. A ficha do catálogo registra modalidade text-to-text. Para entrada de imagem, áudio ou vídeo, você precisa de outro modelo.

Leia também