GLM 5.2 grátis: o que você realmente leva por zero dólares
A versão free do modelo chinês mais barato acima de IQ 45 parece boa no preço — mas a economia existe de verdade ou é só isca?
Seis dias depois de aparecer no catálogo, o GLM 5.2 free já é a curiosidade mais clicada da semana. E o motivo é óbvio: o preço de tabela é zero. Em ambos os lados — entrada e saída. Sem asterisco miúdo no anúncio, sem "primeiro milhão grátis". Zero.
A pergunta que interessa, porém, é outra. Você troca o que?
O que o gratuito realmente é
O GLM 5.2 free é a mesma família do GLM 5.2 pago da Z.ai, lançado na mesma onda. Mesma origem chinesa, mesmo contexto de 256 mil tokens, mesma proposta de uso: raciocínio longo, agentes que rodam por horas, engenharia de software em escala de projeto. O que muda é só a conta no fim do mês — que, no free, não existe.
Para dimensionar o que isso significa na prática, olha o vizinho pago da lista: o GLM 5.2 completo custa US$ 3,036 por milhão de tokens de saída. É o terceiro colocado em inteligência no catálogo de hoje, com IQ 52,641, atrás só do Claude Fable 5 e à frente dos Gemini 3.1 Pro Preview e 3.5 Flash da Google. Não é um modelo qualquer disfarçado de brinde.
Onde o free entra no tabuleiro
Olha o recorte de modelos acima de IQ 45 mais baratos do catálogo nesta data. O ranking é claro: o MiniMax M3 lidera a US$ 1,20 por milhão de saída, o DeepSeek V4 Pro 0423 vem a US$ 1,74, e o GLM 5.2 pago aparece em terceiro a US$ 3,036. O free, por definição, entra abaixo de todos — no zero absoluto.
O detalhe que ninguém comenta: o catálogo tem hoje 475 modelos de 61 criadores, e 28 deles foram lançados nos últimos 30 dias. O free do GLM 5.2 está nesse bolo de novidades, mas é o único entre os três mais baratos com nota de inteligência acima de 52. Os outros dois — MiniMax M3 e DeepSeek V4 Pro — ficam na casa dos 45. É uma diferença relevante quando o trabalho envolve cadeia de raciocínio longa, não só completar frase.
| Campo | Valor |
|---|---|
| Identificador | z-ai/glm-5.2:batch |
| Criador | z-ai |
| Preço de entrada | US$ 1.40 / M tokens |
| Preço de saída | US$ 4.40 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.260 / M (81% de desconto) |
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GLM 5.2 | 52.6 | 3.036 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
Para quem vale — e para quem não muda nada
Vale para você se: está prototipando um agente que vai rodar muitas chamadas em sequência, precisa de contexto grande sem estourar o orçamento, ou quer testar a família GLM 5.2 antes de colocar em produção. Um workflow de agente que consome 500 mil tokens de saída por dia custa, no pago, quase US$ 1.500 por mês. No free, custa o tempo que você gasta configurando.
Não muda nada para você se: já roda em volume na API paga de outro modelo acima de IQ 50 e a conta cabe no orçamento. O free tem limitações típicas de tier gratuito — fila, rate limit, sem SLA — que tornam produção séria arriscada. Também não muda nada se você precisa de multimodalidade: o GLM 5.2 é text-to-text, ponto. Imagem, áudio, vídeo, procure em outro lugar.
E tem um porém honesto: a Z.ai não publicou nota de IQ, coding ou agentic especificamente para a versão free. Os números de benchmark que você vê circulando são do modelo pago. Na prática, a versão gratuita costuma entregar menos — e é razoável esperar o mesmo aqui.
O que fazer com isso
Se você está pagando caro por contexto longo em modelo chinês, teste o GLM 5.2 free esta semana em uma tarefa não-crítica. Meça latência, taxa de erro e qualidade de raciocínio. Se o resultado for próximo do pago, a economia é imediata: você não precisa mais daquela linha na fatura. Se for pior do que o esperado, você gastou algumas horas e zero dólares para descobrir — o que também é um resultado válido.
A versão paga continua sendo a referência da família. O free é a porta de entrada.
Rode uma tarefa não-crítica no GLM 5.2 free antes de renovar qualquer contrato de API com modelo chinês de contexto longo — se a qualidade for próxima da versão paga, a economia aparece no mesmo mês.
Perguntas frequentes
O GLM 5.2 free tem os mesmos 256k tokens de contexto da versão paga?
Sim, segundo os dados do catálogo a janela de contexto é a mesma: 256 mil tokens. O que pode variar entre as versões é rate limit, latência e, na prática, a qualidade efetiva do raciocínio.
Posso usar o GLM 5.2 free em produção?
Não é recomendável. Tier gratuito costuma trazer fila, rate limit agressivo e sem SLA. Use para prototipar, testar e validar — não para servir usuário final em escala.
O GLM 5.2 free é multimodal?
Não. A ficha do catálogo registra modalidade text-to-text. Para entrada de imagem, áudio ou vídeo, você precisa de outro modelo.