FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Z.ai lança GLM 5 a US$ 1,92 por milhão, mas sem benchmark de IQ

Modelo estreia mirando workflow agentic de longo prazo para programador sênior, mas o catálogo só publicou o preço — IQ, código e agentic seguem em branco.

Redação FalaVIP IA 3 min de leitura
US$ 1,92por milhão de tokens de saída
US$ 0,60por milhão de tokens de entrada
US$ 0,12por milhão de tokens em cache

A Z.ai colocou no ar hoje o GLM 5, definido pelo próprio catálogo como "flagship open-source foundation model" voltado a "complex systems design" e "long-horizon agent workflows" — em bom português, tarefas que atravessam vários dias e exigem o modelo lembrar do que combinou na etapa anterior. Pense numa reforma de apartamento que leva três meses, com etapas encadeadas, em vez de uma troca de torneira de uma tarde. A descrição diz ainda que foi construído para "expert developers" e entrega "production-grade performance on large-scale programming tasks" — é a Z.ai mirando programador sênior, não hobbyista de fim de semana.

Ficha técnica — GLM 5
CampoValor
Identificadorz-ai/glm-5
Criadorz-ai
Preço de entradaUS$ 0.600 / M tokens
Preço de saídaUS$ 1.92 / M tokens
Janela de contexto205k
Modalidadetext->text
Leitura de cacheUS$ 0.120 / M (80% de desconto)

Só que tem um porém grande. O índice de inteligência do catálogo? Vazio. Benchmark de código? Vazio. Benchmark agentic? Vazio. Num catálogo que hoje lista mais de 330 modelos, isso significa que você não tem régua independente dizendo onde o GLM 5 se encaixa no tabuleiro. Você vai pagar caro (ou barato, depende do comparativo) sem saber exatamente o que está levando. Isso não é defeito do modelo — modelos recém-listados costumam entrar assim — mas é o que você precisa saber antes de trocar de fornecedor amanhã.

O preço no tabuleiro de 11 de fevereiro

Olhando o topo do mercado hoje, o GLM 5 entra nesta paisagem:

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 332 modelos disponíveis no catálogo nesta data.

Em IQ e em dólar por milhão de tokens de saída, a história se conta sozinha. Em apenas 30 dias, 18 modelos novos entraram no catálogo — e mesmo nesse ritmo de trocas, o GLM 5 chega com preço no meio do caminho. A US$ 1,92 por milhão de saída, fica mais barato que o OpenAI o3 (US$ 8) e o Claude Haiku 4.5 (US$ 5) — os dois modelos com IQ mais próximo do topo. Mas custa mais de seis vezes o Xiaomi MiMo-V2-Flash (US$ 0,30), que lidera o ranking de inteligência do catálogo, e mais de 11 vezes o OpenAI gpt-oss-120b (US$ 0,17). A janela de contexto de 204.800 tokens (200K) entra no padrão atual — nada excepcional, nada defasado.

A leitura honesta: o preço posiciona o GLM 5 como "quase-frontier, mas sem a fatura do frontier". Se entregar o que a descrição promete, é negócio. Se não entregar, é gasto de teste que não compensa repetir.

Para quem faz sentido — e para quem não muda nada

Vale olhar de perto se você:

  • Roda workflows agentic longos, com etapas encadeadas, onde o modelo precisa manter coerência por horas.
  • Já paga caro em frontier (o3, Haiku 4.5) e quer testar alternativa open-source com a mesma ambição.
  • Tem equipe de dev capaz de rodar e ajustar pesos — o modelo é descrito como open-source, então auto-hospedagem entra no radar.

Não muda nada para você se:

  • Sua carga é raciocínio pontual (uma pergunta, uma resposta) — o MiMo-V2-Flash entrega topo de IQ por US$ 0,30 e provavelmente é a escolha mais racional até o catálogo medir o GLM 5.
  • Você otimiza cada centavo da fatura — o gpt-oss-120b a US$ 0,17 segue como referência de custo baixo.
  • Precisa de régua independente antes de mexer em produção. Volte daqui a duas semanas, quando o catálogo provavelmente vai ter IQ, coding e agentic preenchidos.

O que fazer com isso amanhã de manhã

Se você roda agente em produção, separe um dia para teste fechado: pegue o workflow mais longo que você tem, rode em o3 ou Haiku 4.5 (sua baseline cara) e rode o mesmo pipeline no GLM 5 via API. Meça qualidade da entrega final, não velocidade. Se chegar perto e a fatura prevista cair, vale a troca. Se ficar abaixo, o catálogo logo te entrega o número que falta — e aí a conversa muda de preço para desempenho.

Em uma frase

Sem benchmark publicado, o GLM 5 só vale o teste para quem já roda workflow agentic longo e está disposto a gastar um dia medindo antes de migrar — quem precisa de régua pronta espera duas semanas.

Perguntas frequentes

Quanto custa usar o GLM 5 da Z.ai?

Os preços listados no catálogo hoje são US$ 0,60 por milhão de tokens de entrada, US$ 1,92 por milhão de tokens de saída e US$ 0,12 por milhão para cache de leitura. Não há tier gratuito publicado.

O GLM 5 já tem benchmark de IQ ou de código?

Não no catálogo desta data. A entrada do GLM 5 está com índice de inteligência, benchmark de código e benchmark agentic em branco. Modelos recém-listados costumam receber essas medições nas semanas seguintes — o que existe por enquanto é a descrição do próprio fornecedor.

GLM 5 é open-source e dá para rodar local?

A descrição do catálogo o apresenta como "flagship open-source foundation model", mas o campo open_weights do catálogo está vazio para esta entrada. Antes de planejar auto-hospedagem, vale checar o release oficial da Z.ai para confirmar licença, pesos e requisitos de hardware.

Leia também