FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

GLM 5.1 da Z.ai entra a US$ 3 por milhão; falta o IQ

Modelo focado em agente de código chega a um quarto do preço do Gemini Pro e do GPT-5.3-Codex, mas sem nota de inteligência publicada no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 3,04por milhão de tokens de saída
204.800tokens de contexto
≈4×mais barato que o topo do catálogo na saída

A 7 de abril, o catálogo soma mais um: o GLM 5.1, da Z.ai, entra cobrando US$ 3,04 por milhão de tokens de saída. Coloque esse número do lado do que os dois modelos acima de IQ 45 cobram hoje — US$ 12 no Gemini 3.1 Pro Preview, US$ 14 no GPT-5.3-Codex — e a conta fica óbvia. O GLM 5.1 custa cerca de um quarto do que o topo cobra na saída.

Mas tem um asterisco que ninguém deveria ignorar: o GLM 5.1 ainda não tem nota de inteligência publicada no catálogo. Não é que a nota seja ruim. É que ela simplesmente não foi divulgada — você não consegue, nesta data, colocar o GLM 5.1 no mesmo gráfico que o Gemini e o GPT pelo índice atual.

O que a ficha diz (e o que ela não diz)

A ficha é objetiva. Text-to-text, janela de 204.800 tokens (200K, padrão da categoria) e três preços por milhão de tokens:

  • Entrada: US$ 0,966
  • Saída: US$ 3,036
  • Cache de leitura: US$ 0,1794

A descrição oficial enfatiza "salto em capacidade de código" e ganho em "tarefas de longo horizonte", com o detalhe-chave de que o modelo "trabalha de forma independente e contínua". Traduzindo: é um modelo pensado para rodar como agente, gastando tokens em loop, não para responder pergunta curta num chat.

Preço de saída (US$ por milhão de tokens)
GLM 5.13,036Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

Onde ele entra no tabuleiro de hoje

A régua de cima é dura. Pelo índice de inteligência atual, só dois modelos passam de IQ 45: o Gemini 3.1 Pro Preview (47,7) e o GPT-5.3-Codex (45,5). Os dois custam US$ 12 e US$ 14 por milhão de saída, respectivamente. O GLM 5.1 entra a US$ 3,04 — perto de um quarto do preço dos dois.

A régua de baixo também tem nomes. O MiMo-V2-Omni da Xiaomi sai a US$ 2 por milhão de saída, com IQ atual de 35,866. É mais barato que o GLM 5.1, mas numa faixa de capacidade diferente. Pelo preço de tabela, o GLM 5.1 senta entre os dois extremos: mais caro que o MiMo, muito mais barato que Gemini e GPT.

Índice de inteligência (Artificial Analysis)
Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

Para quem vale a troca (e para quem não muda)

Vale testar o GLM 5.1 agora se:

  • Você roda agentes de código e a fatura de tokens de saída é o que mais dói no fim do mês. A US$ 3,04 contra US$ 12 ou US$ 14, a TCO muda quando o agente gasta tokens em loop.
  • Você já mantém pipeline de avaliação próprio, porque a nota IQ não veio publicada — você vai ter que rodar benchmark na sua carga real.
  • O caso de uso cabe em 200K de contexto e é text-to-text.

Não muda nada se:

  • Você decide modelo por IQ publicado e esse é o seu filtro mínimo. Sem nota, o GLM 5.1 não passa nesse crivo por enquanto.
  • Sua carga é multimodal (imagem, áudio, vídeo). A ficha marca text-to-text.
  • Você já travou o stack em Gemini ou GPT e o custo do token não é o gargalo principal.
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
GLM 5.1 (o novo)0.9663.036205k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O fluxo do catálogo não para

Em 30 dias, 33 modelos novos entraram no catálogo. São 390 modelos ativos hoje, vindos de 54 criadores. A Z.ai aparece nesse fluxo com proposta agressiva de preço, sem abrir mão da janela de 200K. Mesmo que o IQ fique abaixo do topo do índice, a conta de custo-benefício fecha: a um quarto do preço do Gemini Pro Preview, o GLM 5.1 só precisa entregar fração da capacidade para empatar nessa régua.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 390 modelos disponíveis no catálogo nesta data.

O que fazer com isso amanhã

Se o custo de saída é a linha que dói na sua fatura, vale rodar uma avaliação curta do GLM 5.1 na sua carga real de agente — preço nesse patamar não aparece todo dia. Se você decide modelo por benchmark publicado, fica na lista de espera: a nota ainda não foi divulgada. De todo modo, a régua de preço da categoria acaba de descer.

Em uma frase

Se a sua dor é o custo de saída do agente de código, vale rodar o GLM 5.1 numa carga controlada agora; se você decide por IQ publicado, espere a nota sair antes de migrar produção crítica.

Perguntas frequentes

O GLM 5.1 tem benchmark de inteligência publicado?

Não. O índice IQ do GLM 5.1 ainda não aparece no catálogo nesta data. Sem a nota, dá para comparar pelo preço, mas não dá para colocar lado a lado com o Gemini 3.1 Pro Preview ou o GPT-5.3-Codex na régua de capacidade.

Quanto custa o GLM 5.1 por milhão de tokens?

O catálogo lista US$ 0,966 por milhão de tokens de entrada, US$ 3,036 por milhão de saída e US$ 0,1794 por milhão de tokens lidos do cache. É text-to-text, com janela de 204.800 tokens.

Para que tipo de tarefa o GLM 5.1 foi feito?

A descrição oficial destaca salto em capacidade de código e ganho em tarefas de longo horizonte, com o modelo 'trabalhando de forma independente e contínua'. É um modelo pensado para rodar como agente, gastando tokens em loop, não para responder pergunta curta num chat.

Leia também