GLM 5.1 da Z.ai entra a US$ 3 por milhão; falta o IQ
Modelo focado em agente de código chega a um quarto do preço do Gemini Pro e do GPT-5.3-Codex, mas sem nota de inteligência publicada no catálogo.
A 7 de abril, o catálogo soma mais um: o GLM 5.1, da Z.ai, entra cobrando US$ 3,04 por milhão de tokens de saída. Coloque esse número do lado do que os dois modelos acima de IQ 45 cobram hoje — US$ 12 no Gemini 3.1 Pro Preview, US$ 14 no GPT-5.3-Codex — e a conta fica óbvia. O GLM 5.1 custa cerca de um quarto do que o topo cobra na saída.
Mas tem um asterisco que ninguém deveria ignorar: o GLM 5.1 ainda não tem nota de inteligência publicada no catálogo. Não é que a nota seja ruim. É que ela simplesmente não foi divulgada — você não consegue, nesta data, colocar o GLM 5.1 no mesmo gráfico que o Gemini e o GPT pelo índice atual.
O que a ficha diz (e o que ela não diz)
A ficha é objetiva. Text-to-text, janela de 204.800 tokens (200K, padrão da categoria) e três preços por milhão de tokens:
- Entrada: US$ 0,966
- Saída: US$ 3,036
- Cache de leitura: US$ 0,1794
A descrição oficial enfatiza "salto em capacidade de código" e ganho em "tarefas de longo horizonte", com o detalhe-chave de que o modelo "trabalha de forma independente e contínua". Traduzindo: é um modelo pensado para rodar como agente, gastando tokens em loop, não para responder pergunta curta num chat.
Onde ele entra no tabuleiro de hoje
A régua de cima é dura. Pelo índice de inteligência atual, só dois modelos passam de IQ 45: o Gemini 3.1 Pro Preview (47,7) e o GPT-5.3-Codex (45,5). Os dois custam US$ 12 e US$ 14 por milhão de saída, respectivamente. O GLM 5.1 entra a US$ 3,04 — perto de um quarto do preço dos dois.
A régua de baixo também tem nomes. O MiMo-V2-Omni da Xiaomi sai a US$ 2 por milhão de saída, com IQ atual de 35,866. É mais barato que o GLM 5.1, mas numa faixa de capacidade diferente. Pelo preço de tabela, o GLM 5.1 senta entre os dois extremos: mais caro que o MiMo, muito mais barato que Gemini e GPT.
Para quem vale a troca (e para quem não muda)
Vale testar o GLM 5.1 agora se:
- Você roda agentes de código e a fatura de tokens de saída é o que mais dói no fim do mês. A US$ 3,04 contra US$ 12 ou US$ 14, a TCO muda quando o agente gasta tokens em loop.
- Você já mantém pipeline de avaliação próprio, porque a nota IQ não veio publicada — você vai ter que rodar benchmark na sua carga real.
- O caso de uso cabe em 200K de contexto e é text-to-text.
Não muda nada se:
- Você decide modelo por IQ publicado e esse é o seu filtro mínimo. Sem nota, o GLM 5.1 não passa nesse crivo por enquanto.
- Sua carga é multimodal (imagem, áudio, vídeo). A ficha marca text-to-text.
- Você já travou o stack em Gemini ou GPT e o custo do token não é o gargalo principal.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| GLM 5.1 (o novo) | — | 0.966 | 3.036 | 205k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
O fluxo do catálogo não para
Em 30 dias, 33 modelos novos entraram no catálogo. São 390 modelos ativos hoje, vindos de 54 criadores. A Z.ai aparece nesse fluxo com proposta agressiva de preço, sem abrir mão da janela de 200K. Mesmo que o IQ fique abaixo do topo do índice, a conta de custo-benefício fecha: a um quarto do preço do Gemini Pro Preview, o GLM 5.1 só precisa entregar fração da capacidade para empatar nessa régua.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O que fazer com isso amanhã
Se o custo de saída é a linha que dói na sua fatura, vale rodar uma avaliação curta do GLM 5.1 na sua carga real de agente — preço nesse patamar não aparece todo dia. Se você decide modelo por benchmark publicado, fica na lista de espera: a nota ainda não foi divulgada. De todo modo, a régua de preço da categoria acaba de descer.
Se a sua dor é o custo de saída do agente de código, vale rodar o GLM 5.1 numa carga controlada agora; se você decide por IQ publicado, espere a nota sair antes de migrar produção crítica.
Perguntas frequentes
O GLM 5.1 tem benchmark de inteligência publicado?
Não. O índice IQ do GLM 5.1 ainda não aparece no catálogo nesta data. Sem a nota, dá para comparar pelo preço, mas não dá para colocar lado a lado com o Gemini 3.1 Pro Preview ou o GPT-5.3-Codex na régua de capacidade.
Quanto custa o GLM 5.1 por milhão de tokens?
O catálogo lista US$ 0,966 por milhão de tokens de entrada, US$ 3,036 por milhão de saída e US$ 0,1794 por milhão de tokens lidos do cache. É text-to-text, com janela de 204.800 tokens.
Para que tipo de tarefa o GLM 5.1 foi feito?
A descrição oficial destaca salto em capacidade de código e ganho em tarefas de longo horizonte, com o modelo 'trabalhando de forma independente e contínua'. É um modelo pensado para rodar como agente, gastando tokens em loop, não para responder pergunta curta num chat.