FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

GLM 5.1 da Z.ai sai a um quarto do preço do Codex

Catálogo lista o modelo a US$ 3 por milhão de tokens de saída, mas sem nota de inteligência publicada — você está comprando o release, não a régua.

Redação FalaVIP IA 3 min de leitura
US$ 3,036por milhão de tokens de saída
Quase 5xmais barato na saída que o GPT-5.3-Codex
204.800tokens de contexto

US$ 3,04 por milhão de tokens de saída: o que muda na sua fatura

O GLM 5.1 da Z.ai apareceu no catálogo hoje cobrando US$ 3,036 por milhão de tokens de saída. O número sozinho não diz nada — mas quando você coloca do lado de quem está cobrando mais caro para a mesma categoria de tarefa, a conversa muda. O Gemini 3.1 Pro Preview, da Google, sai por US$ 12 o milhão. O GPT-5.3-Codex, da OpenAI, sai por US$ 14. Na ponta que mais pesa — a saída, que é o que o seu agente cospe quando devolve a resposta — o GLM 5.1 fica quase quatro vezes mais barato que o Gemini e quase cinco vezes mais barato que o Codex.

Preço de saída (US$ por milhão de tokens)
Claude Opus 4.6 (Fast)150Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

A entrada também está barata: US$ 0,966 o milhão de tokens. E o cache — o que você paga para reaproveitar prompts em chamadas repetidas — está em US$ 0,1794. Em cargas de agente com prompt recorrente, o cache paga o almoço antes mesmo de a fatura chegar.

O release promete "salto em código". O catálogo ainda não tem nota.

A descrição oficial traz o que você já leu em outros lugares: "salto importante" em capacidade de código, ganho "especialmente significativo" em tarefas de longo horizonte, modelo que "trabalha de forma independente e contínua" em vez de interações curtas de minuto. É a narrativa padrão de quem quer vender agente.

O detalhe incômodo: o GLM 5.1 entra no catálogo sem índice de inteligência, sem benchmark de código e sem nota agentic publicada. Você não tem como comparar a régua, só o preço. Em um mercado onde o topo do ranking de inteligência tem 47,738 (Gemini 3.1 Pro) e 45,512 (GPT-5.3-Codex), o GLM 5.1 vira uma aposta — não uma troca direta.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 390 modelos disponíveis no catálogo nesta data.

O tabuleiro hoje

O catálogo tem 390 modelos neste momento, vindos de 54 criadores. Nos últimos 30 dias, 33 modelos foram lançados. O GLM 5.1 é mais um nessa fila, e o seu diferencial declarado — código de longo horizonte — entra em rota de colisão com dois concorrentes que também são vendidos como agentes: o Codex, segundo em inteligência, e o Gemini 3.1 Pro, na liderança.

Abaixo do topo, o MiMo-V2-Omni, da Xiaomi, já sai por US$ 2 o milhão de saída, com nota de inteligência em 35,866 — preço parecido com o do GLM 5.1, mas com régua já publicada.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Opus 4.6 (Fast) (o novo)301501M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale — e para quem não muda nada

Vale para você se a maior parte da sua conta de API é tokens de saída em agentes de código. Para 1 milhão de tokens de saída, a conta cai de US$ 14 no Codex para cerca de US$ 3 no GLM 5.1. Em volumes maiores, a diferença deixa de ser centavos.

Não muda nada para você se o seu cliente final exige nota verificada de inteligência, se o seu gargalo é raciocínio de fronteira em vez de geração, ou se a sua tarefa é curta e a diferença some no orçamento. Nesses casos, o mais barato continua sendo o Codex ou o Gemini — e a conversa não é preço, é confiança.

Ficha técnica — Claude Opus 4.6 (Fast)
CampoValor
Identificadoranthropic/claude-opus-4.6-fast
Criadoranthropic
Preço de entradaUS$ 30.00 / M tokens
Preço de saídaUS$ 150.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 3.00 / M (90% de desconto)

O que você faz com isso amanhã

Rode o seu benchmark interno em uma fração da sua carga. Não o do fornecedor. Meça duas coisas: qualidade da entrega final e economia real no fim do mês. Se passar nos dois, migra. Se não, o GLM 5.1 entra como plano B de baixo custo, e a fatura principal continua sendo paga para quem já tem nota publicada.

Em uma frase

Trate como aposta, não como troca: o preço é quase cinco vezes menor que o Codex, mas a nota de inteligência ainda não foi publicada — rode seu benchmark interno antes de migrar volume.

Perguntas frequentes

Quanto custa o GLM 5.1 da Z.ai?

US$ 0,966 por milhão de tokens de entrada, US$ 3,036 por milhão de tokens de saída e US$ 0,1794 por milhão em cache. É cerca de quatro vezes mais barato na saída que o Gemini 3.1 Pro Preview e quase cinco vezes mais barato que o GPT-5.3-Codex.

O GLM 5.1 já tem benchmark de inteligência?

Não no catálogo desta data. O índice de inteligência, a nota de código e a nota agentic não foram publicados. Você só consegue comparar pelo preço e pela descrição do fornecedor.

Para qual tipo de tarefa o GLM 5.1 foi feito?

Segundo a Z.ai, é voltado para agentes de código que trabalham por períodos longos de forma autônoma — a mesma categoria em que o Codex e o Gemini 3.1 Pro já competem, mas com nota verificada.

Leia também