GLM 5.1 da Z.ai sai a um quarto do preço do Codex
Catálogo lista o modelo a US$ 3 por milhão de tokens de saída, mas sem nota de inteligência publicada — você está comprando o release, não a régua.
US$ 3,04 por milhão de tokens de saída: o que muda na sua fatura
O GLM 5.1 da Z.ai apareceu no catálogo hoje cobrando US$ 3,036 por milhão de tokens de saída. O número sozinho não diz nada — mas quando você coloca do lado de quem está cobrando mais caro para a mesma categoria de tarefa, a conversa muda. O Gemini 3.1 Pro Preview, da Google, sai por US$ 12 o milhão. O GPT-5.3-Codex, da OpenAI, sai por US$ 14. Na ponta que mais pesa — a saída, que é o que o seu agente cospe quando devolve a resposta — o GLM 5.1 fica quase quatro vezes mais barato que o Gemini e quase cinco vezes mais barato que o Codex.
A entrada também está barata: US$ 0,966 o milhão de tokens. E o cache — o que você paga para reaproveitar prompts em chamadas repetidas — está em US$ 0,1794. Em cargas de agente com prompt recorrente, o cache paga o almoço antes mesmo de a fatura chegar.
O release promete "salto em código". O catálogo ainda não tem nota.
A descrição oficial traz o que você já leu em outros lugares: "salto importante" em capacidade de código, ganho "especialmente significativo" em tarefas de longo horizonte, modelo que "trabalha de forma independente e contínua" em vez de interações curtas de minuto. É a narrativa padrão de quem quer vender agente.
O detalhe incômodo: o GLM 5.1 entra no catálogo sem índice de inteligência, sem benchmark de código e sem nota agentic publicada. Você não tem como comparar a régua, só o preço. Em um mercado onde o topo do ranking de inteligência tem 47,738 (Gemini 3.1 Pro) e 45,512 (GPT-5.3-Codex), o GLM 5.1 vira uma aposta — não uma troca direta.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O tabuleiro hoje
O catálogo tem 390 modelos neste momento, vindos de 54 criadores. Nos últimos 30 dias, 33 modelos foram lançados. O GLM 5.1 é mais um nessa fila, e o seu diferencial declarado — código de longo horizonte — entra em rota de colisão com dois concorrentes que também são vendidos como agentes: o Codex, segundo em inteligência, e o Gemini 3.1 Pro, na liderança.
Abaixo do topo, o MiMo-V2-Omni, da Xiaomi, já sai por US$ 2 o milhão de saída, com nota de inteligência em 35,866 — preço parecido com o do GLM 5.1, mas com régua já publicada.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Opus 4.6 (Fast) (o novo) | — | 30 | 150 | 1M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
Para quem vale — e para quem não muda nada
Vale para você se a maior parte da sua conta de API é tokens de saída em agentes de código. Para 1 milhão de tokens de saída, a conta cai de US$ 14 no Codex para cerca de US$ 3 no GLM 5.1. Em volumes maiores, a diferença deixa de ser centavos.
Não muda nada para você se o seu cliente final exige nota verificada de inteligência, se o seu gargalo é raciocínio de fronteira em vez de geração, ou se a sua tarefa é curta e a diferença some no orçamento. Nesses casos, o mais barato continua sendo o Codex ou o Gemini — e a conversa não é preço, é confiança.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.6-fast |
| Criador | anthropic |
| Preço de entrada | US$ 30.00 / M tokens |
| Preço de saída | US$ 150.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 3.00 / M (90% de desconto) |
O que você faz com isso amanhã
Rode o seu benchmark interno em uma fração da sua carga. Não o do fornecedor. Meça duas coisas: qualidade da entrega final e economia real no fim do mês. Se passar nos dois, migra. Se não, o GLM 5.1 entra como plano B de baixo custo, e a fatura principal continua sendo paga para quem já tem nota publicada.
Trate como aposta, não como troca: o preço é quase cinco vezes menor que o Codex, mas a nota de inteligência ainda não foi publicada — rode seu benchmark interno antes de migrar volume.
Perguntas frequentes
Quanto custa o GLM 5.1 da Z.ai?
US$ 0,966 por milhão de tokens de entrada, US$ 3,036 por milhão de tokens de saída e US$ 0,1794 por milhão em cache. É cerca de quatro vezes mais barato na saída que o Gemini 3.1 Pro Preview e quase cinco vezes mais barato que o GPT-5.3-Codex.
O GLM 5.1 já tem benchmark de inteligência?
Não no catálogo desta data. O índice de inteligência, a nota de código e a nota agentic não foram publicados. Você só consegue comparar pelo preço e pela descrição do fornecedor.
Para qual tipo de tarefa o GLM 5.1 foi feito?
Segundo a Z.ai, é voltado para agentes de código que trabalham por períodos longos de forma autônoma — a mesma categoria em que o Codex e o Gemini 3.1 Pro já competem, mas com nota verificada.