FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

GLM-5.3 entra em 6º no índice cobrando 7x menos que Kimi K3

Modelo da chinesa Zhipu AI estreia com IQ 59.513 e US$ 2.15 por milhão de tokens de saída, preenchendo o espaço vago entre o topo caro e o barato funcional.

Redação FalaVIP IA 3 min de leitura
US$ 2.15por milhão de tokens de saída
IQ 59.513posição 6 no índice da Artificial Analysis
7xmais barato que Kimi K3 para IQ similar

O índice da Artificial Analysis ganhou hoje um novo ocupante no top 6: GLM-5.3 (max), da chinesa Zhipu AI, estreou com IQ 59.513 e preço de US$ 2.15 por milhão de tokens de saída. O número que chama atenção não é a posição no ranking — é o que ele cobra para chegar lá.

O vizinho de cima custa 7x mais

O modelo imediatamente acima no ranking é o Kimi K3, da MoonshotAI, com IQ 59.699 — basicamente empatado com o GLM-5.3 (diferença de 0.186 ponto). Só que o Kimi cobra US$ 15 por milhão de tokens de saída. São quase 7 vezes mais caro por uma inteligência quase idêntica.

Subindo mais um degrau, o Grok 4.6 (SpaceXAI) marca IQ 60.923 por US$ 6/M. Mesmo aí, o GLM-5.3 entrega quase 3x mais economia para uma diferença de 1.4 ponto de IQ. É o tipo de relação custo-benefício que faz o gerente financeiro questionar por que a empresa ainda está pagando US$ 15 no Kimi.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
GLM-5.3 (max)59.52.15

O que a régua mostra hoje

O topo do índice continua inalterado: Claude Opus 5 (IQ 63.053, US$ 25/M), Claude Fable 5 (62.073, US$ 50/M) e GPT-5.6 Sol (60.93, US$ 10/M). O GLM-5.3 se encaixa logo abaixo desse pódio, numa faixa onde cada ponto de IQ começa a ficar caro.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 552 modelos disponíveis no catálogo nesta data.

A faixa de IQ 59-61 é onde mora a disputa de custo-benefício real. Até hoje, quem queria inteligência nessa região tinha duas opções: pagar caro (Kimi, Grok) ou descer para IQ 51-52 com DeepSeek V4 Flash (US$ 0.18/M) ou GPT-5.6 Luna (US$ 1.20/M). O GLM-5.3 preenche o meio do caminho — e é exatamente esse meio que estava vazio no catálogo de 552 modelos.

O que muda na fatura

Para um workload de alto volume — sumarização de documentos, geração de código em massa, classificação em pipeline — o GLM-5.3 muda a conta de fechamento do mês. Um fluxo de 100 milhões de tokens de saída por mês sai por US$ 215 nele. No Kimi K3, a mesma conta fecha em US$ 1.500. No Grok 4.6, US$ 600.

Se o seu caso de uso tolera IQ 51-52, o DeepSeek V4 Flash continua imbatível a US$ 0.18/M — são 12x mais barato que o GLM-5.3 para uma diferença de 8 pontos de IQ. A pergunta que vale é: esses 8 pontos se traduzem em resultado melhor no seu produto, ou são overhead que você paga à toa?

Para quem vale e para quem não

Vale a pena testar o GLM-5.3 se você está na faixa de IQ 59+ e o custo do Kimi ou do Grok estava apertando o orçamento. É um swap direto: você troca de fornecedor sem mexer no pipeline, e a qualidade entregue deve ficar no mesmo patamar.

Não muda nada se você já está no DeepSeek V4 Flash (não há motivo para subir e pagar 12x mais) ou se precisa do topo absoluto — Claude Opus 5 e Claude Fable 5 são outra categoria de modelo, com preço à altura, e a diferença de 3-4 pontos de IQ aparece em tarefas agenticas longas e raciocínio multi-etapa.

O tabuleiro em agosto de 2026

A Zhipu AI entra num mercado onde a Anthropic domina o topo em preço, a OpenAI briga pelo segundo escalão e o DeepSeek domina o barato em volume. O GLM-5.3 ocupa um espaço que estava vago: inteligência de top 6 com preço de mid-tier. Os 42 modelos lançados nos últimos 30 dias no índice mostram que a corrida está longe de desacelerar — e que a próxima briga é exatamente quem entrega mais IQ por dólar.

Para o desenvolvedor que escolhe modelo todo mês, a lição é direta: antes de renovar o contrato com Kimi ou Grok, rode um teste cego com GLM-5.3 no seu caso de uso. Se a qualidade segurar, a economia aparece na próxima fatura.

Em uma frase

Antes de renovar contrato com Kimi ou Grok, rode um teste cego com GLM-5.3 no seu pipeline — se a qualidade segurar, a economia de 3x a 7x aparece na próxima fatura.

Perguntas frequentes

O que é o GLM-5.3?

É o modelo mais recente da chinesa Zhipu AI, que estreou no índice da Artificial Analysis em 19 de agosto de 2026 com IQ 59.513 e preço de US$ 2.15 por milhão de tokens de saída.

GLM-5.3 é melhor que Kimi K3?

Em inteligência, são praticamente empatados: 59.513 contra 59.699. A diferença real está no custo — o GLM-5.3 cobra US$ 2.15/M enquanto o Kimi K3 cobra US$ 15/M, uma economia de quase 7x.

Quando usar GLM-5.3 em vez de DeepSeek V4 Flash?

Use GLM-5.3 quando seu caso de uso exigir IQ acima de 59 e você estiver disposto a pagar 12x mais que o DeepSeek. Se IQ 51-52 resolve e o volume é altíssimo, o DeepSeek V4 Flash a US$ 0.18/M continua imbatível.

Leia também