FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Muse Spark 1.1 estreia a US$ 2 com IQ 50; GLM-5.2 fica abaixo da régua

Os dois modelos que entraram hoje no Artificial Analysis. Um compete na faixa dos mais baratos com IQ acima de 50; o outro cobra mais caro e pontua menos que alternativas abaixo de US$ 2.

Redação FalaVIP IA 3 min de leitura
US$ 2,00por milhão de tokens de saída do Muse Spark 1.1
IQ 34índice do GLM-5.2 — abaixo da régua dos 45
US$ 1,20preço dos mais baratos acima de IQ 45

Dois modelos entraram hoje no índice do Artificial Analysis, num catálogo que já passa de 500 opções e viu 37 lançamentos nos últimos 30 dias. As duas estreias de hoje servem quase como uma aula de leitura de régua: uma dá para levar a sério, a outra precisa de muita explicação para fazer sentido.

Índice de inteligência das estreias
Muse Spark 1.1 (xhigh)50,6GLM-5.2 (Non-reasoning)34,1índice

Muse Spark 1.1: barato, competente, mas não o mais barato

O Muse Spark 1.1 (xhigh) cravou IQ 50.623 a US$ 2 por milhão de tokens de saída. É um número decente: fica entre o GPT-5.6 Luna (IQ 52.318) e o MiniMax M3 (IQ 45.397), as duas referências de custo-benefício do momento.

Mas tem um "porém". Os três modelos mais baratos acima de IQ 45 hoje são:

  • MiniMax M3 — IQ 45.397, US$ 1,20/M
  • OpenAI GPT-5.6 Luna — IQ 52.318, US$ 1,20/M
  • DeepSeek V4 Pro 0423 — IQ 45.268, US$ 1,74/M

O Muse Spark 1.1 custa US$ 2/M. Mais caro que os três. Então, qual é a vantagem? Em tese, um perfil de capacidade diferente, ou preferência por um fornecedor específico. Sem mais dados públicos, é difícil cravar.

Para quem vale: equipes que testaram os três mais baratos e não gostaram do resultado, ou que precisam de uma capacidade específica que esses modelos não entregam. Para quem não muda nada: quem já está rodando o Luna ou o M3 e está satisfeito.

GLM-5.2 (Non-reasoning): paga mais, leva menos

A estreia mais difícil de justificar hoje é a do GLM-5.2 (Non-reasoning). IQ 34.052 a US$ 3,1625 por milhão de tokens de saída.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Muse Spark 1.1 (xhigh)50.62.00
GLM-5.2 (Non-reasoning)34.13.16

O número de IQ coloca o modelo abaixo da régua dos 45 pontos — a mesma régua que filtra a lista dos "mais baratos acima de IQ 45". Isso não quer dizer que o GLM-5.2 é inútil, mas significa que ele não compete na prateleira que a maioria dos desenvolvedores consulta primeiro.

E o preço? Está mais caro que o MiniMax M3 (US$ 1,20/M), o GPT-5.6 Luna (US$ 1,20/M) e o DeepSeek V4 Pro (US$ 1,74/M). Os três passam dos 45 pontos de IQ. O GLM-5.2 não passa e custa mais.

Para quem vale: provavelmente para cargas muito específicas onde um modelo não-reasoning a esse preço resolva — por exemplo, classificação em lote onde você quer evitar o overhead de raciocínio e não precisa de alta qualidade. Para quem não muda nada: para a maioria dos casos onde IQ importa, o catálogo oferece opções melhores e mais baratas.

O topo segue intocado

Enquanto isso, o topo do índice não se mexeu. Anthropic Claude Fable 5 lidera com IQ 62.073 a US$ 50/M; OpenAI GPT-5.6 Sol vem logo atrás com IQ 60.93 a US$ 10/M; GPT-5.6 Terra completa o pódio com IQ 56.576 a US$ 12/M.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
GPT-5.6 Terra56.612
Grok 4.555.86
Claude Sonnet 555.310
Entre os 502 modelos disponíveis no catálogo nesta data.

São preços de outra prateleira. Nenhum dos dois estreantes de hoje entra nesse grupo — e nem deveria. A pergunta de hoje é outra: dá para competir na faixa dos US$ 1 a US$ 3 por milhão? A resposta do Muse Spark 1.1 é "sim, com ressalvas". A do GLM-5.2 é "não deste jeito".

O que fazer com a estreia de hoje

Se você roda pipeline em escala e olha a fatura todo mês, a estreia de hoje não muda seu modelo padrão. O GPT-5.6 Luna continua sendo o melhor IQ por dólar do catálogo (IQ 52.318 a US$ 1,20/M). O Muse Spark 1.1 entra como mais uma opção na faixa dos US$ 2, mas precisa provar que entrega algo que os três mais baratos não entregam — e, pelo índice de hoje, isso não está demonstrado.

O GLM-5.2, no estado atual da régua, é uma estreia que só faz sentido para um perfil de uso muito específico. Se você não tem esse perfil, ignore.

Em uma frase

Se sua prioridade é custo, o GPT-5.6 Luna continua sendo o melhor IQ por dólar do catálogo; o Muse Spark 1.1 entra como mais uma opção na faixa dos US$ 2, mas o GLM-5.2 só compensa em casos muito específicos.

Perguntas frequentes

Muse Spark 1.1 vale mais a pena que o GPT-5.6 Luna?

Não pelo índice de hoje. O Luna tem IQ 52.318 a US$ 1,20/M; o Muse Spark 1.1 tem IQ 50.623 a US$ 2/M — você paga cerca de 67% a mais por um IQ um pouco menor. O Muse só vence se entregar um perfil de capacidade que o Luna não entrega.

O que significa o GLM-5.2 estar abaixo de IQ 45?

É a linha de corte usada pela lista dos modelos "úteis para produção". Não quer dizer que o GLM-5.2 é inútil, mas significa que ele não aparece na prateleira que a maioria dos desenvolvedores consulta primeiro — e custa US$ 3,16/M, mais caro que os três acima da régua.

Qual é o modelo com melhor IQ por dólar hoje?

Pelo índice, é o GPT-5.6 Luna: IQ 52.318 a US$ 1,20 por milhão de tokens de saída. O MiniMax M3 vem logo atrás em preço, com IQ 45.397 pelo mesmo valor.

Leia também