FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Muse Spark 1.2 estreia no índice com IQ 54 e Ling-3.0-flash cobra US$ 0,11

Dois modelos entraram hoje na régua do Artificial Analysis: um mira o meio do ranking, o outro disputa centavo por milhão de token.

Redação FalaVIP IA 3 min de leitura
IQ 54,068Muse Spark 1.2 (xhigh) no índice
US$ 2,00por milhão de tokens de saída do Muse Spark 1.2
US$ 0,11125por milhão de tokens de saída do Ling-3.0-flash

Dois recém-chegados, dois jogos diferentes

O índice do Artificial Analysis ganhou hoje dois novos inquilinos, e eles não estão jogando o mesmo jogo. O Muse Spark 1.2 (xhigh) aterriza com IQ 54,068 — bem no meio do ranking, longe do topo ocupado pelo Claude Opus 5 (63,053) e à frente de boa parte do catálogo. O Ling-3.0-flash entra com IQ 37,379, abaixo da régua dos 45 que separa os modelos "úteis" dos experimentais, mas cobra US$ 0,11125 por milhão de tokens de saída. É o tipo de preço que faz você olhar duas vezes antes de descartar.

Índice de inteligência das estreias
Muse Spark 1.2 (xhigh)54,1Ling-3.0-flash37,4índice

O que o IQ 54 realmente significa

Em um catálogo com 531 modelos listados hoje, o IQ 54 coloca o Muse Spark 1.2 numa faixa intermediária disputada. Não é top 5 — o topo segue com Anthropic (Claude Opus 5 e Claude Fable 5) e OpenAI (GPT-5.6 Sol), todos acima de 60. Também não é fundo de tabela: ele se senta entre o DeepSeek V4 Flash 0731 (IQ 51,767) e o GPT-5.6 Luna (52,318), dois modelos que muita gente já usa em produção por causa do custo.

A pergunta que você deve fazer antes de testar é: para qual tarefa esse meio de tabela basta? Resposta curta — classificação, extração, sumarização de texto não-crítico, geração de rascunho. Resposta longa — qualquer coisa em que um erro a cada dez respostas não te custa um cliente.

A conta que ninguém gosta de fazer

O Muse Spark 1.2 cobra US$ 2,00 por milhão de tokens de saída. Compare com o que está logo acima dele no ranking: o Claude Opus 5 cobra US$ 25 pelo mesmo milhão. É doze vezes mais barato para um IQ cerca de 9 pontos menor. Já o Ling-3.0-flash, a US$ 0,11125 por milhão, sai por menos de 1% do preço do Opus 5 — mas com IQ 37,379, está 26 pontos atrás do líder.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Muse Spark 1.2 (xhigh)54.12.00
Ling-3.0-flash37.40.11

Aqui entra a analogia que vale guardar: o índice de inteligência funciona como nota de prova, e o preço funciona como hora extra paga ao professor. Você não contrata o mais caro para corrigir prova de múltipla escolha, nem o mais barato para avaliar redação de vestibular. O meio-termo muitas vezes é o custo-benefício real.

Para quem isso muda alguma coisa

Para quem roda agente de客服 ou classificador em massa, o Ling-3.0-flash entra como opção de triagem: barato o suficiente para descartar sem dó quando o modelo tropeça, inteligente o suficiente para pegar padrões simples. Não substitui um modelo de topo em raciocínio, mas não é esse o papel dele.

Para quem busca substituir um modelo intermediário pago — tipo o GPT-5.6 Luna, que cobra US$ 1,20 pelo milhão de saída —, o Muse Spark 1.2 cobra mais (US$ 2,00) e entrega IQ parecido (54 contra 52). Não é troca óbvia. Mas se a sua fila de tarefas exige um pouco mais de qualidade e o orçamento ainda comporta, vale rodar lado a lado.

Para quem já está no topo do ranking, nada muda. Claude Opus 5, Claude Fable 5 e GPT-5.6 Sol continuam sendo a referência, e a diferença de IQ para o meio de tabela não se resolve com centavos.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
Qwen3.8 Max58.16
Entre os 531 modelos disponíveis no catálogo nesta data.

O tabuleiro hoje

Em 6 de agosto de 2026, o topo do índice segue firme com a Anthropic e a OpenAI. O catálogo soma 531 modelos de 67 criadores diferentes, e 45 deles foram lançados nos últimos 30 dias — o ritmo de estreia continua alto. O fato de dois modelos entrarem na régua no mesmo dia e em faixas tão distintas mostra que o mercado não está convergindo para um só perfil de produto: tem espaço para quem busca nota alta, tem espaço para quem busca preço baixo, e tem cada vez mais espaço para quem busca o meio termo.

O que você faz com isso amanhã

Se o seu pipeline consome mais de cem milhões de tokens de saída por mês, rode o Ling-3.0-flash numa rota de fallback para tarefas simples e meça a economia real antes de promover qualquer modelo para produção. Se você está avaliando trocar o intermediário atual, coloque o Muse Spark 1.2 no mesmo batch de testes do seu incumbente — IQ parecido não significa comportamento parecido. E se a sua decisão de compra passa por nota no índice, lembre: o catálogo é um piso, não um retrato exato, e modelos removidos depois não aparecem mais na régua.

Em uma frase

Dois modelos estrearam hoje em faixas opostas: o Muse Spark 1.2 compete no meio de tabela a US$ 2/M, e o Ling-3.0-flash entra na faixa dos centavistas a US$ 0,11/M — vale testar o segundo como fallback de baixo custo antes de gastar com o primeiro.

Perguntas frequentes

O que é o índice do Artificial Analysis?

É um ranking público que mede inteligência e preço de modelos de linguagem. Hoje lista 531 modelos de 67 criadores, e a nota de IQ é a medição atual — não histórica. Modelos removidos deixam de aparecer no catálogo.

Muse Spark 1.2 ou GPT-5.6 Luna: qual escolher?

O Muse Spark 1.2 tem IQ um pouco maior (54,068 contra 52,318), mas custa mais: US$ 2,00 por milhão de tokens de saída contra US$ 1,20 do Luna. A decisão depende se a diferença de ~2 pontos de IQ no seu caso de uso compensa pagar 67% a mais.

Ling-3.0-flash serve para produção?

Serve para tarefas de baixa complexidade — triagem, classificação simples, extração de campos — onde o custo por token domina a decisão. Com IQ 37,379, está abaixo da régua de 45 que separa modelos "úteis" dos experimentais, então não use para raciocínio crítico.

Leia também