Muse Spark 1.2 estreia no índice com IQ 54 e Ling-3.0-flash cobra US$ 0,11
Dois modelos entraram hoje na régua do Artificial Analysis: um mira o meio do ranking, o outro disputa centavo por milhão de token.
Dois recém-chegados, dois jogos diferentes
O índice do Artificial Analysis ganhou hoje dois novos inquilinos, e eles não estão jogando o mesmo jogo. O Muse Spark 1.2 (xhigh) aterriza com IQ 54,068 — bem no meio do ranking, longe do topo ocupado pelo Claude Opus 5 (63,053) e à frente de boa parte do catálogo. O Ling-3.0-flash entra com IQ 37,379, abaixo da régua dos 45 que separa os modelos "úteis" dos experimentais, mas cobra US$ 0,11125 por milhão de tokens de saída. É o tipo de preço que faz você olhar duas vezes antes de descartar.
O que o IQ 54 realmente significa
Em um catálogo com 531 modelos listados hoje, o IQ 54 coloca o Muse Spark 1.2 numa faixa intermediária disputada. Não é top 5 — o topo segue com Anthropic (Claude Opus 5 e Claude Fable 5) e OpenAI (GPT-5.6 Sol), todos acima de 60. Também não é fundo de tabela: ele se senta entre o DeepSeek V4 Flash 0731 (IQ 51,767) e o GPT-5.6 Luna (52,318), dois modelos que muita gente já usa em produção por causa do custo.
A pergunta que você deve fazer antes de testar é: para qual tarefa esse meio de tabela basta? Resposta curta — classificação, extração, sumarização de texto não-crítico, geração de rascunho. Resposta longa — qualquer coisa em que um erro a cada dez respostas não te custa um cliente.
A conta que ninguém gosta de fazer
O Muse Spark 1.2 cobra US$ 2,00 por milhão de tokens de saída. Compare com o que está logo acima dele no ranking: o Claude Opus 5 cobra US$ 25 pelo mesmo milhão. É doze vezes mais barato para um IQ cerca de 9 pontos menor. Já o Ling-3.0-flash, a US$ 0,11125 por milhão, sai por menos de 1% do preço do Opus 5 — mas com IQ 37,379, está 26 pontos atrás do líder.
| Modelo | Índice de inteligência | Preço combinado US$/M |
|---|---|---|
| Muse Spark 1.2 (xhigh) | 54.1 | 2.00 |
| Ling-3.0-flash | 37.4 | 0.11 |
Aqui entra a analogia que vale guardar: o índice de inteligência funciona como nota de prova, e o preço funciona como hora extra paga ao professor. Você não contrata o mais caro para corrigir prova de múltipla escolha, nem o mais barato para avaliar redação de vestibular. O meio-termo muitas vezes é o custo-benefício real.
Para quem isso muda alguma coisa
Para quem roda agente de客服 ou classificador em massa, o Ling-3.0-flash entra como opção de triagem: barato o suficiente para descartar sem dó quando o modelo tropeça, inteligente o suficiente para pegar padrões simples. Não substitui um modelo de topo em raciocínio, mas não é esse o papel dele.
Para quem busca substituir um modelo intermediário pago — tipo o GPT-5.6 Luna, que cobra US$ 1,20 pelo milhão de saída —, o Muse Spark 1.2 cobra mais (US$ 2,00) e entrega IQ parecido (54 contra 52). Não é troca óbvia. Mas se a sua fila de tarefas exige um pouco mais de qualidade e o orçamento ainda comporta, vale rodar lado a lado.
Para quem já está no topo do ranking, nada muda. Claude Opus 5, Claude Fable 5 e GPT-5.6 Sol continuam sendo a referência, e a diferença de IQ para o meio de tabela não se resolve com centavos.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| Qwen3.8 Max | 58.1 | 6 |
O tabuleiro hoje
Em 6 de agosto de 2026, o topo do índice segue firme com a Anthropic e a OpenAI. O catálogo soma 531 modelos de 67 criadores diferentes, e 45 deles foram lançados nos últimos 30 dias — o ritmo de estreia continua alto. O fato de dois modelos entrarem na régua no mesmo dia e em faixas tão distintas mostra que o mercado não está convergindo para um só perfil de produto: tem espaço para quem busca nota alta, tem espaço para quem busca preço baixo, e tem cada vez mais espaço para quem busca o meio termo.
O que você faz com isso amanhã
Se o seu pipeline consome mais de cem milhões de tokens de saída por mês, rode o Ling-3.0-flash numa rota de fallback para tarefas simples e meça a economia real antes de promover qualquer modelo para produção. Se você está avaliando trocar o intermediário atual, coloque o Muse Spark 1.2 no mesmo batch de testes do seu incumbente — IQ parecido não significa comportamento parecido. E se a sua decisão de compra passa por nota no índice, lembre: o catálogo é um piso, não um retrato exato, e modelos removidos depois não aparecem mais na régua.
Dois modelos estrearam hoje em faixas opostas: o Muse Spark 1.2 compete no meio de tabela a US$ 2/M, e o Ling-3.0-flash entra na faixa dos centavistas a US$ 0,11/M — vale testar o segundo como fallback de baixo custo antes de gastar com o primeiro.
Perguntas frequentes
O que é o índice do Artificial Analysis?
É um ranking público que mede inteligência e preço de modelos de linguagem. Hoje lista 531 modelos de 67 criadores, e a nota de IQ é a medição atual — não histórica. Modelos removidos deixam de aparecer no catálogo.
Muse Spark 1.2 ou GPT-5.6 Luna: qual escolher?
O Muse Spark 1.2 tem IQ um pouco maior (54,068 contra 52,318), mas custa mais: US$ 2,00 por milhão de tokens de saída contra US$ 1,20 do Luna. A decisão depende se a diferença de ~2 pontos de IQ no seu caso de uso compensa pagar 67% a mais.
Ling-3.0-flash serve para produção?
Serve para tarefas de baixa complexidade — triagem, classificação simples, extração de campos — onde o custo por token domina a decisão. Com IQ 37,379, está abaixo da régua de 45 que separa modelos "úteis" dos experimentais, então não use para raciocínio crítico.