Meta cobra US$ 4,25 por milhão de tokens no Muse Spark 1.2 — vale o preço?
Modelo de raciocínio multimodal da Meta chega com 1 milhão de tokens de contexto e preço intermediário, mas fica abaixo do top 3 de inteligência do catálogo.
A Meta entrou na prateleira dos modelos de raciocínio nesta terça-feira (5) com o Muse Spark 1.2, e a primeira pergunta que aparece quando você abre a tabela de preços não é sobre o que ele faz — é sobre o que ele custa. A saída sai por US$ 4,25 por milhão de tokens, a entrada por US$ 1,25, e o cache (respostas reutilizadas) por míseros US$ 0,15. É uma conta intermediária: não é barato como os modelos chineses, mas está longe do topo de mercado.
O que o Muse Spark 1.2 entrega
O modelo é descrito pela Meta como voltado a "tarefas agentic complexas" — fluxos em que o agente precisa planejar, chamar ferramentas e tomar decisões em sequência. Aceita texto, imagem, vídeo, áudio e PDF, devolve só texto, e roda com 1.048.576 tokens de contexto, o tal "1M" que virou padrão entre os modelos premium. É raciocínio de verdade, não um modelo comum com prompt incrementado.
No índice de inteligência da Artificial Analysis, o Muse Spark 1.2 marca 56,76. É um número respeitável, mas que precisa de contexto.
Onde ele se encaixa no tabuleiro
Olhando o topo do catálogo hoje, o Claude Opus 5 lidera com 63,05 e custa US$ 25 por milhão de tokens de saída. O Claude Fable 5 vem logo atrás com 62,07 e US$ 50. O GPT-5.6 Sol, da OpenAI, marca 60,93 e sai por US$ 10. O Muse Spark 1.2 entra abaixo dos três, mas com uma diferença importante: custa menos da metade do GPT-5.6 Sol e quase seis vezes menos que o Opus 5.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Muse Spark 1.2 (o novo) | 56.8 | 1.25 | 4.25 | 1.05M |
| Claude Opus 5 | 63.1 | 5 | 25 | 1M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| GPT-5.6 Sol | 60.9 | 2 | 10 | 1.05M |
| DeepSeek V4 Flash 0731 | 51.8 | 0.065 | 0.18 | 1.31M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
Em outras palavras: você não está comprando o melhor do mercado, está comprando algo entre o pelotão intermediário e o topo, com um preço mais amigável. Para quem roda agente em produção e precisa multimodal, esse intervalo é exatamente onde mora a maioria das decisões reais.
A conta do cache muda o jogo?
O dado mais curioso da ficha é o preço de cache: US$ 0,15 por milhão de tokens. Em workloads agentic, parte relevante das chamadas repete trechos de prompt (instruções de sistema, contexto longo, definições de ferramentas). Quando isso acontece, você paga essa fração. Comparado aos US$ 4,25 da saída cheia, é uma diferença de quase 28 vezes — e isso muda a conta em fluxos com muito reuso.
Para quem vale e para quem não muda nada
Vale para quem precisa de multimodal nativo (texto, imagem, áudio, vídeo, PDF num único endpoint) e roda agente com prompt repetitivo, onde o cache come uma fatia grande do custo. Vale também para quem está no ecossistema Meta e quer manter o stack dentro do mesmo fornecedor.
Não muda nada para quem já está feliz com o GPT-5.6 Sol ou com o Claude Opus 5 e não tem razão específica para trocar. E, se a busca for por custo-benefício puro, o DeepSeek V4 Flash 0731 segue marcando 51,77 de IQ por US$ 0,18 de saída — quase 24 vezes mais barato que o Muse Spark 1.2, com um índice de inteligência cerca de 5 pontos menor. Para tarefas que não exigem o topo, a conta chinesa ainda é difícil de bater.
| Campo | Valor |
|---|---|
| Identificador | meta/muse-spark-1.2 |
| Criador | meta |
| Preço de entrada | US$ 1.25 / M tokens |
| Preço de saída | US$ 4.25 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.150 / M (88% de desconto) |
| Índice de inteligência (AA) | 56.8 |
| Índice de código | 72.2 |
| Índice agêntico | 49.3 |
| Pesos | fechados |
| Velocidade de saída | 184 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
O cenário mais amplo
O catálogo agora soma mais de 530 modelos ativos de 67 criadores, e 46 deles foram lançados nos últimos 30 dias. O mercado de raciocínio multimodal premium está ficando denso: Anthropic, OpenAI e Meta competem no mesmo intervalo de IQ, com preços que variam quase 6 vezes entre si. A escolha deixou de ser "qual é o melhor" e virou "qual é o melhor para o seu padrão de uso".
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| Qwen3.8 Max | 58.1 | 6 |
Se você roda agente multimodal e o cache é uma fatia relevante do seu custo, faça a conta com o Muse Spark 1.2 antes de renovar o contrato com o topo de mercado. Se o seu uso é mais simples, o DeepSeek V4 Flash continua sendo a referência de eficiência — e nenhum lançamento de hoje muda isso.
Antes de renovar contrato com o topo do mercado, simule seu workload agentic no Muse Spark 1.2 — o cache a US$ 0,15 pode derrubar a conta em fluxos com prompt repetitivo, mas se o seu uso é simples, o DeepSeek V4 Flash segue imbatível em custo por ponto de inteligência.
Perguntas frequentes
Quanto custa o Muse Spark 1.2 da Meta?
A saída custa US$ 4,25 por milhão de tokens, a entrada US$ 1,25 e o cache US$ 0,15 por milhão. É um preço intermediário: mais barato que Claude Opus 5 e GPT-5.6 Sol, mas quase 24 vezes mais caro na saída que o DeepSeek V4 Flash 0731.
O Muse Spark 1.2 é melhor que o GPT-5.6 Sol?
Não. No índice de inteligência da Artificial Analysis, o Muse Spark 1.2 marca 56,76 contra 60,93 do GPT-5.6 Sol. A vantagem do Muse está no preço (cerca de metade) e no cache muito mais barato para workloads agentic.
O Muse Spark 1.2 aceita imagem, áudio e vídeo?
Sim. Segundo a ficha do catálogo, ele aceita texto, imagem, vídeo, áudio e PDF, e devolve apenas texto. É um modelo multimodal nativo, com 1 milhão de tokens de contexto.