FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiMo-V2.5-Pro custa 17 vezes menos que Claude Sonnet 4.6 e lidera em inteligência

Mesmo assim, o Sonnet mantém dois trunfos que o modelo chinês ainda não entrega.

Redação FalaVIP IA 3 min de leitura
US$ 0,87 vs US$ 15por milhão de tokens de saída
42,88 vs 35,11índice de inteligência
11xdiferença no preço blended

US$ 15 contra US$ 0,87 por milhão de tokens de saída. Essa é a diferença que aparece na fatura se você trocar Claude Sonnet 4.6 pelo MiMo-V2.5-Pro, da Xiaomi, hoje. São 17 vezes menos — e aqui não estamos falando de um modelo chinês "barato mas fraco": o índice consolidado de inteligência coloca o MiMo em 42,88, contra 35,11 do Sonnet. Você paga mais caro e leva um modelo com nota menor. O senso comum diz que premium é melhor; os números deste catálogo dizem o contrário.

Inteligência: onde dá pra comparar, a Xiaomi lidera

Em coding, o MiMo-V2.5-Pro marca 60,19. Em agentic, 29,53. O catálogo registra o Sonnet 4.6 com dado não publicado nessas duas categorias. O índice geral já coloca o modelo chinês quase oito pontos acima; a Anthropic não expôs números que pudessem ampliar essa distância.

Índice de inteligência (Artificial Analysis)
MiMo-V2.5-Pro42,9Claude Sonnet 4.635,1índice
Fonte: Artificial Analysis

Para situar no tabuleiro: o topo do catálogo nesta data é o Gemini 3.1 Pro Preview (47,74), seguido por GPT-5.3-Codex (45,51) e DeepSeek V4 Pro (45,27). O MiMo-V2.5-Pro aparece em quarto lugar — acima de qualquer modelo da Anthropic listado hoje.

O preço, traduzido sem release

O anúncio do Sonnet fala em "modelo Sonnet mais capaz até hoje". A conta fala outra coisa. Por milhão de tokens, o MiMo cobra US$ 0,435 de entrada e US$ 0,87 de saída, com cache a US$ 0,0036. O Sonnet cobra US$ 3 de entrada, US$ 15 de saída, US$ 0,30 de cache. No preço blended — uso típico combinando entrada e saída — são US$ 0,54 contra US$ 6. Uma diferença de 11 vezes.

Preço de saída (US$ por milhão de tokens)
MiMo-V2.5-Pro0,87Claude Sonnet 4.615US$/M
Fonte: OpenRouter

Traduzindo em volume: uma startup queimando 100 milhões de tokens de saída por mês paga US$ 87 com o MiMo e US$ 1.500 com o Sonnet pelo mesmo trabalho. Em seis meses, são cerca de US$ 8.500 de economia — o custo de um desenvolvedor pleno no Brasil.

O que o Claude ainda faz melhor

Duas coisas, e nenhuma é a inteligência bruta. A primeira é multimodalidade: o Sonnet 4.6 aceita texto, imagem e arquivo; o MiMo é text-to-text puro. Se o seu pipeline precisa ler PDF, screenshot de tela ou foto de produto, o Anthropic continua sendo a escolha. A segunda é velocidade: 41,37 tokens por segundo contra 34,05 do MiMo — uma diferença de cerca de 20% que pesa em chat ao vivo, não em batch noturno.

Peso aberto: o argumento que o boleto não mostra

O MiMo-V2.5-Pro tem 1.023 bilhões de parâmetros totais, com 42 bilhões ativos (arquitetura MoE, mistura de especialistas), e é open weights. Você baixa, ajusta, roda no seu próprio cluster. O Sonnet 4.6 é fechado: consome via API, sem opção de inspecionar pesos ou fazer fine-tune. Para empresas de saúde, jurídico ou financeiro que precisam de soberania de dados, essa diferença muda a equação inteira — não só a linha do custo por token.

MiMo-V2.5-Pro × Claude Sonnet 4.6
CritérioMiMo-V2.5-ProClaude Sonnet 4.6
Índice de inteligência42.935.1
Entrada US$/M0.4353
Saída US$/M0.8715
Contexto1.05M1M
Pesos abertossimnão
Velocidade (tok/s)3441
Índice de código60.2
Índice agêntico29.5

A escolha, sem "depende"

Use o MiMo-V2.5-Pro para tudo que é texto puro: geração de código, sumarização, extração, classificação, agentes que só leem e escrevem texto. É mais barato, mais inteligente no índice geral, ajustável e hospedável em casa. Use o Claude Sonnet 4.6 quando a entrada for multimodal ou quando a latência de chat ao vivo justificar o preço premium — lembrando que você está pagando caro pela multimodalidade, não pela inteligência.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 443 modelos disponíveis no catálogo nesta data.
Em uma frase

Para texto puro, migre chamadas para o MiMo-V2.5-Pro e corte até 17 vezes o custo de saída; só mantenha o Claude Sonnet 4.6 onde a entrada for imagem, arquivo ou a latência de chat for inegociável.

Perguntas frequentes

MiMo-V2.5-Pro é melhor que Claude Sonnet 4.6?

No índice geral de inteligência desta data, sim: 42,88 contra 35,11, com preço de saída 17 vezes menor. A superioridade do Claude está em multimodalidade (aceita imagem e arquivo) e em velocidade bruta — não em capacidade de raciocínio geral medida pelo catálogo.

Por que o Claude Sonnet 4.6 custa 17 vezes mais caro por token de saída?

O preço de US$ 15 por milhão de tokens de saída reflete o posicionamento premium da Anthropic e o custo de manter entrada multimodal (imagem e arquivo) que o MiMo-V2.5-Pro não oferece. É o preço da multimodalidade e da marca, não da inteligência — o índice geral diz o contrário.

Posso rodar o MiMo-V2.5-Pro localmente?

Sim. O modelo é open weights, com 1.023 bilhões de parâmetros totais e 42 bilhões ativos em arquitetura MoE (mistura de especialistas). Você pode hospedar no seu próprio cluster e fazer fine-tune — algo impossível com o Claude Sonnet 4.6, que é fechado e só roda via API.

Leia também