MiMo-V2.5-Pro custa 17 vezes menos que Claude Sonnet 4.6 e lidera em inteligência
Mesmo assim, o Sonnet mantém dois trunfos que o modelo chinês ainda não entrega.
US$ 15 contra US$ 0,87 por milhão de tokens de saída. Essa é a diferença que aparece na fatura se você trocar Claude Sonnet 4.6 pelo MiMo-V2.5-Pro, da Xiaomi, hoje. São 17 vezes menos — e aqui não estamos falando de um modelo chinês "barato mas fraco": o índice consolidado de inteligência coloca o MiMo em 42,88, contra 35,11 do Sonnet. Você paga mais caro e leva um modelo com nota menor. O senso comum diz que premium é melhor; os números deste catálogo dizem o contrário.
Inteligência: onde dá pra comparar, a Xiaomi lidera
Em coding, o MiMo-V2.5-Pro marca 60,19. Em agentic, 29,53. O catálogo registra o Sonnet 4.6 com dado não publicado nessas duas categorias. O índice geral já coloca o modelo chinês quase oito pontos acima; a Anthropic não expôs números que pudessem ampliar essa distância.
Para situar no tabuleiro: o topo do catálogo nesta data é o Gemini 3.1 Pro Preview (47,74), seguido por GPT-5.3-Codex (45,51) e DeepSeek V4 Pro (45,27). O MiMo-V2.5-Pro aparece em quarto lugar — acima de qualquer modelo da Anthropic listado hoje.
O preço, traduzido sem release
O anúncio do Sonnet fala em "modelo Sonnet mais capaz até hoje". A conta fala outra coisa. Por milhão de tokens, o MiMo cobra US$ 0,435 de entrada e US$ 0,87 de saída, com cache a US$ 0,0036. O Sonnet cobra US$ 3 de entrada, US$ 15 de saída, US$ 0,30 de cache. No preço blended — uso típico combinando entrada e saída — são US$ 0,54 contra US$ 6. Uma diferença de 11 vezes.
Traduzindo em volume: uma startup queimando 100 milhões de tokens de saída por mês paga US$ 87 com o MiMo e US$ 1.500 com o Sonnet pelo mesmo trabalho. Em seis meses, são cerca de US$ 8.500 de economia — o custo de um desenvolvedor pleno no Brasil.
O que o Claude ainda faz melhor
Duas coisas, e nenhuma é a inteligência bruta. A primeira é multimodalidade: o Sonnet 4.6 aceita texto, imagem e arquivo; o MiMo é text-to-text puro. Se o seu pipeline precisa ler PDF, screenshot de tela ou foto de produto, o Anthropic continua sendo a escolha. A segunda é velocidade: 41,37 tokens por segundo contra 34,05 do MiMo — uma diferença de cerca de 20% que pesa em chat ao vivo, não em batch noturno.
Peso aberto: o argumento que o boleto não mostra
O MiMo-V2.5-Pro tem 1.023 bilhões de parâmetros totais, com 42 bilhões ativos (arquitetura MoE, mistura de especialistas), e é open weights. Você baixa, ajusta, roda no seu próprio cluster. O Sonnet 4.6 é fechado: consome via API, sem opção de inspecionar pesos ou fazer fine-tune. Para empresas de saúde, jurídico ou financeiro que precisam de soberania de dados, essa diferença muda a equação inteira — não só a linha do custo por token.
| Critério | MiMo-V2.5-Pro | Claude Sonnet 4.6 |
|---|---|---|
| Índice de inteligência | 42.9 | 35.1 |
| Entrada US$/M | 0.435 | 3 |
| Saída US$/M | 0.87 | 15 |
| Contexto | 1.05M | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 34 | 41 |
| Índice de código | 60.2 | — |
| Índice agêntico | 29.5 | — |
A escolha, sem "depende"
Use o MiMo-V2.5-Pro para tudo que é texto puro: geração de código, sumarização, extração, classificação, agentes que só leem e escrevem texto. É mais barato, mais inteligente no índice geral, ajustável e hospedável em casa. Use o Claude Sonnet 4.6 quando a entrada for multimodal ou quando a latência de chat ao vivo justificar o preço premium — lembrando que você está pagando caro pela multimodalidade, não pela inteligência.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Para texto puro, migre chamadas para o MiMo-V2.5-Pro e corte até 17 vezes o custo de saída; só mantenha o Claude Sonnet 4.6 onde a entrada for imagem, arquivo ou a latência de chat for inegociável.
Perguntas frequentes
MiMo-V2.5-Pro é melhor que Claude Sonnet 4.6?
No índice geral de inteligência desta data, sim: 42,88 contra 35,11, com preço de saída 17 vezes menor. A superioridade do Claude está em multimodalidade (aceita imagem e arquivo) e em velocidade bruta — não em capacidade de raciocínio geral medida pelo catálogo.
Por que o Claude Sonnet 4.6 custa 17 vezes mais caro por token de saída?
O preço de US$ 15 por milhão de tokens de saída reflete o posicionamento premium da Anthropic e o custo de manter entrada multimodal (imagem e arquivo) que o MiMo-V2.5-Pro não oferece. É o preço da multimodalidade e da marca, não da inteligência — o índice geral diz o contrário.
Posso rodar o MiMo-V2.5-Pro localmente?
Sim. O modelo é open weights, com 1.023 bilhões de parâmetros totais e 42 bilhões ativos em arquitetura MoE (mistura de especialistas). Você pode hospedar no seu próprio cluster e fazer fine-tune — algo impossível com o Claude Sonnet 4.6, que é fechado e só roda via API.