Xiaomi MiMo-V2.5 cobra US$ 0,28 e vence Sonnet 4.6 em IQ
Modelo chinês de 310B parâmetros abertos custa um quinto do Anthropic e lidera em inteligência geral — mas o Claude segue melhor onde o trabalho é longo e estruturado.
Paga-se caro por marca. No comparativo de hoje, o MiMo-V2.5 da Xiaomi cobra US$ 0,28 por milhão de tokens de saída enquanto o Claude Sonnet 4.6 da Anthropic pede US$ 15 — exatamente 53 vezes mais pelo mesmo trabalho. A pergunta que não quer calar é: vale a diferença?
Os números não mentem (mas precisam de contexto)
Olha o índice de inteligência geral medido hoje: MiMo-V2.5 marca 38,04 e Claude Sonnet 4.6 marca 35,11. São quase 3 pontos de vantagem para o chinês, numa escala em que a diferença entre o topo do mercado (Gemini 3.1 Pro Preview, 47,74) e o quinto colocado (MiMo-V2.5-Pro, 42,88) é de menos de 5 pontos.
A leitura rápida seria "o Xiaomi ganha". A leitura correta é outra: o MiMo está acima do Sonnet neste índice agregado, mas isso não conta a história toda sobre coding e agentic.
Coding: a fortaleza do Sonnet
Em coding, o MiMo alcança 56,80 — nota forte. O dado de coding do Claude Sonnet 4.6 não foi publicado pelo catálogo nesta data, então não dá para cravar quem pontua mais alto nessa categoria. O que dá para afirmar com os dados em mãos: Xiaomi descreve o modelo como entregando "Pro-level agentic performance at roughly half the inference cost", enquanto a Anthropic posiciona o Sonnet 4.6 como o carro-chefe para "iterative development, complex codebase navigation, end-to-end project management".
| Critério | MiMo-V2.5 | Claude Sonnet 4.6 |
|---|---|---|
| Índice de inteligência | 38.0 | 35.1 |
| Entrada US$/M | 0.14 | 3 |
| Saída US$/M | 0.28 | 15 |
| Contexto | 1.05M | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 58 | 41 |
| Índice de código | 56.8 | — |
| Índice agêntico | 24.4 | — |
Onde o Anthropic ainda leva vantagem clara é na maturidade do produto: 41,37 de speed no Sonnet contra 57,52 no MiMo (a métrica de speed não é autoexplicativa, então trate como sinal, não como veredito). E tem o ecosystem — ferramentas, integrações, SDKs — que não aparece na fatura mas aparece quando o código precisa rodar em produção.
Preço: a vantagem real do Xiaomi
Vamos ao que pesa no boleto. Token de entrada: US$ 0,14 no MiMo contra US$ 3,00 no Sonnet. Cache: US$ 0,0028 contra US$ 0,30. Em qualquer cenário de uso intenso — agente rodando o dia inteiro, RAG com prompts longos, análise de codebase — o multiplicador fica entre 21x e 107x dependendo da linha.
Para dimensionar: se você processa 100 milhões de tokens de saída por mês, são US$ 28 com MiMo ou US$ 1.500 com Sonnet. A diferença paga um desenvolvedor júnior.
Modalidade e arquitetura: chineses entregam mais por menos
O MiMo-V2.5 é nativo multimodal — aceita texto, imagem, áudio e vídeo, devolve só texto. O Sonnet 4.6 aceita texto, imagem e arquivo. Em vídeo, o Xiaomi leva. O MiMo também é open weights, 310B de parâmetros totais com 15B ativos (arquitetura MoE). O Sonnet é fechado e não divulga contagem.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
E tem o contexto: 1.050.000 tokens no MiMo, 1.000.000 no Sonnet. Empate técnico.
Quando cada um ganha
Xiaomi MiMo-V2.5 ganha quando o gargalo é custo por token, quando você precisa processar vídeo ou áudio multimodal, quando quer rodar self-hosted com pesos abertos, e quando o workload é agentic de alta cadência (a Xiaomi destaca esse uso). Se você está queimando US$ 5.000/mês com Sonnet em tarefas que o MiMo resolve, a troca é imediata.
Claude Sonnet 4.6 ganha quando o trabalho depende de navegação longa por codebases complexos, quando a integração com o ecossistema Anthropic (Claude Code, ferramentas) já está no pipeline, e quando o cliente final paga pela marca — corporativo americano ainda vê Anthropic como default. E em agentic, a descrição do produto sugere entrega frontier, sem benchmark publicado para confrontar de verdade.
A implicação é direta: testar o MiMo-V2.5 em produção não é mais experimental. É economia pura.
Roteirize custo alto no Sonnet, escale no MiMo: use Claude Sonnet 4.6 para codebases longos e críticos, e MiMo-V2.5 para tudo que é multimodal, agentic de alto volume ou self-hosted com pesos abertos.
Perguntas frequentes
Xiaomi MiMo-V2.5 é melhor que Claude Sonnet 4.6 em programação?
O MiMo-V2.5 pontua 56,80 em coding no catálogo. O índice de coding do Sonnet 4.6 não foi publicado nesta data, então não há comparação direta possível — só dá para afirmar que o MiMo tem nota forte em coding e que a Anthropic descreve o Sonnet como frontier em navegação de codebase.
Quanto custa rodar o MiMo-V2.5 vs Sonnet 4.6?
Saída: US$ 0,28/M tokens no MiMo contra US$ 15/M no Sonnet (53x de diferença). Entrada: US$ 0,14 contra US$ 3,00 (21x). Cache: US$ 0,0028 contra US$ 0,30 (107x). Em uso intenso, a economia mensal facilmente supera quatro dígitos em dólar.
Posso rodar o Xiaomi MiMo-V2.5 localmente?
Sim — o modelo é open weights, com 310B de parâmetros totais e 15B ativos em arquitetura MoE. Os pesos ativos cabem em hardware de data center; para inferência completa, prepare-se para GPUs de 80GB em configuração multi-GPU.