Xiaomi MiMo-V2-Flash custa 16 vezes menos que Claude Haiku 4.5
O modelo chinês de 309B parâmetros lidera o índice de inteligência do dia e cobra US$ 0,30 por milhão de tokens de saída — contra US$ 5 do Haiku.
O preço que a Xiaomi cobra por ser chinesa
O catálogo tem hoje 307 modelos ativos. No topo do índice de inteligência, um nome que não era óbvio há duas semanas: Xiaomi MiMo-V2-Flash, lançado em 14 de dezembro, com nota 34,024. Logo abaixo vem o OpenAI o3 (31,096) e, em terceiro, o Claude Haiku 4.5 da Anthropic (29,892). A diferença entre o primeiro e o terceiro lugar é de pouco mais de quatro pontos — mas a diferença de preço é de outro planeta.
O que você paga em cada um
O MiMo-V2-Flash cobra US$ 0,30 por milhão de tokens de saída. O Claude Haiku 4.5 cobra US$ 5,00 pela mesma unidade. Isso dá 16,7 vezes mais barato no papel — e a conta fica ainda mais feia para o Haiku quando você olha o cache: US$ 0,10 por milhão no Anthropic contra US$ 0,01 no Xiaomi. Na entrada, US$ 0,10 contra US$ 1,00. Em qualquer cenário de uso contínuo, a diferença no fim do mês não é percentual, é absoluta.
O que cada um entrega de verdade
O MiMo-V2-Flash é um modelo MoE com 309B parâmetros totais e 15B ativos, contexto de 262K tokens, raciocínio habilitado e pesos abertos. O catálogo não publicou nota de coding, agentic nem blended para ele. O Claude Haiku 4.5, por outro lado, tem nota de coding 43,892, agentic 16,472, blended 2, aceita imagem e arquivo como entrada e roda a 90,21 tokens por segundo — velocidade medida, não chute. Os pesos são fechados.
Para quem faz agente, ferramenta ou pipeline com visão, o Haiku 4.5 ainda é o pacote mais redondo do comparativo. Para quem roda lote de texto puro e quer pagar pouco por token, o MiMo-V2-Flash entra como a opção mais agressiva em custo do dia.
| Critério | MiMo-V2-Flash | Claude Haiku 4.5 |
|---|---|---|
| Índice de inteligência | 34.0 | 29.9 |
| Entrada US$/M | 0.1 | 1 |
| Saída US$/M | 0.3 | 5 |
| Contexto | 262k | 200k |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | — | 90 |
| Índice de código | — | 43.9 |
| Índice agêntico | — | 16.5 |
Onde o MiMo-V2-Flash ganha e onde perde
O Xiaomi ganha em três frentes concretas: preço de saída, preço de cache e preço de entrada. Perde em três outras: multimodalidade (texto puro contra texto+imagem+arquivo), velocidade aferida (não publicada para o MiMo) e maturidade de tooling — Anthropic tem dois anos de estrada em integração com Cursor, Claude Code e SDKs de agente.
O Haiku 4.5 ganha onde o MiMo ainda não tem número publicado: coding 43,892 e agentic 16,472 são as duas notas que mais importam para quem está construindo produto agora. Perde onde o Xiaomi é impiedoso: a conta.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Em que situação cada um vale a pena
Se o seu gargalo é custo por token em workload de texto — sumarização em massa, classificação, geração de rascunho, RAG pesado — o MiMo-V2-Flash é a escolha racional hoje: menor preço de entrada, menor preço de saída, menor preço de cache, índice de inteligência acima do Haiku. Se o seu gargalo é montar agente multimodal com visão, ler PDF, processar screenshot e manter latência baixa com SDK maduro, o Claude Haiku 4.5 continua valendo o preço — você está pagando por capacidade que o Xiaomi ainda não oferece.
A regra é simples: texto puro e fatura curta, Xiaomi. Multimodal e agente rodando em produção, Anthropic.
Roteire texto puro e geração em lote para o MiMo-V2-Flash e reserve o Haiku 4.5 para fluxos com imagem, arquivo e tooling de agente — a economia de 16x só faz sentido se você não precisa do que o Haiku tem de diferente.
Perguntas frequentes
MiMo-V2-Flash é realmente melhor que Claude Haiku 4.5?
No índice de inteligência atual, sim: 34,024 contra 29,892. Mas o Haiku 4.5 tem notas de coding (43,892) e agentic (16,472) que o catálogo ainda não publicou para o MiMo, além de aceitar imagem e arquivo. Em texto puro o Xiaomi lidera; em multimodal e agente, o Haiku segue à frente.
Quanto eu economizo trocando Claude Haiku 4.5 pelo MiMo-V2-Flash?
Na saída, a queda é de US$ 5,00 para US$ 0,30 por milhão de tokens — 16,7 vezes mais barato. No cache, de US$ 0,10 para US$ 0,01. Na entrada, de US$ 1,00 para US$ 0,10. Em workload de texto pesado, a economia no fim do mês é absoluta, não percentual.
O MiMo-V2-Flash serve para agente em produção?
Serve para agente de texto puro, sim. Para agente multimodal com visão ou leitura de arquivo, não — o Haiku 4.5 cobre esse caso e o catálogo não publicou nota agentic nem coding para o MiMo nesta data.