MiMo V2.5 Pro cobra US$ 0,87/milhão e entra no top 3 do mercado
Modelo open weights da chinesa Xiaomi custa quase 14 vezes menos que o Gemini 3.1 Pro Preview e ainda pontua mais alto em agentic. O que você perde pelo preço?
O que cabe em US$ 0,87 por milhão de tokens
O release da Xiaomi chama o MiMo V2.5 Pro de "flagship". Aí você abre a tabela de preços e vê: US$ 0,87 por milhão de tokens de saída. O Gemini 3.1 Pro Preview, quase cinco pontos acima em IQ, cobra US$ 12. O GPT-5.3-Codex, dois pontos acima, cobra US$ 14.
Lançado ontem, o MiMo V2.5 Pro já é o terceiro colocado do catálogo (que tem mais de 400 modelos listados hoje), com IQ 42,88. Traduzindo o marketing: você entrega cerca de 90% da inteligência do topo pagando 7% do preço por token gerado. A pergunta que fica é quais 10% você está deixando na mesa.
A leitura por dentro dos benchmarks
A descrição oficial cita "forte desempenho em capacidades agentic gerais, engenharia de software complexa e tarefas de longo horizonte", com topo em ClawEval, GDPVal e SWE-bench Pro. Olhando os números do catálogo:
- Coding: 60,19 (Gemini marca 68,83)
- Agentic: 29,53 (Gemini marca 23,05 — o MiMo Pro GANHA aqui)
- IQ geral: 42,88
Esse agentic mais alto é o tipo de métrica que decide se o seu agente de software termina a tarefa ou fica preso em loop infinito. Não é detalhe decorativo de release.
Open weights muda a conta
O MiMo V2.5 Pro é open weights, com 1.023 bilhões de parâmetros totais e 42 bilhões ativos (MoE). Dá para baixar os pesos e rodar onde quiser. Os dois rivais acima dele no pódio são fechados.
| Campo | Valor |
|---|---|
| Identificador | xiaomi/mimo-v2.5-pro |
| Criador | xiaomi |
| Preço de entrada | US$ 0.435 / M tokens |
| Preço de saída | US$ 0.870 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.004 / M (99% de desconto) |
| Índice de inteligência (AA) | 42.9 |
| Índice de código | 60.2 |
| Índice agêntico | 29.5 |
| Parâmetros | 1023B (42B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 34 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Se você precisa de modelo próprio, auditabilidade, quer evitar lock-in geopolítico ou ajustar latência controlando a infraestrutura, isso muda a equação de long-term. É o único modelo do top 3 que oferece essa saída.
O irmão que custa um terço
Vale comparar com o MiMo V2.5, lançado no mesmo dia. Ele custa US$ 0,28 por milhão de tokens de saída — quase um terço do Pro —, pontua IQ 38,04 e coding 56,80. É multimodal nativo, coisa que o Pro não é.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| MiMo-V2.5-Pro (o novo) | 42.9 | 0.435 | 0.87 | 1.05M |
| MiMo-V2.5 | 38.0 | 0.14 | 0.28 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
Pro vs V2.5: três vezes o preço por mais 4,8 pontos de IQ e 3,4 pontos de coding. Para agentes longos e debugging pesado, o Pro compensa. Para 80% do tráfego corporativo, o V2.5 provavelmente resolve mais barato — e ainda abre porta para multimodal.
Quando NÃO vale a pena
Se você precisa do topo absoluto de raciocínio — análise jurídica pesada, pesquisa científica, revisão crítica de código — Gemini e Codex ainda entregam mais. E entregam mais rápido: Gemini roda a 102 tokens/segundo, Codex a 118; o MiMo V2.5 Pro marca 34. Em volume, o usuário final sente a diferença.
Omniscience também pesa: o MiMo Pro marca 3,25. O Gemini, 31,88. Para casos que pedem conhecimento enciclopédico amplo, a lacuna é grande.
O que fazer amanhã
Se a sua fila de chamadas a modelo pesa na fatura e a queda de ~5 pontos de IQ é tolerável nos seus casos reais, teste o MiMo V2.5 Pro na mesma suite de eval que você usa para Gemini ou Codex. Se a perda for aceitável, o corte de quase 14x no custo de saída compensa no primeiro mês. Se não for, o MiMo V2.5 a US$ 0,28/milhão cobre o que sobra — e ainda é open weights, fechando o melhor pacote custo/soberania disponível hoje entre os cinco primeiros do catálogo.
Se a fatura dói e ~5 pontos a menos de IQ são toleráveis nos seus casos, testar o MiMo V2.5 Pro esta semana é a decisão de menor custo de descoberta — e ser open weights muda o cálculo de longo prazo.
Perguntas frequentes
MiMo V2.5 Pro é mesmo tão mais barato assim?
Sim. O preço de saída é US$ 0,87 por milhão de tokens, contra US$ 12 do Gemini 3.1 Pro Preview e US$ 14 do GPT-5.3-Codex. No preço blended (entrada e saída misturados), o custo do MiMo Pro fica em US$ 0,54 por milhão — patamar único entre os três primeiros do catálogo.
Posso rodar o MiMo V2.5 Pro localmente?
Sim. O modelo é open weights com 1.023 bilhões de parâmetros totais e 42 bilhões ativos (MoE), o que reduz custo de inferência em hardware compatível. Gemini e Codex, no mesmo recorte, são fechados.
Quando o MiMo V2.5 Pro NÃO vale a pena?
Quando você precisa do topo absoluto de raciocínio geral (Gemini e Codex pontuam mais alto), latência baixa (MiMo Pro roda a 34 tokens/s, contra 102 do Gemini) ou conhecimento enciclopédico amplo (omniscience de 3,25 vs 31,88 do Gemini).