FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiMo V2.5 Pro cobra US$ 0,87/milhão e entra no top 3 do mercado

Modelo open weights da chinesa Xiaomi custa quase 14 vezes menos que o Gemini 3.1 Pro Preview e ainda pontua mais alto em agentic. O que você perde pelo preço?

Redação FalaVIP IA 3 min de leitura
US$ 0,87por milhão de tokens de saída
42,88de IQ — 3º colocado no catálogo
1.023 bide parâmetros totais, 42 bi ativos (MoE)

O que cabe em US$ 0,87 por milhão de tokens

O release da Xiaomi chama o MiMo V2.5 Pro de "flagship". Aí você abre a tabela de preços e vê: US$ 0,87 por milhão de tokens de saída. O Gemini 3.1 Pro Preview, quase cinco pontos acima em IQ, cobra US$ 12. O GPT-5.3-Codex, dois pontos acima, cobra US$ 14.

Índice de inteligência (Artificial Analysis)
MiMo-V2.5-Pro42,9MiMo-V2.538Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5índice
Fonte: Artificial Analysis
Preço de saída (US$ por milhão de tokens)
MiMo-V2.5-Pro0,87MiMo-V2.50,28Gemini 3.1 Pro Preview12GPT-5.3-Codex14US$/M
Fonte: OpenRouter

Lançado ontem, o MiMo V2.5 Pro já é o terceiro colocado do catálogo (que tem mais de 400 modelos listados hoje), com IQ 42,88. Traduzindo o marketing: você entrega cerca de 90% da inteligência do topo pagando 7% do preço por token gerado. A pergunta que fica é quais 10% você está deixando na mesa.

A leitura por dentro dos benchmarks

A descrição oficial cita "forte desempenho em capacidades agentic gerais, engenharia de software complexa e tarefas de longo horizonte", com topo em ClawEval, GDPVal e SWE-bench Pro. Olhando os números do catálogo:

  • Coding: 60,19 (Gemini marca 68,83)
  • Agentic: 29,53 (Gemini marca 23,05 — o MiMo Pro GANHA aqui)
  • IQ geral: 42,88

Esse agentic mais alto é o tipo de métrica que decide se o seu agente de software termina a tarefa ou fica preso em loop infinito. Não é detalhe decorativo de release.

Open weights muda a conta

O MiMo V2.5 Pro é open weights, com 1.023 bilhões de parâmetros totais e 42 bilhões ativos (MoE). Dá para baixar os pesos e rodar onde quiser. Os dois rivais acima dele no pódio são fechados.

Ficha técnica — MiMo-V2.5-Pro
CampoValor
Identificadorxiaomi/mimo-v2.5-pro
Criadorxiaomi
Preço de entradaUS$ 0.435 / M tokens
Preço de saídaUS$ 0.870 / M tokens
Janela de contexto1.05M
Modalidadetext->text
Leitura de cacheUS$ 0.004 / M (99% de desconto)
Índice de inteligência (AA)42.9
Índice de código60.2
Índice agêntico29.5
Parâmetros1023B (42B ativos por token)
Pesosabertos
Velocidade de saída34 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Se você precisa de modelo próprio, auditabilidade, quer evitar lock-in geopolítico ou ajustar latência controlando a infraestrutura, isso muda a equação de long-term. É o único modelo do top 3 que oferece essa saída.

O irmão que custa um terço

Vale comparar com o MiMo V2.5, lançado no mesmo dia. Ele custa US$ 0,28 por milhão de tokens de saída — quase um terço do Pro —, pontua IQ 38,04 e coding 56,80. É multimodal nativo, coisa que o Pro não é.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
MiMo-V2.5-Pro (o novo)42.90.4350.871.05M
MiMo-V2.538.00.140.281.05M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Pro vs V2.5: três vezes o preço por mais 4,8 pontos de IQ e 3,4 pontos de coding. Para agentes longos e debugging pesado, o Pro compensa. Para 80% do tráfego corporativo, o V2.5 provavelmente resolve mais barato — e ainda abre porta para multimodal.

Quando NÃO vale a pena

Se você precisa do topo absoluto de raciocínio — análise jurídica pesada, pesquisa científica, revisão crítica de código — Gemini e Codex ainda entregam mais. E entregam mais rápido: Gemini roda a 102 tokens/segundo, Codex a 118; o MiMo V2.5 Pro marca 34. Em volume, o usuário final sente a diferença.

Omniscience também pesa: o MiMo Pro marca 3,25. O Gemini, 31,88. Para casos que pedem conhecimento enciclopédico amplo, a lacuna é grande.

O que fazer amanhã

Se a sua fila de chamadas a modelo pesa na fatura e a queda de ~5 pontos de IQ é tolerável nos seus casos reais, teste o MiMo V2.5 Pro na mesma suite de eval que você usa para Gemini ou Codex. Se a perda for aceitável, o corte de quase 14x no custo de saída compensa no primeiro mês. Se não for, o MiMo V2.5 a US$ 0,28/milhão cobre o que sobra — e ainda é open weights, fechando o melhor pacote custo/soberania disponível hoje entre os cinco primeiros do catálogo.

Em uma frase

Se a fatura dói e ~5 pontos a menos de IQ são toleráveis nos seus casos, testar o MiMo V2.5 Pro esta semana é a decisão de menor custo de descoberta — e ser open weights muda o cálculo de longo prazo.

Perguntas frequentes

MiMo V2.5 Pro é mesmo tão mais barato assim?

Sim. O preço de saída é US$ 0,87 por milhão de tokens, contra US$ 12 do Gemini 3.1 Pro Preview e US$ 14 do GPT-5.3-Codex. No preço blended (entrada e saída misturados), o custo do MiMo Pro fica em US$ 0,54 por milhão — patamar único entre os três primeiros do catálogo.

Posso rodar o MiMo V2.5 Pro localmente?

Sim. O modelo é open weights com 1.023 bilhões de parâmetros totais e 42 bilhões ativos (MoE), o que reduz custo de inferência em hardware compatível. Gemini e Codex, no mesmo recorte, são fechados.

Quando o MiMo V2.5 Pro NÃO vale a pena?

Quando você precisa do topo absoluto de raciocínio geral (Gemini e Codex pontuam mais alto), latência baixa (MiMo Pro roda a 34 tokens/s, contra 102 do Gemini) ou conhecimento enciclopédico amplo (omniscience de 3,25 vs 31,88 do Gemini).

Leia também