FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiMo-V2-Omni cobra 6 vezes mais caro que o Gemma 4 31B

Omni-modal da Xiaomi entrega mais inteligência, mas o modelo aberto do Google cobra US$ 0,34 por milhão de tokens de saída.

Redação FalaVIP IA 3 min de leitura
US$ 2preço de saída do MiMo-V2-Omni por milhão de tokens
US$ 0,34preço de saída do Gemma 4 31B por milhão de tokens
35,87 vs 29,70índice de inteligência (Artificial Analysis)

O que está em jogo nesta conta

Você olha para dois modelos lançados nas últimas três semanas e a primeira pergunta é sempre a mesma: vale pagar mais caro pelo que parece mais inteligente? A resposta curta é que o MiMo-V2-Omni, da Xiaomi, custa US$ 2 por milhão de tokens de saída. O Gemma 4 31B, do Google DeepMind, custa US$ 0,34 pelo mesmo volume. São quase 6 vezes de diferença para uma diferença de 6 pontos no índice de inteligência.

Preço de saída (US$ por milhão de tokens)
MiMo-V2-Omni2Gemma 4 31B0,34US$/M
Fonte: OpenRouter

A conta, porém, esconde o que cada modelo entrega de fato.

Inteligência e capacidade real

O índice de inteligência atual coloca o MiMo-V2-Omni em 35,87 e o Gemma 4 31B em 29,70. Em agentic, o cenário muda: o Gemma 4 marca 14,38, enquanto o MiMo não tem nota publicada nesse recorte. Já em coding, o Gemma 4 atinge 43,43 — um número que o rival chinês também não entrega publicamente.

Índice de inteligência (Artificial Analysis)
MiMo-V2-Omni35,9Gemma 4 31B29,7índice
Fonte: Artificial Analysis

Traduzindo: o MiMo-V2-Omni lidera em raciocínio geral multimodal, mas o Gemma 4 31B tem nota específica em tarefas de código e agente. Para quem precisa de benchmark público de coding, a escolha está clara.

Multimodalidade: a vantagem real do MiMo

Aqui está o ponto que justifica o preço chinês. O MiMo-V2-Omni aceita texto, imagem, áudio e vídeo e devolve texto em uma arquitetura unificada. O Gemma 4 31B aceita texto, imagem e vídeo — sem áudio. Se o seu pipeline precisa transcrever voz, classificar áudio ou trabalhar com vídeo legendado automaticamente, o MiMo é o único dos dois que cobre o pacote completo.

A janela de contexto empata: 262.144 tokens nos dois. Nenhum dos dois é gratuito, e nenhum dos dois publica data de corte de conhecimento.

MiMo-V2-Omni × Gemma 4 31B
CritérioMiMo-V2-OmniGemma 4 31B
Índice de inteligência35.929.7
Entrada US$/M0.40.09
Saída US$/M20.34
Contexto262k262k
Pesos abertosnãosim
Velocidade (tok/s)35
Índice de código43.4
Índice agêntico14.4

Onde o Gemma 4 31B ganha

Três pontos que pesam na decisão:

  • Preço de entrada. US$ 0,09 por milhão de tokens de entrada contra US$ 0,40 do MiMo. Para workloads de ingestão de documentos, isso é 4 vezes mais barato.
  • Cache. US$ 0,05 por milhão contra US$ 0,08. Em sistemas com prompts repetidos, a economia se acumula.
  • Pesos abertos. O Gemma 4 31B é open weights, com 30,7 bilhões de parâmetros densos. Dá para rodar em hardware próprio, ajustar com fine-tuning e tirar o dado da API. O MiMo-V2-Omni é API-only.
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 388 modelos disponíveis no catálogo nesta data.

O contexto global ajuda a calibrar: hoje o catálogo lista 388 modelos de 54 criadores, e os dois únicos acima de IQ 45 custam US$ 12 e US$ 14 por milhão de tokens de saída. O MiMo-V2-Omni e o Gemma 4 31B estão bem abaixo desse teto — e entre si, a diferença é de arquitetura, não de elite.

Em que situação cada um ganha

MiMo-V2-Omni ganha quando: você precisa de áudio nativo no pipeline, quer a maior nota de inteligência entre modelos abaixo de US$ 5 por milhão de tokens de saída e aceita pagar a mais pela multimodalidade completa.

Gemma 4 31B ganha quando: o orçamento de API está apertado, você quer ajustar o modelo com seus próprios dados via pesos abertos, ou o trabalho é predominantemente de código e tarefas agentic com benchmark público.

Para um chatbot de atendimento que só lê texto, nenhum dos dois é a melhor escolha — existem opções mais baratas no catálogo. Para um agente multimodal com voz, a conta muda de figura e o MiMo-V2-Omni vira o caminho mais curto.

O que fazer com essa informação

Se você já roda o Gemma 4 31B localmente, não há motivo para trocar. Se você está decidindo entre API chinesa e API americana para um produto multimodal, a régua é simples: precisa de áudio, paga os US$ 2 por milhão; não precisa, gasta US$ 0,34 e fica com pesos abertos para ajustar.

Em uma frase

Reserve o MiMo-V2-Omni para pipelines que exigem áudio nativo; em todo o resto, o Gemma 4 31B entrega 83% da inteligência por 17% do preço e ainda vem com pesos abertos.

Perguntas frequentes

MiMo-V2-Omni é melhor que Gemma 4 31B?

Depende do recorte. No índice geral de inteligência, o MiMo lidera com 35,87 contra 29,70. Em coding, o Gemma 4 marca 43,43 e o MiMo não publica nota. Em multimodalidade, o MiMo aceita áudio, e o Gemma não.

Quanto custa cada modelo por milhão de tokens?

MiMo-V2-Omni cobra US$ 0,40 de entrada e US$ 2 de saída por milhão de tokens, com cache a US$ 0,08. Gemma 4 31B cobra US$ 0,09 de entrada e US$ 0,34 de saída, com cache a US$ 0,05.

O Gemma 4 31B tem pesos abertos?

Sim. O Gemma 4 31B é um modelo denso de 30,7 bilhões de parâmetros com pesos abertos, o que permite rodar localmente e fazer fine-tuning. O MiMo-V2-Omni é acessível apenas via API.

Leia também