MiMo-V2-Omni cobra 6 vezes mais caro que o Gemma 4 31B
Omni-modal da Xiaomi entrega mais inteligência, mas o modelo aberto do Google cobra US$ 0,34 por milhão de tokens de saída.
O que está em jogo nesta conta
Você olha para dois modelos lançados nas últimas três semanas e a primeira pergunta é sempre a mesma: vale pagar mais caro pelo que parece mais inteligente? A resposta curta é que o MiMo-V2-Omni, da Xiaomi, custa US$ 2 por milhão de tokens de saída. O Gemma 4 31B, do Google DeepMind, custa US$ 0,34 pelo mesmo volume. São quase 6 vezes de diferença para uma diferença de 6 pontos no índice de inteligência.
A conta, porém, esconde o que cada modelo entrega de fato.
Inteligência e capacidade real
O índice de inteligência atual coloca o MiMo-V2-Omni em 35,87 e o Gemma 4 31B em 29,70. Em agentic, o cenário muda: o Gemma 4 marca 14,38, enquanto o MiMo não tem nota publicada nesse recorte. Já em coding, o Gemma 4 atinge 43,43 — um número que o rival chinês também não entrega publicamente.
Traduzindo: o MiMo-V2-Omni lidera em raciocínio geral multimodal, mas o Gemma 4 31B tem nota específica em tarefas de código e agente. Para quem precisa de benchmark público de coding, a escolha está clara.
Multimodalidade: a vantagem real do MiMo
Aqui está o ponto que justifica o preço chinês. O MiMo-V2-Omni aceita texto, imagem, áudio e vídeo e devolve texto em uma arquitetura unificada. O Gemma 4 31B aceita texto, imagem e vídeo — sem áudio. Se o seu pipeline precisa transcrever voz, classificar áudio ou trabalhar com vídeo legendado automaticamente, o MiMo é o único dos dois que cobre o pacote completo.
A janela de contexto empata: 262.144 tokens nos dois. Nenhum dos dois é gratuito, e nenhum dos dois publica data de corte de conhecimento.
| Critério | MiMo-V2-Omni | Gemma 4 31B |
|---|---|---|
| Índice de inteligência | 35.9 | 29.7 |
| Entrada US$/M | 0.4 | 0.09 |
| Saída US$/M | 2 | 0.34 |
| Contexto | 262k | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | — | 35 |
| Índice de código | — | 43.4 |
| Índice agêntico | — | 14.4 |
Onde o Gemma 4 31B ganha
Três pontos que pesam na decisão:
- Preço de entrada. US$ 0,09 por milhão de tokens de entrada contra US$ 0,40 do MiMo. Para workloads de ingestão de documentos, isso é 4 vezes mais barato.
- Cache. US$ 0,05 por milhão contra US$ 0,08. Em sistemas com prompts repetidos, a economia se acumula.
- Pesos abertos. O Gemma 4 31B é open weights, com 30,7 bilhões de parâmetros densos. Dá para rodar em hardware próprio, ajustar com fine-tuning e tirar o dado da API. O MiMo-V2-Omni é API-only.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O contexto global ajuda a calibrar: hoje o catálogo lista 388 modelos de 54 criadores, e os dois únicos acima de IQ 45 custam US$ 12 e US$ 14 por milhão de tokens de saída. O MiMo-V2-Omni e o Gemma 4 31B estão bem abaixo desse teto — e entre si, a diferença é de arquitetura, não de elite.
Em que situação cada um ganha
MiMo-V2-Omni ganha quando: você precisa de áudio nativo no pipeline, quer a maior nota de inteligência entre modelos abaixo de US$ 5 por milhão de tokens de saída e aceita pagar a mais pela multimodalidade completa.
Gemma 4 31B ganha quando: o orçamento de API está apertado, você quer ajustar o modelo com seus próprios dados via pesos abertos, ou o trabalho é predominantemente de código e tarefas agentic com benchmark público.
Para um chatbot de atendimento que só lê texto, nenhum dos dois é a melhor escolha — existem opções mais baratas no catálogo. Para um agente multimodal com voz, a conta muda de figura e o MiMo-V2-Omni vira o caminho mais curto.
O que fazer com essa informação
Se você já roda o Gemma 4 31B localmente, não há motivo para trocar. Se você está decidindo entre API chinesa e API americana para um produto multimodal, a régua é simples: precisa de áudio, paga os US$ 2 por milhão; não precisa, gasta US$ 0,34 e fica com pesos abertos para ajustar.
Reserve o MiMo-V2-Omni para pipelines que exigem áudio nativo; em todo o resto, o Gemma 4 31B entrega 83% da inteligência por 17% do preço e ainda vem com pesos abertos.
Perguntas frequentes
MiMo-V2-Omni é melhor que Gemma 4 31B?
Depende do recorte. No índice geral de inteligência, o MiMo lidera com 35,87 contra 29,70. Em coding, o Gemma 4 marca 43,43 e o MiMo não publica nota. Em multimodalidade, o MiMo aceita áudio, e o Gemma não.
Quanto custa cada modelo por milhão de tokens?
MiMo-V2-Omni cobra US$ 0,40 de entrada e US$ 2 de saída por milhão de tokens, com cache a US$ 0,08. Gemma 4 31B cobra US$ 0,09 de entrada e US$ 0,34 de saída, com cache a US$ 0,05.
O Gemma 4 31B tem pesos abertos?
Sim. O Gemma 4 31B é um modelo denso de 30,7 bilhões de parâmetros com pesos abertos, o que permite rodar localmente e fazer fine-tuning. O MiMo-V2-Omni é acessível apenas via API.