DeepSeek V4 Pro custa 6x mais que MiMo-V2.5 — vale a diferença?
Dois modelos chineses lançados em abril de 2026 disputam o mesmo terreno: raciocínio forte, pesos abertos e preços em escala industrial. Um deles entrega mais IQ por dólar.
Você olha o catálogo e vê dois modelos chineses, com pesos abertos, lançados na mesma semana de abril, e a pergunta inevitável aparece: por que pagar seis vezes mais em um deles? É exatamente essa a conta que o DeepSeek V4 Pro 0423 e o Xiaomi MiMo-V2.5 colocam na mesa — e a resposta não é óbvia só pelo preço.
O que cada um entrega em inteligência
O índice de inteligência medido hoje coloca o DeepSeek V4 Pro em 45,268 e o MiMo-V2.5 em 38,043. Em coding, a diferença é menor do que parece: 59,363 contra 56,799. Em agentic, aí sim o fosso se abre — 37,807 contra 24,395. Em outras palavras, o MiMo-V2.5 programa quase no mesmo nível do V4 Pro, mas tropeça quando a tarefa exige encadear工具, navegar em interfaces ou operar como agente autônomo.
Onde o MiMo-V2.5 não tem como competir é no recorte multimodal: ele aceita texto, imagem, áudio e vídeo na entrada e devolve texto. O V4 Pro é estritamente text-to-text. Se o seu pipeline joga PDF escaneado, screenshot ou clipe de vídeo para o modelo, isso já decide a disputa antes mesmo de olhar preço.
A conta que importa
O V4 Pro cobra US$ 0,87 por milhão de tokens de entrada e US$ 1,74 por milhão na saída. O MiMo-V2.5 cobra US$ 0,14 de entrada e US$ 0,28 de saída — e ainda oferece cache a US$ 0,0028 por milhão, o que muda tudo em workloads com prompt repetido. No uso real, com a proporção 3:1 entre tokens de entrada e saída que costuma aparecer em aplicações, cada milhão de tokens processados custa cerca de US$ 0,79 no V4 Pro e US$ 0,21 no MiMo-V2.5.
Traduzindo o marketing: o release da Xiaomi diz que o MiMo-V2.5 entrega "performance agentic de nível Pro pela metade do custo de inferência". Metade é relativo — o V4 Pro não é o referencial mais caro do mercado, e a Xiaomi está se comparando ao MiMo-V2.5-Pro, que sai por US$ 0,87 de saída. Frente ao V4 Pro, o MiMo-V2.5 custa cerca de um sexto.
| Critério | DeepSeek V4 Pro 0423 | MiMo-V2.5 |
|---|---|---|
| Índice de inteligência | 45.3 | 38.0 |
| Entrada US$/M | 1.0423 | 0.14 |
| Saída US$/M | 2.0845 | 0.28 |
| Contexto | 1.05M | 1.05M |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 58 | 58 |
| Índice de código | 59.4 | 56.8 |
| Índice agêntico | 37.8 | 24.4 |
O tabuleiro em 13 de maio de 2026
O catálogo tem mais de 443 modelos listados hoje, vindos de 61 criadores. No topo do índice de inteligência aparecem Gemini 3.1 Pro Preview (47,738), GPT-5.3-Codex (45,512) e logo abaixo o DeepSeek V4 Pro (45,268) — terceiro lugar geral e primeiro entre modelos de pesos abertos. O MiMo-V2.5 está mais abaixo, em 38,043, mas é o mais barato entre os modelos com IQ acima de 38 que ainda aparecem nesta faixa.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Ambos são chineses, ambos MoE com fração ativa pequena (49B no V4 Pro, 15B no MiMo-V2.5) e ambos têm reasoning habilitado. O V4 Pro tem 1,6 trilhão de parâmetros totais contra 310 bilhões do MiMo-V2.5, e a janela de contexto é equivalente: 1.048.576 contra 1.050.000 tokens. Velocidade de saída é praticamente igual — 57,82 tokens/s no V4 Pro, 57,52 no MiMo-V2.5.
Quando cada um ganha
O DeepSeek V4 Pro ganha quando a tarefa exige raciocínio de verdade: agente autônomo rodando por horas, code review em base grande, planejamento multi-etapa. A diferença de 13 pontos em agentic não é cosmética — é a diferença entre um agente que termina o trabalho e um que fica travado no terceiro passo.
O MiMo-V2.5 ganha quando multimodalidade entra no pipeline e quando o orçamento é o fator limitante. Classificação de imagem, sumarização de vídeo, atendimento que precisa entender áudio do cliente — tudo isso o V4 Pro nem aceita como entrada. E em volume alto, pagar US$ 0,28 em vez de US$ 1,74 por milhão de tokens de saída muda a conta no fim do mês de qualquer startup.
Na prática, o que você faz
Se você está montando um agente de produção e o input é texto puro, comece pelo V4 Pro e meça se os 13 pontos de agentic se traduzem em tarefas concluídas a mais. Se você está processando mídia multimodal ou queimando milhões de tokens por dia em classificação e extração, o MiMo-V2.5 é o caminho — e o cache a US$ 0,0028 torna prompts longos com system message repetido quase gratuitos.
Use V4 Pro para agente autônomo em texto puro; use MiMo-V2.5 para multimodal ou alto volume onde cada centavo por token conta.
Perguntas frequentes
DeepSeek V4 Pro é melhor que MiMo-V2.5 em programação?
Em coding a diferença é pequena: 59,363 contra 56,799 no índice Artificial Analysis. O fosso aparece em agentic, onde o V4 Pro marca 37,807 e o MiMo-V2.5 fica em 24,395.
MiMo-V2.5 aceita imagem e vídeo?
Sim. MiMo-V2.5 é nativo omnimodal: aceita texto, imagem, áudio e vídeo e devolve texto. O DeepSeek V4 Pro só trabalha com texto na entrada e na saída.
Qual é mais barato por milhão de tokens?
MiMo-V2.5 cobra US$ 0,28 por milhão de tokens de saída contra US$ 1,74 do DeepSeek V4 Pro — cerca de seis vezes mais barato. O cache do MiMo-V2.5 sai por US$ 0,0028 por milhão.