DeepSeek V4 Pro custa o dobro da Xiaomi MiMo — vale a diferença?
Dois modelos chineses lançados com dois dias de diferença em abril disputam a faixa de IQ 45; o preço da saída é o fiel da balança.
A diferença que cabe numa fatura
DeepSeek V4 Pro 0423 e Xiaomi MiMo-V2.5-Pro chegaram com dois dias de diferença em abril de 2026. Os dois são chineses, MoE (mistura de especialistas — pense num prédio com 1.600 apartamentos onde só 49 estão ocupados por vez), raciocínio nativo, pesos abertos, janela de 1M de tokens. O DeepSeek custa o dobro da Xiaomi na saída. A pergunta é: a entrega também dobra?
Preço: a conta de saída
MiMo-V2.5-Pro sai por US$ 0,435 de entrada e US$ 0,87 de saída por milhão de tokens. O cache de prompt custa US$ 0,0036 — quase simbólico. DeepSeek V4 Pro 0423 cobra US$ 0,87 de entrada, US$ 1,74 de saída e cache a US$ 0,0725. Mesma arquitetura MoE, exatamente o dobro do preço de saída.
Para um sistema gerando 50 milhões de tokens de saída por mês, são US$ 43,50 na Xiaomi contra US$ 87 no DeepSeek. Em volume de produção real, essa diferença anual pesa mais do que qualquer ponto de benchmark.
Quem entrega o que
| Critério | DeepSeek V4 Pro 0423 | MiMo-V2.5-Pro |
|---|---|---|
| Índice de inteligência | 45.3 | 42.9 |
| Entrada US$/M | 1.0423 | 0.435 |
| Saída US$/M | 2.0845 | 0.87 |
| Contexto | 1.05M | 1.05M |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 58 | 34 |
| Índice de código | 59.4 | 60.2 |
| Índice agêntico | 37.8 | 29.5 |
Índice de inteligência Artificial Analysis: 45,27 (DeepSeek) contra 42,88 (Xiaomi). Diferença de 2,4 pontos — relevante se o seu filtro mínimo é IQ 45.
Codificação: 60,19 (Xiaomi) contra 59,36 (DeepSeek). Vantagem Xiaomi, mas por décimos.
Agentic — execução de tarefas em várias etapas com decisão autônoma: 37,81 (DeepSeek) contra 29,53 (Xiaomi). Aqui a diferença é séria: 28% a mais para o DeepSeek.
Velocidade: 57,82 tokens/s (DeepSeek) contra 34,05 (Xiaomi). O DeepSeek responde 70% mais rápido.
Omnisciência — quanto o modelo sabe o que não sabe: +3,25 (Xiaomi) contra −10,73 (DeepSeek). A Xiaomi alucina menos; a DeepSeek inventa mais quando não tem a resposta.
Onde cada um ganha (sem "depende")
Xiaomi MiMo-V2.5-Pro ganha quando: o orçamento mensal por token é variável sensível; o workload é codificação longa com agente simples; você precisa de respostas factualmente mais conservadoras; latência não bloqueia o produto. É a escolha para times enxutos queimando prompt em volume.
DeepSeek V4 Pro 0423 ganha quando: o agente tem de encadear cinco, seis etapas e decidir sozinho entre elas; a velocidade de resposta entra no SLA do produto; você já roda a stack DeepSeek e quer migrar para V4 sem trocar fornecedor; o requisito mínimo é IQ ≥ 45 e o orçamento absorve os US$ 1,74 de saída.
O tabuleiro de hoje
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
No recorte atual de modelos acima de IQ 45, o DeepSeek V4 Pro 0423 é o mais barato do catálogo: US$ 1,74 de saída contra US$ 12 do Gemini 3.1 Pro Preview e US$ 14 do GPT-5.3-Codex. A Xiaomi ficou abaixo dos 45 e por isso não entra nesse recorte — mesmo sendo a opção com melhor custo por token da lista inteira.
Xiaomi ganha em custo e em codificação rasa. DeepSeek ganha em agentic, em velocidade e no selo "acima de IQ 45 sem estourar orçamento". Para um sistema em produção, vale rodar os dois no mesmo conjunto de prompts do seu domínio por uma semana — o que decide é qual entrega mais tokens certos por dólar, não qual lidera em qual benchmark isolado.
Se o gargalo é a fatura, MiMo-V2.5-Pro; se o gargalo é o agente tomando decisões sozinho com velocidade, DeepSeek V4 Pro 0423 — e ele é o único acima de IQ 45 com saída abaixo de US$ 2 no catálogo hoje.
Perguntas frequentes
DeepSeek V4 Pro 0423 tem pesos abertos?
Sim. É um MoE com 1,6T de parâmetros totais e 49B ativos, publicado sob licença aberta. Mesma situação da Xiaomi MiMo-V2.5-Pro, com 1,023T totais e 42B ativos.
Qual dos dois é melhor para codificação?
Xiaomi MiMo-V2.5-Pro leva por pouco no índice de coding (60,19 contra 59,36). Em agentic, a vantagem troca de lado e o DeepSeek abre 28%.
Por que o DeepSeek é mais caro que a Xiaomi, sendo chinês e mais barato que Gemini e GPT?
Ele não é caro dentro da faixa — é o piso da categoria premium. No recorte de IQ ≥ 45 de hoje, só existem três modelos: DeepSeek a US$ 1,74, Gemini 3.1 Pro Preview a US$ 12 e GPT-5.3-Codex a US$ 14.