FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Gemini 3.5 Flash cobra 10x mais por token que o MiMo chinês — vale a diferença?

O modelo do Google entrega mais inteligência bruta; o da Xiaomi cobra uma fração e ainda abre o peso. Veja em que cenário cada um ganha.

Redação FalaVIP IA 3 min de leitura
US$ 9preço de saída do Gemini 3.5 Flash por milhão de tokens
US$ 0,87preço de saída do MiMo-V2.5-Pro por milhão de tokens
46,67 vs 42,88índice de inteligência (Gemini 3.5 Flash × MiMo-V2.5-Pro)

O anúncio diz uma coisa, a conta diz outra

A Google lançou o Gemini 3.5 Flash em 19 de maio de 2026, há menos de uma semana, com a promessa de "perto do Pro pelo preço do Flash". Olhando só o índice de inteligência, a conta até fecha: 46,67 coloca o modelo em segundo lugar no ranking geral, atrás só do Gemini 3.1 Pro Preview. O problema mora na outra ponta da fatura. Cada milhão de tokens de saída custa US$ 9. É o dobro do que o Gemini 3.1 Pro Preview cobra, e mais de cinco vezes o DeepSeek V4 Pro, que lidera a lista dos baratos acima de IQ 45.

Preço de saída (US$ por milhão de tokens)
Gemini 3.5 Flash9MiMo-V2.5-Pro0,87US$/M
Fonte: OpenRouter

Do outro lado da mesa está o MiMo-V2.5-Pro, da Xiaomi, lançado em 22 de abril de 2026. Sai por US$ 0,87 por milhão de tokens de saída — literalmente um décimo do Flash. Tem 1.050.000 tokens de contexto contra 1.048.576 do Flash, e ainda abre o peso: 1.023 bilhões de parâmetros com 42 bilhões ativos, open weights. É a primeira vez que um modelo chinês de peso aberto entra nessa faixa de preço com benchmark de coding declarado em 60,19.

O que cada um entrega de fato

A diferença de IQ entre os dois é de 3,79 pontos: 46,67 contra 42,88. Em termos relativos, o Flash é cerca de 8,8% mais inteligente na métrica agregada da Artificial Analysis. Já em coding, o único benchmark específico publicado para o MiMo, a história muda: 60,19 do chinês contra o Flash, que simplesmente não publica número de coding no catálogo. Quem trabalha com geração de código e não tem como comparar diretamente fica no escuro — e isso é parte do argumento da Xiaomi.

Índice de inteligência (Artificial Analysis)
Gemini 3.5 Flash46,7MiMo-V2.5-Pro42,9índice
Fonte: Artificial Analysis

Em velocidade, o Flash entrega 194,53 tokens por segundo; o MiMo roda a 34,05. Cinco vezes mais rápido. Para um agente que fica em loop chamando a API, isso muda completamente o tempo de resposta percebido pelo usuário final.

A conta que ninguém gosta de fazer

Vamos colocar números reais em cima da mesa. Um sistema que gera 10 milhões de tokens de saída por mês paga US$ 90 no Gemini 3.5 Flash e US$ 8,70 no MiMo-V2.5-Pro. Para dobrar o volume, o Flash cobra mais US$ 90; o MiMo, US$ 8,70. O custo de cache também conta: US$ 0,15 por milhão no Flash, US$ 0,0036 no MiMo — uma diferença de 41 vezes.

Gemini 3.5 Flash × MiMo-V2.5-Pro
CritérioGemini 3.5 FlashMiMo-V2.5-Pro
Índice de inteligência46.742.9
Entrada US$/M1.50.435
Saída US$/M90.87
Contexto1.05M1.05M
Pesos abertosnãosim
Velocidade (tok/s)19534
Índice de código60.2
Índice agêntico29.5

O Flash tem uma vantagem estrutural que o catálogo não entrega ao MiMo: multimodalidade nativa. Texto, imagem, arquivo, áudio e vídeo entram; só texto sai. O MiMo é text-in, text-out. Quem precisa mandar uma captura de tela, um PDF escaneado ou um clipe de áudio para o modelo não tem escolha — o Flash é o único dos dois que resolve.

Onde cada um ganha — sem "depende"

Gemini 3.5 Flash ganha quando: o produto exige multimodalidade (imagem, áudio, vídeo entrando), quando a latência percebida importa mais que o custo — um chat ao vivo, por exemplo — e quando o usuário final precisa daquela diferença de 3,79 pontos de IQ em tarefas de raciocínio geral que não têm benchmark específico publicado.

MiMo-V2.5-Pro ganha quando: o orçamento é o fator dominante, o caso de uso é texto puro, e a equipe quer (ou precisa) rodar o modelo on-premise graças ao peso aberto. Para empresas chinesas ou times com restrição de envio de dados para APIs estrangeiras, o MiMo é a única opção nessa faixa de capability.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
Entre os 447 modelos disponíveis no catálogo nesta data.

O tabuleiro em 25 de maio de 2026

O catálogo tem mais de 447 modelos listados, vindos de 61 criadores diferentes. Nos últimos 30 dias, 34 modelos novos entraram — um ritmo que mantém o preço médio em queda. O Flash ocupa uma posição curiosa: é o segundo mais inteligente do mercado, mas é mais caro que o terceiro colocado (DeepSeek V4 Pro, a US$ 1,74) e mais caro que o próprio Pro da casa. A Google está cobando caro pela velocidade e pela multimodalidade, não pela inteligência bruta — e isso é uma escolha de produto, não um acidente.

Para o MiMo, o lançamento de 22 de abril já mostra resultado: entrou no top 5 geral e no top 3 entre modelos com IQ acima de 42. É a primeira vez que a Xiaomi aparece nesse recorte com peso aberto. Quem achava que modelo chinês bom era só DeepSeek precisa atualizar a lista.

Em uma frase

Use Gemini 3.5 Flash quando multimodalidade ou latência baixa forem inegociáveis; use MiMo-V2.5-Pro quando o orçamento mandar e o caso de uso for texto puro — a diferença de IQ de 3,8 pontos raramente justifica pagar 10x mais por token.

Perguntas frequentes

Gemini 3.5 Flash é melhor que o MiMo-V2.5-Pro em coding?

O catálogo só publica benchmark de coding para o MiMo (60,19). Para o Gemini 3.5 Flash não há número oficial de coding; a comparação direta depende de teste próprio. A descrição do Flash afirma "near-Pro coding", mas sem nota pública.

Por que o MiMo-V2.5-Pro é tão mais barato?

O preço de saída é US$ 0,87 por milhão de tokens contra US$ 9 do Flash. Parte da diferença vem do fato de o MiMo ser open weights (1.023B de parâmetros, 42B ativos), o que permite hospedagem própria e pressiona o preço da API para baixo.

Posso usar o MiMo-V2.5-Pro para processar imagens e áudio?

Não. A modalidade declarada é text-in, text-out. Para qualquer entrada multimodal — imagem, PDF, áudio, vídeo — o Gemini 3.5 Flash é a única opção entre os dois.

Leia também