Xiaomi MiMo-V2-Flash lidera ranking de IA com saída a US$ 0,30
Um modelo chinês de baixo custo destoa do topo do catálogo na semana em que a única novidade foi um 32B open source da AllenAI.
Você abriu o painel de modelos hoje esperando novidade e encontrou a mesma paisagem da semana passada — com um detalhe que não estava lá sete dias atrás. O topo do catálogo, que costuma ser um duelo entre OpenAI, Anthropic e Google, agora tem um nome chinês na primeira posição: Xiaomi MiMo-V2-Flash, com índice de inteligência 34,024 e cobrança de US$ 0,30 por milhão de tokens de saída. O segundo colocado, OpenAI o3, cobra US$ 8 pelo mesmo milhão. Não é erro de digitação.
A conta que o marketing não mostra
Quando o catálogo diz que o MiMo-V2-Flash é "barato", o que isso significa na prática? Significa que, para cada milhão de tokens que o modelo cospe como resposta, você paga trinta centavos de dólar. O o3, da OpenAI, custa oito dólares pelo mesmo volume. Em um lote de 10 milhões de tokens gerados, a diferença é de US$ 77. Em 100 milhões, US$ 770. É o tipo de economia que muda a conta de uma startup que usa IA em produto, não só em demo.
Mas o índice de inteligência sozinho não conta a história inteira. O MiMo marca 34,024; o o3, 31,096; o Claude Haiku 4.5, da Anthropic, 29,892. Ou seja: o chinês não está barato porque é pior — está barato cobrando um preço que parece de outro mercado. É a mesma lógica de um celular com câmera excelente que custa a metade do flagship: o argumento não é "bom o suficiente", é "bom e barato ao mesmo tempo".
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
A semana em si foi quieta
Entre 5 e 11 de janeiro, o catálogo registrou um único lançamento novo: o Olmo 3.1 32B Instruct, da AllenAI, em 6 de janeiro. Modelo open source, 32 bilhões de parâmetros, índice de inteligência 6,212 e preço de US$ 0,60 por milhão de tokens de saída. É um número baixo no ranking geral, mas faz sentido no nicho: a AllenAI é conhecida por publicar pesos abertos voltados a pesquisa e fine-tuning, não por brigar pelo topo do índice.
Não houve corte de preço nem aumento de preço na semana. Zero. Quando o calendário de IA fica mudo assim, o que importa é o que já está no ar e quanto custa manter ligado.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-01-06 | Olmo 3.1 32B Instruct | allenai | 6.2 | 0.6 |
Para quem isso muda o jogo
Se você roda um produto com alto volume de tokens de saída — geração de texto longo, sumarização em massa, agentes que escrevem bastante — o MiMo-V2-Flash virou candidato sério a default. O custo por chamada cai uma ordem de grandeza em relação ao o3, e o índice de inteligência está acima. Para tarefas onde o topo absoluto do ranking importa mais que a conta, o3 e Claude Haiku 4.5 seguem valendo o que cobram.
Se você está montando um stack open source e quer um modelo instruct decente sem virar refém de API, o Olmo 3.1 32B Instruct entra na lista — não para competir com o topo, mas para ocupar a faixa de experimentação local. Para quem usa IA só para classificar, resumir em poucas linhas ou嵌入 em prompts curtos, nada nesta semana muda o que já estava funcionando.
O tabuleiro em janeiro de 2026
O catálogo hoje lista mais de 314 modelos de 48 criadores. Nos últimos 30 dias, foram 10 lançamentos. O topo absoluto, medido pelo índice atual, tem Xiaomi, OpenAI e Anthropic nas três primeiras posições — uma configuração que, até pouco tempo, era impensável sem a chinesa. O quarto lugar, gpt-oss-120b, cobra US$ 0,17 por milhão de saída, mostrando que a faixa "open source barato" já tem seu próprio representante bem ranqueado. A Mistral aparece em quinto com o Devstral 2 2512, a US$ 2 o milhão.
O que fazer com isso? Se você ainda não testou o MiMo-V2-Flash em produção, esta semana é boa para colocar lado a lado com o modelo que você usa hoje e medir custo por tarefa concluída — não só custo por token. A diferença pode estar justamente onde você não está olhando.
Rode o MiMo-V2-Flash em paralelo ao seu modelo atual e meça custo por tarefa, não por token: a economia pode mudar a conta sem você trocar de fornecedor.
Perguntas frequentes
Qual é o modelo de IA mais barato no topo do ranking em janeiro de 2026?
Pelo catálogo desta semana, o Xiaomi MiMo-V2-Flash lidera o índice de inteligência com 34,024 pontos e cobra US$ 0,30 por milhão de tokens de saída — cerca de 26 vezes menos que o OpenAI o3, segundo colocado.
O que foi lançado na semana de 5 a 11 de janeiro de 2026?
Apenas um modelo novo entrou no catálogo: o Olmo 3.1 32B Instruct, da AllenAI, publicado em 6 de janeiro, open source, com índice de inteligência 6,212 e preço de US$ 0,60 por milhão de tokens de saída.
Houve mudança de preço em modelos de IA nesta semana?
Não. O registro entre 5 e 11 de janeiro de 2026 mostra zero cortes e zero aumentos de preço nos modelos listados no catálogo.