FalaVIP IA quinta-feira, 03 de setembro de 2026
Mercado

Xiaomi MiMo-V2-Flash lidera ranking de IA com saída a US$ 0,30

Um modelo chinês de baixo custo destoa do topo do catálogo na semana em que a única novidade foi um 32B open source da AllenAI.

Redação FalaVIP IA 3 min de leitura
US$ 0,30por milhão de tokens de saída do MiMo-V2-Flash
34,024índice de inteligência do modelo no topo do catálogo
10modelos lançados nos últimos 30 dias

Você abriu o painel de modelos hoje esperando novidade e encontrou a mesma paisagem da semana passada — com um detalhe que não estava lá sete dias atrás. O topo do catálogo, que costuma ser um duelo entre OpenAI, Anthropic e Google, agora tem um nome chinês na primeira posição: Xiaomi MiMo-V2-Flash, com índice de inteligência 34,024 e cobrança de US$ 0,30 por milhão de tokens de saída. O segundo colocado, OpenAI o3, cobra US$ 8 pelo mesmo milhão. Não é erro de digitação.

A conta que o marketing não mostra

Quando o catálogo diz que o MiMo-V2-Flash é "barato", o que isso significa na prática? Significa que, para cada milhão de tokens que o modelo cospe como resposta, você paga trinta centavos de dólar. O o3, da OpenAI, custa oito dólares pelo mesmo volume. Em um lote de 10 milhões de tokens gerados, a diferença é de US$ 77. Em 100 milhões, US$ 770. É o tipo de economia que muda a conta de uma startup que usa IA em produto, não só em demo.

Mas o índice de inteligência sozinho não conta a história inteira. O MiMo marca 34,024; o o3, 31,096; o Claude Haiku 4.5, da Anthropic, 29,892. Ou seja: o chinês não está barato porque é pior — está barato cobrando um preço que parece de outro mercado. É a mesma lógica de um celular com câmera excelente que custa a metade do flagship: o argumento não é "bom o suficiente", é "bom e barato ao mesmo tempo".

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 314 modelos disponíveis no catálogo nesta data.

A semana em si foi quieta

Entre 5 e 11 de janeiro, o catálogo registrou um único lançamento novo: o Olmo 3.1 32B Instruct, da AllenAI, em 6 de janeiro. Modelo open source, 32 bilhões de parâmetros, índice de inteligência 6,212 e preço de US$ 0,60 por milhão de tokens de saída. É um número baixo no ranking geral, mas faz sentido no nicho: a AllenAI é conhecida por publicar pesos abertos voltados a pesquisa e fine-tuning, não por brigar pelo topo do índice.

Não houve corte de preço nem aumento de preço na semana. Zero. Quando o calendário de IA fica mudo assim, o que importa é o que já está no ar e quanto custa manter ligado.

Lançamentos entre 2026-01-05 e 2026-01-11
DataModeloCriadorInteligênciaSaída US$/M
2026-01-06Olmo 3.1 32B Instructallenai6.20.6

Para quem isso muda o jogo

Se você roda um produto com alto volume de tokens de saída — geração de texto longo, sumarização em massa, agentes que escrevem bastante — o MiMo-V2-Flash virou candidato sério a default. O custo por chamada cai uma ordem de grandeza em relação ao o3, e o índice de inteligência está acima. Para tarefas onde o topo absoluto do ranking importa mais que a conta, o3 e Claude Haiku 4.5 seguem valendo o que cobram.

Se você está montando um stack open source e quer um modelo instruct decente sem virar refém de API, o Olmo 3.1 32B Instruct entra na lista — não para competir com o topo, mas para ocupar a faixa de experimentação local. Para quem usa IA só para classificar, resumir em poucas linhas ou嵌入 em prompts curtos, nada nesta semana muda o que já estava funcionando.

O tabuleiro em janeiro de 2026

O catálogo hoje lista mais de 314 modelos de 48 criadores. Nos últimos 30 dias, foram 10 lançamentos. O topo absoluto, medido pelo índice atual, tem Xiaomi, OpenAI e Anthropic nas três primeiras posições — uma configuração que, até pouco tempo, era impensável sem a chinesa. O quarto lugar, gpt-oss-120b, cobra US$ 0,17 por milhão de saída, mostrando que a faixa "open source barato" já tem seu próprio representante bem ranqueado. A Mistral aparece em quinto com o Devstral 2 2512, a US$ 2 o milhão.

O que fazer com isso? Se você ainda não testou o MiMo-V2-Flash em produção, esta semana é boa para colocar lado a lado com o modelo que você usa hoje e medir custo por tarefa concluída — não só custo por token. A diferença pode estar justamente onde você não está olhando.

Em uma frase

Rode o MiMo-V2-Flash em paralelo ao seu modelo atual e meça custo por tarefa, não por token: a economia pode mudar a conta sem você trocar de fornecedor.

Perguntas frequentes

Qual é o modelo de IA mais barato no topo do ranking em janeiro de 2026?

Pelo catálogo desta semana, o Xiaomi MiMo-V2-Flash lidera o índice de inteligência com 34,024 pontos e cobra US$ 0,30 por milhão de tokens de saída — cerca de 26 vezes menos que o OpenAI o3, segundo colocado.

O que foi lançado na semana de 5 a 11 de janeiro de 2026?

Apenas um modelo novo entrou no catálogo: o Olmo 3.1 32B Instruct, da AllenAI, publicado em 6 de janeiro, open source, com índice de inteligência 6,212 e preço de US$ 0,60 por milhão de tokens de saída.

Houve mudança de preço em modelos de IA nesta semana?

Não. O registro entre 5 e 11 de janeiro de 2026 mostra zero cortes e zero aumentos de preço nos modelos listados no catálogo.

Leia também