FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

26 modelos com pesos abertos e um líder inesperado da Xiaomi

O catálogo tem 327 modelos hoje; 26 deles entregam os pesos. O topo do recorte não é americano — e custa uma fração do o3.

Redação FalaVIP IA 3 min de leitura
US$ 0,30por milhão de tokens de saída do MiMo-V2-Flash
26modelos com pesos abertos no catálogo de 327
117Bparâmetros totais do gpt-oss-120b, com 5,1B ativos

O recorte que ninguém pediu pra ver

Dos 327 modelos listados no catálogo hoje, só 26 abrem os pesos. É uma fatia pequena — menos de 8% — mas é a fatia que você consegue baixar, inspecionar e colocar atrás do seu próprio firewall. Olhar esse recorte inteiro de uma vez revela um padrão que não aparece quando você consome lançamento por lançamento: o topo da tabela não é americano, e o custo de entrada para raciocínio sério caiu a um patamar que muda a conta no fim do mês.

O líder que ninguém estava esperando

O MiMo-V2-Flash, da Xiaomi, lidera o recorte com índice de inteligência 34,024 — à frente do o3 da OpenAI (31,096) e do Claude Haiku 4.5 (29,892), que são modelos fechados. É um MoE de 309B parâmetros totais com apenas 15B ativos por passagem, lançado em 14 de dezembro de 2025, com contexto de 262 mil tokens. O detalhe que importa para quem paga a API: a saída custa US$ 0,30 por milhão de tokens. O o3 cobra US$ 8 pelo mesmo milhão. São 26 vezes mais barato no output.

Inteligência × preço no recorte
MiMo-V2-Flashgpt-oss-120bDevstral 2 2512Qwen3 Next 80B A3B ThinkingMistral Large 3 2512INTELLECT-3gpt-oss-20bNemotron 3 Nano 30B A3BUS$ por milhão (saída, escala log)índice de inteligência

Isso não quer dizer que o MiMo substitui o o3 em qualquer tarefa — o catálogo não traz comparativo de coding e agentic para o modelo chinês, só o IQ geral. Mas coloca uma referência nova no topo do recorte aberto.

Os três nomes que você vai cruzar com frequência

Atrás do MiMo, três modelos concentram a conversa:

  • gpt-oss-120b (OpenAI) — 117B totais, 5,1B ativos, IQ 24,126. É o mais barato do recorte com raciocínio de verdade: US$ 0,17 por milhão de saída. Tem nota de coding (30,441) e agentic (13,425) publicadas, o que o MiMo ainda não tem.
  • Devstral 2 2512 (Mistral) — 125B densos, sem MoE, IQ 19,242. É o melhor do recorte em coding (31,259) e o único francês da lista. Sai por US$ 2 por milhão de saída.
  • Qwen3 Next 80B A3B Thinking (Alibaba) — 80B totais, 3B ativos, raciocínio por padrão. IQ 16,867, saída a US$ 1,20.
Destaques do recorte: pesos abertos
ModeloCriadorInteligênciaSaída US$/MContexto
MiMo-V2-Flashxiaomi34.00.3262k
gpt-oss-120bopenai24.10.17131k
Devstral 2 2512mistralai19.22262k
Qwen3 Next 80B A3B Thinkingqwen16.91.2262k
Mistral Large 3 2512mistralai15.91.5262k
INTELLECT-3prime-intellect15.71.1131k
gpt-oss-20bopenai15.20.13131k
Nemotron 3 Nano 30B A3Bnvidia14.50.2262k

O que mudou na régua de preço

A leitura antiga dizia: modelo aberto é mais barato, modelo fechado é mais capaz. A leitura de hoje, olhando os 26 do recorte: a fronteira de capacidade está dentro do recorte aberto, e o preço de entrada para raciocínio sério gira em torno de US$ 0,13 a US$ 0,30 por milhão de saída. O gpt-oss-20b, da própria OpenAI, cobra US$ 0,13 — e ainda é um MoE de 21B com 3,6B ativos.

Para quem está comparando fechado versus aberto na mesma faixa de capacidade: o Claude Haiku 4.5 sai por US$ 5, o o3 por US$ 8. O Devstral 2, melhor que os dois em coding, sai por US$ 2. O MiMo, melhor que os dois em IQ geral, sai por US$ 0,30.

Para quem isso muda a conta — e para quem não muda

Se você roda agente de coding, Devstral 2 e gpt-oss-120b são os dois nomes para colocar na fila. Se você precisa de raciocínio geral com contexto longo e quer manter o peso em casa, MiMo e Qwen3 Next Thinking são as opções de hoje. Se o seu caso é multimodal (texto + imagem + arquivo), só o Mistral Large 3 2512, dos modelos abertos do recorte, cobre — e ainda assim é mais barato que o Haiku.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 327 modelos disponíveis no catálogo nesta data.

Para quem já está preso a um stack fechado por contrato, integração ou requisito de compliance que impeça auto-hospedagem, nada disso muda amanhã. Mas o argumento "aberto é mais barato" virou "aberto é mais barato e, em algumas métricas, está na frente". É uma frase diferente.

O próximo teste

O MiMo lidera em IQ geral, mas o catálogo não publicou coding e agentic para ele. Quando esses números aparecerem, a conversa muda de novo — porque o Devstral 2 hoje vence em coding com folga, e o gpt-oss-120b entrega agentic medido. Até lá, a regra prática é: Xiaomi para raciocínio geral barato, Mistral para coding, OpenAI aberta para o meio-termo com métricas publicadas.

Em uma frase

Se você roda agente de coding ou raciocínio geral e pode auto-hospedar, o recorte aberto de hoje já entrega capacidade de topo por uma fração do preço fechado — começa por Devstral 2, gpt-oss-120b ou MiMo-V2-Flash conforme a tarefa.

Perguntas frequentes

Quantos modelos com pesos abertos existem no catálogo hoje?

São 26 modelos com pesos abertos no catálogo de 327 listados em 3 de fevereiro de 2026. É um piso: modelos removidos depois não aparecem, então o número histórico pode ter sido maior.

Qual o modelo aberto mais barato com raciocínio?

O gpt-oss-20b, da OpenAI, cobra US$ 0,13 por milhão de tokens de saída e US$ 0,03 de entrada. É um MoE de 21B com 3,6B ativos por passagem e IQ 15,225.

O MiMo-V2-Flash da Xiaomi é realmente melhor que o o3?

No índice de inteligência geral do catálogo, sim: 34,024 contra 31,096. Mas o o3 tem métricas de coding e agentic publicadas que o MiMo ainda não tem, então a comparação completa depende do tipo de tarefa.

Leia também