26 modelos com pesos abertos e um líder inesperado da Xiaomi
O catálogo tem 327 modelos hoje; 26 deles entregam os pesos. O topo do recorte não é americano — e custa uma fração do o3.
O recorte que ninguém pediu pra ver
Dos 327 modelos listados no catálogo hoje, só 26 abrem os pesos. É uma fatia pequena — menos de 8% — mas é a fatia que você consegue baixar, inspecionar e colocar atrás do seu próprio firewall. Olhar esse recorte inteiro de uma vez revela um padrão que não aparece quando você consome lançamento por lançamento: o topo da tabela não é americano, e o custo de entrada para raciocínio sério caiu a um patamar que muda a conta no fim do mês.
O líder que ninguém estava esperando
O MiMo-V2-Flash, da Xiaomi, lidera o recorte com índice de inteligência 34,024 — à frente do o3 da OpenAI (31,096) e do Claude Haiku 4.5 (29,892), que são modelos fechados. É um MoE de 309B parâmetros totais com apenas 15B ativos por passagem, lançado em 14 de dezembro de 2025, com contexto de 262 mil tokens. O detalhe que importa para quem paga a API: a saída custa US$ 0,30 por milhão de tokens. O o3 cobra US$ 8 pelo mesmo milhão. São 26 vezes mais barato no output.
Isso não quer dizer que o MiMo substitui o o3 em qualquer tarefa — o catálogo não traz comparativo de coding e agentic para o modelo chinês, só o IQ geral. Mas coloca uma referência nova no topo do recorte aberto.
Os três nomes que você vai cruzar com frequência
Atrás do MiMo, três modelos concentram a conversa:
- gpt-oss-120b (OpenAI) — 117B totais, 5,1B ativos, IQ 24,126. É o mais barato do recorte com raciocínio de verdade: US$ 0,17 por milhão de saída. Tem nota de coding (30,441) e agentic (13,425) publicadas, o que o MiMo ainda não tem.
- Devstral 2 2512 (Mistral) — 125B densos, sem MoE, IQ 19,242. É o melhor do recorte em coding (31,259) e o único francês da lista. Sai por US$ 2 por milhão de saída.
- Qwen3 Next 80B A3B Thinking (Alibaba) — 80B totais, 3B ativos, raciocínio por padrão. IQ 16,867, saída a US$ 1,20.
| Modelo | Criador | Inteligência | Saída US$/M | Contexto |
|---|---|---|---|---|
| MiMo-V2-Flash | xiaomi | 34.0 | 0.3 | 262k |
| gpt-oss-120b | openai | 24.1 | 0.17 | 131k |
| Devstral 2 2512 | mistralai | 19.2 | 2 | 262k |
| Qwen3 Next 80B A3B Thinking | qwen | 16.9 | 1.2 | 262k |
| Mistral Large 3 2512 | mistralai | 15.9 | 1.5 | 262k |
| INTELLECT-3 | prime-intellect | 15.7 | 1.1 | 131k |
| gpt-oss-20b | openai | 15.2 | 0.13 | 131k |
| Nemotron 3 Nano 30B A3B | nvidia | 14.5 | 0.2 | 262k |
O que mudou na régua de preço
A leitura antiga dizia: modelo aberto é mais barato, modelo fechado é mais capaz. A leitura de hoje, olhando os 26 do recorte: a fronteira de capacidade está dentro do recorte aberto, e o preço de entrada para raciocínio sério gira em torno de US$ 0,13 a US$ 0,30 por milhão de saída. O gpt-oss-20b, da própria OpenAI, cobra US$ 0,13 — e ainda é um MoE de 21B com 3,6B ativos.
Para quem está comparando fechado versus aberto na mesma faixa de capacidade: o Claude Haiku 4.5 sai por US$ 5, o o3 por US$ 8. O Devstral 2, melhor que os dois em coding, sai por US$ 2. O MiMo, melhor que os dois em IQ geral, sai por US$ 0,30.
Para quem isso muda a conta — e para quem não muda
Se você roda agente de coding, Devstral 2 e gpt-oss-120b são os dois nomes para colocar na fila. Se você precisa de raciocínio geral com contexto longo e quer manter o peso em casa, MiMo e Qwen3 Next Thinking são as opções de hoje. Se o seu caso é multimodal (texto + imagem + arquivo), só o Mistral Large 3 2512, dos modelos abertos do recorte, cobre — e ainda assim é mais barato que o Haiku.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Para quem já está preso a um stack fechado por contrato, integração ou requisito de compliance que impeça auto-hospedagem, nada disso muda amanhã. Mas o argumento "aberto é mais barato" virou "aberto é mais barato e, em algumas métricas, está na frente". É uma frase diferente.
O próximo teste
O MiMo lidera em IQ geral, mas o catálogo não publicou coding e agentic para ele. Quando esses números aparecerem, a conversa muda de novo — porque o Devstral 2 hoje vence em coding com folga, e o gpt-oss-120b entrega agentic medido. Até lá, a regra prática é: Xiaomi para raciocínio geral barato, Mistral para coding, OpenAI aberta para o meio-termo com métricas publicadas.
Se você roda agente de coding ou raciocínio geral e pode auto-hospedar, o recorte aberto de hoje já entrega capacidade de topo por uma fração do preço fechado — começa por Devstral 2, gpt-oss-120b ou MiMo-V2-Flash conforme a tarefa.
Perguntas frequentes
Quantos modelos com pesos abertos existem no catálogo hoje?
São 26 modelos com pesos abertos no catálogo de 327 listados em 3 de fevereiro de 2026. É um piso: modelos removidos depois não aparecem, então o número histórico pode ter sido maior.
Qual o modelo aberto mais barato com raciocínio?
O gpt-oss-20b, da OpenAI, cobra US$ 0,13 por milhão de tokens de saída e US$ 0,03 de entrada. É um MoE de 21B com 3,6B ativos por passagem e IQ 15,225.
O MiMo-V2-Flash da Xiaomi é realmente melhor que o o3?
No índice de inteligência geral do catálogo, sim: 34,024 contra 31,096. Mas o o3 tem métricas de coding e agentic publicadas que o MiMo ainda não tem, então a comparação completa depende do tipo de tarefa.