FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Os 26 modelos de pesos abertos do catálogo custam menos que um almoço — mas só alguns valem o que você paga

Xiaomi, Mistral e OpenAI dominam o topo do recorte; metade dos modelos abertos fica abaixo de IQ 16 e disputa por centavos.

Redação FalaVIP IA 3 min de leitura
US$ 0,30por milhão de tokens de saída do MiMo-V2-Flash, líder do recorte
26modelos com pesos abertos no catálogo de 327
IQ 34,024MiMo-V2-Flash, o mais inteligente do recorte de pesos abertos

A diferença entre o que o release diz e o que a fatura mostra

Você já deve ter lido que modelos de pesos abertos são “baratos”. Mas barato em relação a quê, e barato para fazer o quê? Quando você abre o catálogo hoje e filtra só os 26 modelos com pesos abertos, o que aparece é um clube estranho: o topo é ocupado por um modelo chinês da Xiaomi que custa US$ 0,10 por milhão de tokens de entrada e US$ 0,30 por milhão de saída — MiMo-V2-Flash, IQ 34,024. Logo abaixo vem o gpt-oss-120b da OpenAI, com IQ 24,126 e preço ainda menor: US$ 0,17 por milhão de saída. Aí você olha para o terceiro colocado, o Claude Haiku 4.5 da Anthropic, e lembra que ele nem está nessa lista — porque não tem pesos abertos. É essa a primeira tensão: o melhor do recorte aberto não é o melhor do mercado geral, e o melhor do mercado geral não está no recorte aberto.

Inteligência × preço no recorte
MiMo-V2-Flashgpt-oss-120bDevstral 2 2512Qwen3 Next 80B A3B ThinkingMistral Large 3 2512INTELLECT-3gpt-oss-20bNemotron 3 Nano 30B A3BUS$ por milhão (saída, escala log)índice de inteligência

O topo do recorte é chinês, francês e americano — nesta ordem

Dos oito modelos destacados no recorte, três vêm da China (Xiaomi, Qwen), dois da França (Mistral), dois dos Estados Unidos (OpenAI, NVIDIA) e um dos EUA também (Prime Intellect). A geografia importa porque o país do criador diz quem você está contratando de verdade: o servidor de inferência, a licença, o suporte. Mistral, por exemplo, libera o Devstral 2 2512 sob licença aberta e mantém preço de US$ 2 por milhão de tokens de saída — quase sete vezes o valor cobrado pela Xiaomi no topo. Mas o Devstral 2 tem um trunfo que o MiMo não entrega do mesmo jeito: ele foi desenhado para coding agentic e marca 31,259 nesse benchmark, contra um índice de coding não publicado para o modelo da Xiaomi.

Metade do recorte não passa de IQ 16

Aqui está o padrão que justifica o título. Dos oito modelos com dados completos no recorte, quatro ficam abaixo de IQ 16: Mistral Large 3 2512 (15,919), INTELLECT-3 da Prime Intellect (15,718), gpt-oss-20b (15,225) e Nemotron 3 Nano 30B A3B (14,538). É um vale grande entre o líder e o meio do pacote. Para quem está escolhendo modelo, isso significa que “pesos abertos” não é sinônimo de “modelo bom”: é um guarda-chuva que cobre desde o melhor custo-benefício do mercado aberto até opções intermediárias que disputam por centavos. O preço de saída do Nemotron 3 Nano, US$ 0,20 por milhão, é menor que o do MiMo — mas o IQ também é.

Destaques do recorte: pesos abertos
ModeloCriadorInteligênciaSaída US$/MContexto
MiMo-V2-Flashxiaomi34.00.3262k
gpt-oss-120bopenai24.10.17131k
Devstral 2 2512mistralai19.22262k
Qwen3 Next 80B A3B Thinkingqwen16.91.2262k
Mistral Large 3 2512mistralai15.91.5262k
INTELLECT-3prime-intellect15.71.1131k
gpt-oss-20bopenai15.20.13131k
Nemotron 3 Nano 30B A3Bnvidia14.50.2262k

Para quem isso vale — e para quem não muda nada

Vale para quem roda inferência própria, em GPU dedicada, e quer pagar só pelo que usa sem amarrar a um fornecedor. Vale para times que precisam de auditoria do modelo e querem abrir os pesos. Vale para startups que negociam contrato com cliente corporativo e precisam mostrar que o modelo não é uma caixa-preta. Não muda nada para quem usa API fechada e está satisfeito: o Claude Haiku 4.5, que não está no recorte, ainda lidera em IQ entre os modelos pequenos de peso fechado, e o o3 da OpenAI continua sendo o segundo colocado geral do catálogo inteiro com IQ 31,096. A conta da API não mente: se o seu gargalo é qualidade bruta e você não vai hospedar, o recorte aberto não é onde está a resposta.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 327 modelos disponíveis no catálogo nesta data.

O que fazer com isso hoje

Olhe o gráfico de custo-benefício antes de escolher pelo nome. Se o seu caso é coding agentic, o Devstral 2 entrega o melhor benchmark da categoria dentro do recorte aberto, e o gpt-oss-120b é a segunda opção com a vantagem de ser mais barato para sair (US$ 0,17 contra US$ 2 por milhão). Se o caso é raciocínio geral e você pode hospedar, o MiMo-V2-Flash da Xiaomi é o melhor IQ pelo menor preço do recorte — e é a primeira vez que um modelo chinês lidera esse recorte específico. Se o caso é multimodal com imagem, o Mistral Large 3 2512 é o único do pacote que aceita imagem e arquivo, com IQ 15,919. E se a conta da API dói, vale testar o gpt-oss-20b: IQ 15,225, US$ 0,13 por milhão de saída, e roda em hardware menor porque ativa só 3,6 bilhões de parâmetros por passada.

Em uma frase

Antes de migrar para pesos abertos, rode o gráfico de IQ × preço no seu caso de uso: o melhor do recorte não é o mais barato, e o mais barato não é o melhor — mas a diferença entre eles cabe em centavos por milhão de tokens.

Perguntas frequentes

Qual é o modelo de pesos abertos com maior IQ hoje?

É o Xiaomi MiMo-V2-Flash, com IQ 34,024 e preço de US$ 0,30 por milhão de tokens de saída. É também o único do recorte acima de IQ 30.

Pesos abertos é sempre mais barato que API fechada?

Nem sempre. O Devstral 2 da Mistral cobra US$ 2 por milhão de saída, mais caro que o Claude Haiku 4.5 em alguns cenários. A vantagem do aberto está no custo de hospedagem própria e na ausência de amarração com fornecedor, não necessariamente no preço de tabela.

Quantos modelos de pesos abertos existem no catálogo?

São 26 modelos com pesos abertos listados hoje, de um total de mais de 327. É um recorte pequeno em volume, mas é onde estão algumas das melhores relações de custo-benefício do mercado.

Leia também