FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

12 modelos com pesos abertos, mas só 4 valem a conta

O catálogo aberto soma 12 opções; o recorte mostra que metade fica abaixo de IQ 14 e só um passa dos 24.

Redação FalaVIP IA 3 min de leitura
12modelos com pesos abertos no catálogo
US$ 0,17por milhão de tokens de saída do gpt-oss-120b
IQ 24,126maior nota de inteligência do recorte (gpt-oss-120b)

O catálogo aberto é menor do que parece

Dos 227 modelos listados hoje, só 12 soltam os pesos. É um punhado — e, quando você coloca esse punhado num gráfico de inteligência por preço, o que sobra é ainda menor.

A conta é simples: dos 12, oito têm IQ abaixo de 14. O topo do recorte, o gpt-oss-120b da OpenAI, marca IQ 24,126 cobrando US$ 0,17 por milhão de tokens de saída. Logo abaixo dele, o Qwen3 Next 80B A3B Thinking chega a IQ 16,867 por US$ 1,20 — quase sete vezes mais caro na saída. O terceiro lugar, gpt-oss-20b, custa US$ 0,13 de saída e entrega IQ 15,225.

Inteligência × preço no recorte
gpt-oss-120bQwen3 Next 80B A3B Thinkinggpt-oss-20bLlama 4 MaverickQwen3 Next 80B A3B InstructLlama 4 ScoutLlama 3.3 70B InstructERNIE 4.5 300B A47B US$ por milhão (saída, escala log)índice de inteligência

Traduzindo o marketing: "aberto" não significa "barato", e "barato" não significa "bom". O que você quer saber é qual cruzamento de IQ e preço faz sentido para o seu caso.

Os quatro que merecem a sua atenção

O gpt-oss-120b é o caso óbvio: maior IQ do recorte, preço de saída de US$ 0,17, contexto de 131 mil tokens. É um MoE de 117B com 5,1B ativos por passagem — pense num restaurante com 117 chefs no quadro, mas só 5,1 cozinham de cada vez. O custo de servir a mesa cai, a conta segue alta.

O Qwen3 Next 80B A3B Thinking, lançado há cinco dias, é o segundo em IQ e o único do recorte com raciocínio nativo que passa dos 16 pontos. Sai por US$ 1,20 por milhão de tokens de saída, contexto de 262 mil. Se você precisa de cadeia de pensamento explícita e pode pagar, ele está aqui.

O gpt-oss-20b é o primo pobre do primeiro: mesmo criador, mesma data de lançamento (5 de agosto), IQ 15,225, mas preço de entrada de US$ 0,03 por milhão e cache de US$ 0,03. Para quem roda volume, é o melhor custo do recorte.

O Llama 4 Maverick, da Meta, é o único multimodal do grupo: aceita imagem, contexto de 1 milhão de tokens, IQ 14,477, saída a US$ 0,696. Não é o mais barato nem o mais inteligente, mas é o que abre imagem sem fechar o orçamento.

Destaques do recorte: pesos abertos
ModeloCriadorInteligênciaSaída US$/MContexto
gpt-oss-120bopenai24.10.17131k
Qwen3 Next 80B A3B Thinkingqwen16.91.2262k
gpt-oss-20bopenai15.20.13131k
Llama 4 Maverickmeta-llama14.50.6961.05M
Qwen3 Next 80B A3B Instructqwen13.81.1262k
Llama 4 Scoutmeta-llama10.30.31.31M
Llama 3.3 70B Instructmeta-llama9.30.32131k
ERNIE 4.5 300B A47B baidu8.91.1131k

Para quem cada um vale — e para quem nada muda

Se você está migrando de um modelo fechado e quer manter o controle do peso, o gpt-oss-120b é a primeira opção a testar. Se o gargalo é custo por requisição e não qualidade, o gpt-oss-20b é o que entra no lugar. Se você precisa de multimodal aberto, o Maverick é o único caminho hoje.

Para quem já roda um modelo fechado acima de IQ 30 — caso do OpenAI o3, que lidera o catálogo com IQ 31,096 a US$ 8 por milhão de saída — nenhum dos 12 troca o seu setup. O ganho está no controle, não na nota.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 227 modelos disponíveis no catálogo nesta data.

O tabuleiro hoje

Dos 12 modelos abertos, 4 vêm dos Estados Unidos (OpenAI e Meta) e 3 da China (Qwen e Baidu). O restante se espalha por outros criadores. O dado geográfico importa porque os pesos abertos americanos tendem a licença Apache ou similar; os chineses costumam vir com restrições de uso que variam caso a caso — vale ler a licença antes de colocar em produção.

Dos 13 modelos lançados nos últimos 30 dias, dois estão neste recorte: os dois Qwen3 Next. O restante dos lançamentos do mês é de pesos fechados.

O que fazer com isso

Se você paga a API e quer testar um modelo aberto sem trocar de fornecedor, comece pelo gpt-oss-120b: melhor IQ do recorte, preço de saída baixo, raciocínio nativo. Se o orçamento for o limite, o gpt-oss-20b cobre 80% do caminho por uma fração do custo. Multimodal aberto é Maverick, sem alternativa no recorte. E se você está acima de IQ 30 com modelo fechado, este artigo é só um mapa — não um motivo para migrar.

Em uma frase

Comece pelo gpt-oss-120b se quer o melhor IQ aberto; vá de gpt-oss-20b se o que importa é custo por token; só considere o Maverick se precisar de imagem.

Perguntas frequentes

Quantos modelos com pesos abertos existem no catálogo hoje?

São 12 modelos com pesos abertos listados no catálogo, de um total de mais de 227. O número é um piso: modelos removidos depois não aparecem.

Qual modelo aberto tem o melhor custo-benefício em setembro de 2025?

Depende do que você pesa. Pelo IQ por dólar de saída, o gpt-oss-120b lidera com IQ 24,126 a US$ 0,17 por milhão de tokens. Pelo menor preço absoluto, o gpt-oss-20b entrega IQ 15,225 a US$ 0,13 de saída.

Modelo aberto substitui um modelo fechado de topo?

Não no recorte de hoje. O OpenAI o3 lidera o catálogo com IQ 31,096; o melhor aberto, gpt-oss-120b, chega a 24,126. A troca faz sentido por controle de pesos e custo, não por nota bruta.

Leia também