FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

INTELLECT-3 chega por US$ 1,10 e empurra gpt-oss-20b para encruzilhada de preço

Dois modelos abertos americanos com MoE disputam a faixa dos US$ 0,13 a US$ 1,10 por milhão de tokens de saída — e a diferença não está só no preço.

Redação FalaVIP IA 2 min de leitura
US$ 1,10por milhão de tokens de saída do INTELLECT-3
US$ 0,13por milhão de tokens de saída do gpt-oss-20b
8,5xdiferença de preço por token de saída entre os dois

O que o lançamento de 27 de novembro muda de verdade

A Prime Intellect soltou o INTELLECT-3 há dois dias, em 27 de novembro de 2025, e o catálogo já trata como caso sério: modelo aberto, 106B parâmetros totais com 12B ativos por passada, treinado a partir do GLM-4.5-Air-Base com SFT e reinforcement learning em larga escala. O índice de inteligência Artificial Analysis marca 15,718, enquanto o gpt-oss-20b — open-weight da OpenAI, lançado em agosto — marca 15,225. Meia unidade de IQ separa os dois, mas a conta de API fala outra língua.

Índice de inteligência (Artificial Analysis)
INTELLECT-315,7gpt-oss-20b15,2índice
Fonte: Artificial Analysis

A conta que ninguém quer ver

A diferença brutal está no preço de saída. O INTELLECT-3 cobra US$ 1,10 por milhão de tokens; o gpt-oss-20b, US$ 0,13. São 8,5 vezes mais caro por token gerado. No input, a diferença também pesa: US$ 0,20 contra US$ 0,03 por milhão — quase 7x. O gpt-oss-20b ainda oferece cache de leitura a US$ 0,03, vantagem que o INTELLECT-3 não publicou.

Preço de saída (US$ por milhão de tokens)
INTELLECT-31,1gpt-oss-20b0,13US$/M
Fonte: OpenRouter

Traduzindo o release da Prime Intellect: o marketing fala em "state-of-the-art para o tamanho". O tamanho aqui é 106B com 12B ativos — Mixture-of-Experts puro, mesma família arquitetural do rival. O que muda é o pós-treinamento e o orçamento que você topa gastar.

Tamanho, contexto e o que cada um entrega

Os dois são text-to-text, reasoning nativo, 131k de contexto e origem americana. Pesam diferente na infra: 21B parâmetros totais e 3,6B ativos no gpt-oss-20b contra 107B e 12B ativos no INTELLECT-3. Em outras palavras, o INTELLECT-3 é quase cinco vezes maior em parâmetros totais, o que explica parte do preço — MoE cobra pela inferência completa, não só pelos parâmetros ativos que você vê na conversa.

INTELLECT-3 × gpt-oss-20b
CritérioINTELLECT-3gpt-oss-20b
Índice de inteligência15.715.2
Entrada US$/M0.20.03
Saída US$/M1.10.13
Contexto131k131k
Pesos abertossimsim
Velocidade (tok/s)113
Índice de código20.7
Índice agêntico3.1

Para tarefas com benchmark específico, o gpt-oss-20b tem números publicados que o INTELLECT-3 ainda não expôs: coding em 20,697, agentic em 3,103 e blended em 0,0925. O INTELLECT-3 chega com promessa de performance em matemática e reasoning no tamanho, mas sem números granulares no catálogo ainda. Velocidade? Só o gpt-oss-20b publicou: 112,6 tokens por segundo.

Onde cada um ganha

INTELLECT-3 ganha quando você precisa de um modelo aberto americano razoavelmente capaz para raciocínio geral e topa pagar caro por isso. É a opção para quem quer um MoE grande de laboratório americano, pós-treinado com RL pesado, e não liga de gastar quase dez vezes mais por token. Faz sentido em cargas pequenas, em eval interno, em testes A/B onde a inteligência bruta pesa mais que o cents por milhão.

gpt-oss-20b ganha em qualquer cenário sensível a custo. Coding a 20,7, agentic a 3,1, e ainda por cima é barato. Para produção com volume, chatbots, pipelines de extração, geração em massa — o gpt-oss-20b entrega quase a mesma inteligência por uma fração do preço. O cache de leitura a US$ 0,03 vira uma economia real quando você repete system prompts longos.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
INTELLECT-315.71.1
Entre os 282 modelos disponíveis no catálogo nesta data.

Para o leitor que paga a conta: se o seu workload passa de alguns milhões de tokens por mês, o INTELLECT-3 não compete. Reserve-o para benchmarking e experimentação pontual. Para o resto, o gpt-oss-20b segue sendo o open-weight com melhor relação entre IQ medido e preço de prateleira — e a Prime Intellect, por enquanto, só vende a versão cara.

Em uma frase

Use o gpt-oss-20b para qualquer carga com volume em produção e reserve o INTELLECT-3 para eval e experimentação pontual — até a Prime Intellect publicar preço agressivo, a economia não fecha.

Perguntas frequentes

INTELLECT-3 é melhor que gpt-oss-20b em inteligência?

Marginalmente: 15,718 contra 15,225 no índice Artificial Analysis medido hoje. Meia unidade de IQ não justifica pagar 8,5 vezes mais por token de saída na maioria dos workloads.

Por que o INTELLECT-3 é tão mais caro?

É um MoE de 106B parâmetros totais com 12B ativos, quase cinco vezes maior que o gpt-oss-20b em tamanho total. MoE grande custa mais para servir, e o preço de US$ 1,10 por milhão de tokens reflete isso.

Qual tem cache de leitura mais barato?

O gpt-oss-20b, a US$ 0,03 por milhão de tokens. O INTELLECT-3 não publicou preço de cache no catálogo até esta data.

Leia também