INTELLECT-3 chega por US$ 1,10 e empurra gpt-oss-20b para encruzilhada de preço
Dois modelos abertos americanos com MoE disputam a faixa dos US$ 0,13 a US$ 1,10 por milhão de tokens de saída — e a diferença não está só no preço.
O que o lançamento de 27 de novembro muda de verdade
A Prime Intellect soltou o INTELLECT-3 há dois dias, em 27 de novembro de 2025, e o catálogo já trata como caso sério: modelo aberto, 106B parâmetros totais com 12B ativos por passada, treinado a partir do GLM-4.5-Air-Base com SFT e reinforcement learning em larga escala. O índice de inteligência Artificial Analysis marca 15,718, enquanto o gpt-oss-20b — open-weight da OpenAI, lançado em agosto — marca 15,225. Meia unidade de IQ separa os dois, mas a conta de API fala outra língua.
A conta que ninguém quer ver
A diferença brutal está no preço de saída. O INTELLECT-3 cobra US$ 1,10 por milhão de tokens; o gpt-oss-20b, US$ 0,13. São 8,5 vezes mais caro por token gerado. No input, a diferença também pesa: US$ 0,20 contra US$ 0,03 por milhão — quase 7x. O gpt-oss-20b ainda oferece cache de leitura a US$ 0,03, vantagem que o INTELLECT-3 não publicou.
Traduzindo o release da Prime Intellect: o marketing fala em "state-of-the-art para o tamanho". O tamanho aqui é 106B com 12B ativos — Mixture-of-Experts puro, mesma família arquitetural do rival. O que muda é o pós-treinamento e o orçamento que você topa gastar.
Tamanho, contexto e o que cada um entrega
Os dois são text-to-text, reasoning nativo, 131k de contexto e origem americana. Pesam diferente na infra: 21B parâmetros totais e 3,6B ativos no gpt-oss-20b contra 107B e 12B ativos no INTELLECT-3. Em outras palavras, o INTELLECT-3 é quase cinco vezes maior em parâmetros totais, o que explica parte do preço — MoE cobra pela inferência completa, não só pelos parâmetros ativos que você vê na conversa.
| Critério | INTELLECT-3 | gpt-oss-20b |
|---|---|---|
| Índice de inteligência | 15.7 | 15.2 |
| Entrada US$/M | 0.2 | 0.03 |
| Saída US$/M | 1.1 | 0.13 |
| Contexto | 131k | 131k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | — | 113 |
| Índice de código | — | 20.7 |
| Índice agêntico | — | 3.1 |
Para tarefas com benchmark específico, o gpt-oss-20b tem números publicados que o INTELLECT-3 ainda não expôs: coding em 20,697, agentic em 3,103 e blended em 0,0925. O INTELLECT-3 chega com promessa de performance em matemática e reasoning no tamanho, mas sem números granulares no catálogo ainda. Velocidade? Só o gpt-oss-20b publicou: 112,6 tokens por segundo.
Onde cada um ganha
INTELLECT-3 ganha quando você precisa de um modelo aberto americano razoavelmente capaz para raciocínio geral e topa pagar caro por isso. É a opção para quem quer um MoE grande de laboratório americano, pós-treinado com RL pesado, e não liga de gastar quase dez vezes mais por token. Faz sentido em cargas pequenas, em eval interno, em testes A/B onde a inteligência bruta pesa mais que o cents por milhão.
gpt-oss-20b ganha em qualquer cenário sensível a custo. Coding a 20,7, agentic a 3,1, e ainda por cima é barato. Para produção com volume, chatbots, pipelines de extração, geração em massa — o gpt-oss-20b entrega quase a mesma inteligência por uma fração do preço. O cache de leitura a US$ 0,03 vira uma economia real quando você repete system prompts longos.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| INTELLECT-3 | 15.7 | 1.1 |
Para o leitor que paga a conta: se o seu workload passa de alguns milhões de tokens por mês, o INTELLECT-3 não compete. Reserve-o para benchmarking e experimentação pontual. Para o resto, o gpt-oss-20b segue sendo o open-weight com melhor relação entre IQ medido e preço de prateleira — e a Prime Intellect, por enquanto, só vende a versão cara.
Use o gpt-oss-20b para qualquer carga com volume em produção e reserve o INTELLECT-3 para eval e experimentação pontual — até a Prime Intellect publicar preço agressivo, a economia não fecha.
Perguntas frequentes
INTELLECT-3 é melhor que gpt-oss-20b em inteligência?
Marginalmente: 15,718 contra 15,225 no índice Artificial Analysis medido hoje. Meia unidade de IQ não justifica pagar 8,5 vezes mais por token de saída na maioria dos workloads.
Por que o INTELLECT-3 é tão mais caro?
É um MoE de 106B parâmetros totais com 12B ativos, quase cinco vezes maior que o gpt-oss-20b em tamanho total. MoE grande custa mais para servir, e o preço de US$ 1,10 por milhão de tokens reflete isso.
Qual tem cache de leitura mais barato?
O gpt-oss-20b, a US$ 0,03 por milhão de tokens. O INTELLECT-3 não publicou preço de cache no catálogo até esta data.