Prime Intellect lança INTELLECT-3: 106B parâmetros, US$ 1,10 por milhão de saída
MoE open-weights com 12B ativos chega ao catálogo custando quase 90% menos que o3 por token de saída
O que mudou de verdade na conta
Você viu o anúncio de um modelo novo, abriu o catálogo e foi direto na pergunta que importa: quanto custa o token de saída, e quanto eu levo de inteligência por esse preço. O INTELLECT-3, da Prime Intellect, chegou hoje ao catálogo cobrando US$ 1,10 por milhão de tokens de saída e US$ 0,20 por milhão de entrada. Em números de quem paga API, isso é quase 13 vezes mais barato que o o3 da OpenAI no output (US$ 8/M) e mais de 7 vezes mais barato que o Claude Haiku 4.5 (US$ 5/M). É também mais barato que o gpt-oss-120b da própria OpenAI, que cobra US$ 0,17 de saída — mas atenção, esse é o único que fica abaixo do INTELLECT-3 em preço de output.
O que o INTELLECT-3 é, sem o marketing
A Prime Intellect descreve o INTELLECT-3 como um modelo Mixture-of-Experts de 106 bilhões de parâmetros, com 12B ativos por inferência. Traduzindo: o modelo tem o tamanho de um cérebro grande, mas só usa uma fração dele a cada token que gera — é como um restaurante com 106 chefs no quadro, mas só 12 cozinham cada prato. Foi pós-treinado a partir do GLM-4.5-Air-Base via SFT seguido de RL em larga escala, é um modelo de raciocínio (reasoning), tem contexto de 131.072 tokens e é open weights, ou seja, dá pra baixar e rodar onde você quiser.
| Campo | Valor |
|---|---|
| Identificador | prime-intellect/intellect-3 |
| Criador | prime-intellect |
| Preço de entrada | US$ 0.200 / M tokens |
| Preço de saída | US$ 1.10 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
| Índice de inteligência (AA) | 15.7 |
| Parâmetros | 107B (12B ativos por token) |
| Pesos | abertos |
| Raciocínio | sim (gasta tokens de saída pensando) |
Onde ele se encaixa no tabuleiro
No índice de inteligência atual, o INTELLECT-3 marca 15,718 — bem abaixo do o3 (31,096), do Claude Haiku 4.5 (29,892) e do gpt-oss-120b (24,126). Em outras palavras: ele não entra na disputa pelo topo da régua. O que ele oferece é um custo por ponto de inteligência radicalmente menor que os dois primeiros colocados.
Olhando o gráfico de dispersão, o INTELLECT-3 ocupa uma região que os modelos frontier não visitam: inteligência mediana com preço de saída baixo. Para workloads onde cada centavo por token pesa — classificação em massa, sumarização, geração de rascunhos, agentes que precisam de raciocínio barato — esse é exatamente o quadrante que importa.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| INTELLECT-3 (o novo) | 15.7 | 0.2 | 1.1 | 131k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
Para quem vale e para quem não muda nada
Vale para você se: roda volume alto e quer manter raciocínio na pipeline sem estourar a fatura; quer open weights pra hospedar em GPU própria e cortar a API do meio; precisa de contexto de 128k com preço de entrada agressivo (US$ 0,20/M é competitivo até entre os modelos não-racionais).
Não muda nada se: você está extraindo o máximo de inteligência possível por dólar em tarefas onde cada ponto de IQ vale o output caro do o3 ou do Claude Haiku 4.5 — benchmarks difíceis, code review de PRs complexos, planejamento multi-etapa onde erro custa caro. Nesses casos, pagar US$ 8/M de saída pelo o3 ainda é a conta certa. Também não muda nada se você já roda o gpt-oss-120b: o modelo da OpenAI continua mais barato no output (US$ 0,17 vs. US$ 1,10) e com índice de inteligência maior.
O tabuleiro em 27 de novembro
O catálogo fechou o dia com 282 modelos listados de 44 criadores, e 17 lançamentos nos últimos 30 dias. O topo do ranking segue dominado por OpenAI e Anthropic, com a Qwen3 Next 80B A3B Thinking em quarto (IQ 16,867, US$ 1,20/M de saída). O INTELLECT-3 entra logo abaixo desse bloco, na faixa dos modelos de raciocínio de baixo custo. A Prime Intellect, criadora americana, agora tem um cartão de visita com peso: open weights, MoE enxuto, preço agressivo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| INTELLECT-3 | 15.7 | 1.1 |
O que fazer com isso hoje
Se você tem um agente que consome muito token de saída e hoje roda em Haiku 4.5 ou o3, vale um teste A/B com INTELLECT-3: o custo cai por um fator de 5x a 13x, e o índice de inteligência é metade — então a pergunta certa não é "ele é melhor?", é "ele é bom o suficiente pelo preço que cobra?". Se a resposta for sim, a economia mensal pode pagar outra feature. Se for não, o Haiku 4.5 continua sendo o meio-termo mais equilibrado entre os modelos fechados.
Se o seu gargalo é custo de output e não exige o topo da régua de inteligência, teste o INTELLECT-3 antes de renovar a fatura do Haiku 4.5 ou do o3 — a economia é de 5x a 13x por token de saída.
Perguntas frequentes
Quanto custa o INTELLECT-3 da Prime Intellect?
Cobra US$ 0,20 por milhão de tokens de entrada e US$ 1,10 por milhão de tokens de saída. Não há cache publicado nem modalidade gratuita no catálogo.
INTELLECT-3 é open weights?
Sim. É um modelo Mixture-of-Experts de 106B parâmetros (12B ativos) com pesos abertos, pós-treinado a partir do GLM-4.5-Air-Base via SFT e reinforcement learning.
INTELLECT-3 é melhor que o o3 ou o Claude Haiku 4.5?
Não em inteligência bruta: o índice atual coloca o3 em 31,096, Haiku 4.5 em 29,892 e o INTELLECT-3 em 15,718. A vantagem do INTELLECT-3 está no preço por token de saída, não na régua de capacidade.