FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Prime Intellect lança INTELLECT-3: 106B parâmetros, US$ 1,10 por milhão de saída

MoE open-weights com 12B ativos chega ao catálogo custando quase 90% menos que o3 por token de saída

Redação FalaVIP IA 3 min de leitura
US$ 1,10por milhão de tokens de saída
US$ 0,20por milhão de tokens de entrada
106B / 12B ativosparâmetros totais vs. ativos

O que mudou de verdade na conta

Você viu o anúncio de um modelo novo, abriu o catálogo e foi direto na pergunta que importa: quanto custa o token de saída, e quanto eu levo de inteligência por esse preço. O INTELLECT-3, da Prime Intellect, chegou hoje ao catálogo cobrando US$ 1,10 por milhão de tokens de saída e US$ 0,20 por milhão de entrada. Em números de quem paga API, isso é quase 13 vezes mais barato que o o3 da OpenAI no output (US$ 8/M) e mais de 7 vezes mais barato que o Claude Haiku 4.5 (US$ 5/M). É também mais barato que o gpt-oss-120b da própria OpenAI, que cobra US$ 0,17 de saída — mas atenção, esse é o único que fica abaixo do INTELLECT-3 em preço de output.

Preço de saída (US$ por milhão de tokens)
INTELLECT-31,1o38Claude Haiku 4.55gpt-oss-120b0,17US$/M
Fonte: OpenRouter

O que o INTELLECT-3 é, sem o marketing

A Prime Intellect descreve o INTELLECT-3 como um modelo Mixture-of-Experts de 106 bilhões de parâmetros, com 12B ativos por inferência. Traduzindo: o modelo tem o tamanho de um cérebro grande, mas só usa uma fração dele a cada token que gera — é como um restaurante com 106 chefs no quadro, mas só 12 cozinham cada prato. Foi pós-treinado a partir do GLM-4.5-Air-Base via SFT seguido de RL em larga escala, é um modelo de raciocínio (reasoning), tem contexto de 131.072 tokens e é open weights, ou seja, dá pra baixar e rodar onde você quiser.

Ficha técnica — INTELLECT-3
CampoValor
Identificadorprime-intellect/intellect-3
Criadorprime-intellect
Preço de entradaUS$ 0.200 / M tokens
Preço de saídaUS$ 1.10 / M tokens
Janela de contexto131k
Modalidadetext->text
Índice de inteligência (AA)15.7
Parâmetros107B (12B ativos por token)
Pesosabertos
Raciocíniosim (gasta tokens de saída pensando)

Onde ele se encaixa no tabuleiro

No índice de inteligência atual, o INTELLECT-3 marca 15,718 — bem abaixo do o3 (31,096), do Claude Haiku 4.5 (29,892) e do gpt-oss-120b (24,126). Em outras palavras: ele não entra na disputa pelo topo da régua. O que ele oferece é um custo por ponto de inteligência radicalmente menor que os dois primeiros colocados.

Índice de inteligência (Artificial Analysis)
INTELLECT-315,7o331,1Claude Haiku 4.529,9gpt-oss-120b24,1índice
Fonte: Artificial Analysis

Olhando o gráfico de dispersão, o INTELLECT-3 ocupa uma região que os modelos frontier não visitam: inteligência mediana com preço de saída baixo. Para workloads onde cada centavo por token pesa — classificação em massa, sumarização, geração de rascunhos, agentes que precisam de raciocínio barato — esse é exatamente o quadrante que importa.

Inteligência × preço de saída
INTELLECT-3o3Claude Haiku 4.5gpt-oss-120bUS$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
INTELLECT-3 (o novo)15.70.21.1131k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale e para quem não muda nada

Vale para você se: roda volume alto e quer manter raciocínio na pipeline sem estourar a fatura; quer open weights pra hospedar em GPU própria e cortar a API do meio; precisa de contexto de 128k com preço de entrada agressivo (US$ 0,20/M é competitivo até entre os modelos não-racionais).

Não muda nada se: você está extraindo o máximo de inteligência possível por dólar em tarefas onde cada ponto de IQ vale o output caro do o3 ou do Claude Haiku 4.5 — benchmarks difíceis, code review de PRs complexos, planejamento multi-etapa onde erro custa caro. Nesses casos, pagar US$ 8/M de saída pelo o3 ainda é a conta certa. Também não muda nada se você já roda o gpt-oss-120b: o modelo da OpenAI continua mais barato no output (US$ 0,17 vs. US$ 1,10) e com índice de inteligência maior.

O tabuleiro em 27 de novembro

O catálogo fechou o dia com 282 modelos listados de 44 criadores, e 17 lançamentos nos últimos 30 dias. O topo do ranking segue dominado por OpenAI e Anthropic, com a Qwen3 Next 80B A3B Thinking em quarto (IQ 16,867, US$ 1,20/M de saída). O INTELLECT-3 entra logo abaixo desse bloco, na faixa dos modelos de raciocínio de baixo custo. A Prime Intellect, criadora americana, agora tem um cartão de visita com peso: open weights, MoE enxuto, preço agressivo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
INTELLECT-315.71.1
Entre os 282 modelos disponíveis no catálogo nesta data.

O que fazer com isso hoje

Se você tem um agente que consome muito token de saída e hoje roda em Haiku 4.5 ou o3, vale um teste A/B com INTELLECT-3: o custo cai por um fator de 5x a 13x, e o índice de inteligência é metade — então a pergunta certa não é "ele é melhor?", é "ele é bom o suficiente pelo preço que cobra?". Se a resposta for sim, a economia mensal pode pagar outra feature. Se for não, o Haiku 4.5 continua sendo o meio-termo mais equilibrado entre os modelos fechados.

Em uma frase

Se o seu gargalo é custo de output e não exige o topo da régua de inteligência, teste o INTELLECT-3 antes de renovar a fatura do Haiku 4.5 ou do o3 — a economia é de 5x a 13x por token de saída.

Perguntas frequentes

Quanto custa o INTELLECT-3 da Prime Intellect?

Cobra US$ 0,20 por milhão de tokens de entrada e US$ 1,10 por milhão de tokens de saída. Não há cache publicado nem modalidade gratuita no catálogo.

INTELLECT-3 é open weights?

Sim. É um modelo Mixture-of-Experts de 106B parâmetros (12B ativos) com pesos abertos, pós-treinado a partir do GLM-4.5-Air-Base via SFT e reinforcement learning.

INTELLECT-3 é melhor que o o3 ou o Claude Haiku 4.5?

Não em inteligência bruta: o índice atual coloca o3 em 31,096, Haiku 4.5 em 29,892 e o INTELLECT-3 em 15,718. A vantagem do INTELLECT-3 está no preço por token de saída, não na régua de capacidade.

Leia também