FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

INTELLECT-3 a US$ 1,10 vs Nemotron Nano a US$ 0,20: quem vale o que

Dois modelos abertos americanos com 65 dias de diferença no catálogo, preços e tamanhos quase opostos — e o placar de inteligência não acompanha a conta.

Redação FalaVIP IA 3 min de leitura
US$ 1,10preço de saída por milhão de tokens do INTELLECT-3
US$ 0,20preço de saída por milhão de tokens do Nemotron Nano
15,7 vs 14,5índice de inteligência Artificial Analysis

O que está em jogo

Você está olhando para dois modelos americanos, abertos, com arquitetura MoE, lançados em novembro e dezembro de 2025, e a diferença de preço de saída é de 5,5 vezes. O INTELLECT-3, da Prime Intellect, cobra US$ 1,10 por milhão de tokens de saída. O Nemotron 3 Nano 30B A3B, da NVIDIA, cobra US$ 0,20. Em um mês rodando 100 milhões de tokens de saída, são US$ 110 contra US$ 20. Em um ano, com a mesma média, US$ 1.320 contra US$ 240.

A pergunta que importa: essa diferença vira qualidade entregue, ou vira só a fatura?

Tamanho e arquitetura: parecidos no papel, opostos na conta

O INTELLECT-3 é um MoE de 106B parâmetros com 12B ativos, pós-treinado a partir do GLM-4.5-Air-Base via SFT e RL em larga escala. O Nemotron Nano é um MoE de 31,6B com 3,6B ativos, pensado pela NVIDIA para máxima eficiência computacional em sistemas agentic. Em outras palavras: o INTELLECT-3 aciona três vezes mais parâmetros por token do que o Nemotron Nano, e isso se reflete direto no preço.

Preço de saída (US$ por milhão de tokens)
INTELLECT-31,1Nemotron 3 Nano 30B A3B0,2US$/M
Fonte: OpenRouter

Onde o Nemotron Nano contra-ataca é no contexto: 262 mil tokens, o dobro dos 131 mil do INTELLECT-3. Se você enfia documento grande numa única chamada, isso muda o cálculo.

Inteligência e velocidade: o placar não acompanha a diferença de preço

No índice de inteligência medido hoje, INTELLECT-3 marca 15,718 e Nemotron Nano 14,538. Diferença de 1,18 ponto — cerca de 8%. Para colocar em perspectiva: o catálogo tem 326 modelos listados nesta data, e o topo (MiMo-V2-Flash) marca 34,024. Os dois estão na faixa intermediária, longe do pódio.

Índice de inteligência (Artificial Analysis)
INTELLECT-315,7Nemotron 3 Nano 30B A3B14,5índice
Fonte: Artificial Analysis

A velocidade do Nemotron Nano aparece medida em 247,99 tokens por segundo; a do INTELLECT-3 não consta no dado publicado. Em workload agentic, o Nemotron traz os sub-índices: coding 14,371, agentic 1,993 e blended 0,0875. O INTELLECT-3 não tem essas métricas publicadas.

INTELLECT-3 × Nemotron 3 Nano 30B A3B
CritérioINTELLECT-3Nemotron 3 Nano 30B A3B
Índice de inteligência15.714.5
Entrada US$/M0.20.05
Saída US$/M1.10.2
Contexto131k262k
Pesos abertossimsim
Velocidade (tok/s)248
Índice de código14.4
Índice agêntico2.0

Para quem cada um vale — e para quem nenhum dos dois muda nada

INTELLECT-3 vale se você precisa de um modelo aberto americano com 12B ativos bem treinados em raciocínio via RL, e está disposto a pagar cinco vezes mais por saída para tirar 8% a mais de índice de inteligência. Para workload que consome muito token de entrada e pouco de saída, a diferença aperta: o INTELLECT-3 cobra US$ 0,20 por milhão de entrada, o Nemotron Nano US$ 0,05 — e ainda tem cache a US$ 0,025.

Nemotron Nano vale se o que importa é a conta no fim do mês. Em agente de alto volume, em pipelines de extração, em qualquer coisa que vai rodar 24/7 com prompt grande e resposta curta, a economia é real e o índice de inteligência fica a um ponto do concorrente mais caro.

Nenhum dos dois muda nada para quem já roda Claude Haiku 4.5 (29,892 de IQ a US$ 5 de saída) ou o3 (31,096 a US$ 8) e está feliz. Tampouco para quem mira o topo da tabela — o MiMo-V2-Flash, da Xiaomi, entrega 34,024 de índice a US$ 0,30 de saída e muda a conversa inteira.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 326 modelos disponíveis no catálogo nesta data.

O que você faz com isso amanhã

Se a sua fila de inferência aberta está crescendo e o CFO começou a perguntar sobre a fatura da API, rode uma amostra do seu workload real nos dois e meça custo por tarefa concluída, não só preço por token. O índice de inteligência parecido esconde que o INTELLECT-3 entrega mais por token e o Nemotron entrega mais por dólar. Para a maioria dos workloads agentic de alto volume, o Nano ganha. Para tarefas que exigem o melhor que um modelo aberto de 12B ativos consegue dar em raciocínio, o INTELLECT-3 ainda cobra a diferença — e você decide se ela cabe.

Em uma frase

Para alto volume agentic, Nemotron Nano entrega quase a mesma inteligência por um quinto do preço; para raciocínio pontual em modelo aberto, o INTELLECT-3 ainda justifica o premium.

Perguntas frequentes

INTELLECT-3 ou Nemotron Nano: qual é mais barato por token de saída?

Nemotron 3 Nano 30B A3B, por larga margem: US$ 0,20 contra US$ 1,10 por milhão de tokens de saída — 5,5 vezes mais barato. No token de entrada a diferença também é grande: US$ 0,05 contra US$ 0,20.

Qual dos dois tem índice de inteligência maior?

INTELLECT-3, com 15,718 contra 14,538 do Nemotron Nano — diferença de cerca de 8%. Os dois ficam na faixa intermediária do catálogo de 326 modelos, bem abaixo do topo liderado pelo MiMo-V2-Flash (34,024).

Os dois modelos são abertos?

Sim. INTELLECT-3 (Prime Intellect) e Nemotron 3 Nano 30B A3B (NVIDIA) são ambos open weights, criados nos Estados Unidos, com arquitetura MoE e capacidade de raciocínio habilitada.

Leia também