INTELLECT-3 a US$ 1,10 vs Nemotron Nano a US$ 0,20: quem vale o que
Dois modelos abertos americanos com 65 dias de diferença no catálogo, preços e tamanhos quase opostos — e o placar de inteligência não acompanha a conta.
O que está em jogo
Você está olhando para dois modelos americanos, abertos, com arquitetura MoE, lançados em novembro e dezembro de 2025, e a diferença de preço de saída é de 5,5 vezes. O INTELLECT-3, da Prime Intellect, cobra US$ 1,10 por milhão de tokens de saída. O Nemotron 3 Nano 30B A3B, da NVIDIA, cobra US$ 0,20. Em um mês rodando 100 milhões de tokens de saída, são US$ 110 contra US$ 20. Em um ano, com a mesma média, US$ 1.320 contra US$ 240.
A pergunta que importa: essa diferença vira qualidade entregue, ou vira só a fatura?
Tamanho e arquitetura: parecidos no papel, opostos na conta
O INTELLECT-3 é um MoE de 106B parâmetros com 12B ativos, pós-treinado a partir do GLM-4.5-Air-Base via SFT e RL em larga escala. O Nemotron Nano é um MoE de 31,6B com 3,6B ativos, pensado pela NVIDIA para máxima eficiência computacional em sistemas agentic. Em outras palavras: o INTELLECT-3 aciona três vezes mais parâmetros por token do que o Nemotron Nano, e isso se reflete direto no preço.
Onde o Nemotron Nano contra-ataca é no contexto: 262 mil tokens, o dobro dos 131 mil do INTELLECT-3. Se você enfia documento grande numa única chamada, isso muda o cálculo.
Inteligência e velocidade: o placar não acompanha a diferença de preço
No índice de inteligência medido hoje, INTELLECT-3 marca 15,718 e Nemotron Nano 14,538. Diferença de 1,18 ponto — cerca de 8%. Para colocar em perspectiva: o catálogo tem 326 modelos listados nesta data, e o topo (MiMo-V2-Flash) marca 34,024. Os dois estão na faixa intermediária, longe do pódio.
A velocidade do Nemotron Nano aparece medida em 247,99 tokens por segundo; a do INTELLECT-3 não consta no dado publicado. Em workload agentic, o Nemotron traz os sub-índices: coding 14,371, agentic 1,993 e blended 0,0875. O INTELLECT-3 não tem essas métricas publicadas.
| Critério | INTELLECT-3 | Nemotron 3 Nano 30B A3B |
|---|---|---|
| Índice de inteligência | 15.7 | 14.5 |
| Entrada US$/M | 0.2 | 0.05 |
| Saída US$/M | 1.1 | 0.2 |
| Contexto | 131k | 262k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | — | 248 |
| Índice de código | — | 14.4 |
| Índice agêntico | — | 2.0 |
Para quem cada um vale — e para quem nenhum dos dois muda nada
INTELLECT-3 vale se você precisa de um modelo aberto americano com 12B ativos bem treinados em raciocínio via RL, e está disposto a pagar cinco vezes mais por saída para tirar 8% a mais de índice de inteligência. Para workload que consome muito token de entrada e pouco de saída, a diferença aperta: o INTELLECT-3 cobra US$ 0,20 por milhão de entrada, o Nemotron Nano US$ 0,05 — e ainda tem cache a US$ 0,025.
Nemotron Nano vale se o que importa é a conta no fim do mês. Em agente de alto volume, em pipelines de extração, em qualquer coisa que vai rodar 24/7 com prompt grande e resposta curta, a economia é real e o índice de inteligência fica a um ponto do concorrente mais caro.
Nenhum dos dois muda nada para quem já roda Claude Haiku 4.5 (29,892 de IQ a US$ 5 de saída) ou o3 (31,096 a US$ 8) e está feliz. Tampouco para quem mira o topo da tabela — o MiMo-V2-Flash, da Xiaomi, entrega 34,024 de índice a US$ 0,30 de saída e muda a conversa inteira.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
O que você faz com isso amanhã
Se a sua fila de inferência aberta está crescendo e o CFO começou a perguntar sobre a fatura da API, rode uma amostra do seu workload real nos dois e meça custo por tarefa concluída, não só preço por token. O índice de inteligência parecido esconde que o INTELLECT-3 entrega mais por token e o Nemotron entrega mais por dólar. Para a maioria dos workloads agentic de alto volume, o Nano ganha. Para tarefas que exigem o melhor que um modelo aberto de 12B ativos consegue dar em raciocínio, o INTELLECT-3 ainda cobra a diferença — e você decide se ela cabe.
Para alto volume agentic, Nemotron Nano entrega quase a mesma inteligência por um quinto do preço; para raciocínio pontual em modelo aberto, o INTELLECT-3 ainda justifica o premium.
Perguntas frequentes
INTELLECT-3 ou Nemotron Nano: qual é mais barato por token de saída?
Nemotron 3 Nano 30B A3B, por larga margem: US$ 0,20 contra US$ 1,10 por milhão de tokens de saída — 5,5 vezes mais barato. No token de entrada a diferença também é grande: US$ 0,05 contra US$ 0,20.
Qual dos dois tem índice de inteligência maior?
INTELLECT-3, com 15,718 contra 14,538 do Nemotron Nano — diferença de cerca de 8%. Os dois ficam na faixa intermediária do catálogo de 326 modelos, bem abaixo do topo liderado pelo MiMo-V2-Flash (34,024).
Os dois modelos são abertos?
Sim. INTELLECT-3 (Prime Intellect) e Nemotron 3 Nano 30B A3B (NVIDIA) são ambos open weights, criados nos Estados Unidos, com arquitetura MoE e capacidade de raciocínio habilitada.