FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nova 2 Lite custa 2,3× mais que INTELLECT-3 por token de saída

Amazon entrega multimodal e contexto de 1 milhão; Prime Intellect responde com pesos abertos e 107B parâmetros. O preço mais alto da Nova 2 Lite só se justifica se você usa câmera nem roda modelo local.

Redação FalaVIP IA 2 min de leitura
US$ 2,50por milhão de tokens de saída (Nova 2 Lite)
US$ 1,10por milhão de tokens de saída (INTELLECT-3)
1.000.000tokens de contexto da Nova 2 Lite

A Amazon soltou a Nova 2 Lite em 2 de dezembro chamando-a de "rápida e econômica". Cinco dias antes, a Prime Intellect tinha lançado a INTELLECT-3 dizendo que entrega "state-of-the-art para o seu tamanho". Marketing parecido, preços muito diferentes: Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída; INTELLECT-3, US$ 1,10. Em volume, essa diferença pesa mais do que qualquer benchmark isolado.

Preço de saída (US$ por milhão de tokens)
Nova 2 Lite2,5INTELLECT-31,1US$/M
Fonte: OpenRouter

O que cada release esconde

A Nova 2 Lite é multimodal de verdade: aceita texto, imagem, arquivo e vídeo, devolve só texto. O contexto vai a 1 milhão de tokens — espaço para enfiar um livro inteiro ou um lote grande de PDFs numa única chamada. A INTELLECT-3 é estritamente texto-em-texto, com contexto de 131 mil tokens. Se o seu pipeline precisa "olhar" para uma imagem ou extrair quadros de um vídeo, a escolha já está feita antes de olhar preço.

Nova 2 Lite × INTELLECT-3
CritérioNova 2 LiteINTELLECT-3
Índice de inteligência19.215.7
Entrada US$/M0.30.2
Saída US$/M2.51.1
Contexto1M131k
Pesos abertosnãosim
Velocidade (tok/s)153
Índice de código
Índice agêntico

A INTELLECT-3 compensa em outra direção: é de pesos abertos. São 107 bilhões de parâmetros no total, com 12 bilhões ativos — uma arquitetura Mixture-of-Experts pós-treinada em cima do GLM-4.5-Air-Base. Quem tem GPU disponível pode rodar localmente, ajustar, fazer fine-tuning. A Nova 2 Lite é fechada e só atende via API da AWS.

Inteligência medida hoje

No índice de inteligência atual do catálogo, a Nova 2 Lite marca 19,24 e a INTELLECT-3, 15,72. Diferença de 3,5 pontos — não é desprezível, mas nenhum dos dois entra no top 5 do mercado nesta data. O topo segue sendo o Xiaomi MiMo-V2-Flash (34,02), seguido de OpenAI o3 (31,10) e Claude Haiku 4.5 (29,89).

Índice de inteligência (Artificial Analysis)
Nova 2 Lite19,2INTELLECT-315,7índice
Fonte: Artificial Analysis
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 313 modelos disponíveis no catálogo nesta data.

Leitura honesta: a Nova 2 Lite é objetivamente superior em capacidade bruta, e a lacuna tende a importar em tarefas de raciocínio mais longas. Só que o índice não mede multimodalidade — então a vantagem real da Nova 2 Lite sobre a INTELLECT-3 em tarefas com imagem ou vídeo é maior do que esses 3,5 pontos sugerem.

O preço em volume

A diferença de US$ 1,40 por milhão de tokens de saída parece pequena. Não é. Para uma carga hipotética de 500 milhões de tokens de saída por mês — volume comum em produtos com agentes ou geração em massa — a conta fecha em US$ 1.250 na Nova 2 Lite e US$ 550 na INTELLECT-3. Na entrada, a INTELLECT-3 também é mais barata: US$ 0,20 contra US$ 0,30.

Sobre cache: nenhum dos dois publicou preço de cache no catálogo. Antes de fechar contrato, vale perguntar ao suporte se existe e qual a política — em workloads com contexto repetido, cache muda a conta inteira.

Quando cada um ganha

Nova 2 Lite ganha quando você precisa processar imagem, vídeo ou arquivos junto com texto; quando o contexto de 131 mil tokens da concorrente é gargalo; e quando a infraestrutura já está dentro da AWS. Extração de informação em vídeos, leitura de PDFs longos com figuras, qualquer fluxo multimodal — é a Nova 2 Lite.

INTELLECT-3 ganha quando o workload é só texto; quando você quer rodar o modelo localmente em GPU própria (os 12B ativos quantizados cabem em hardware único); quando precisa de economia real por token via API; ou quando a auditoria exige pesos abertos. Agentes enxutos, geração de código, análise de logs — a INTELLECT-3 entrega por quase metade do preço.

Em uma frase

Precisa ver imagem ou vídeo: Nova 2 Lite. Quer pagar menos, rodar local ou ajustar o modelo: INTELLECT-3. Multimodalidade não é detalhe — é o divisor da escolha.

Perguntas frequentes

Nova 2 Lite é melhor que INTELLECT-3?

Em IQ bruto, sim: 19,24 contra 15,72 no índice atual. Em multimodalidade e contexto, a Nova 2 Lite é a única das duas que entrega. Em preço por token e possibilidade de self-hosting, a INTELLECT-3 ganha — e em workloads só-texto essa economia costuma pesar mais que os 3,5 pontos de IQ.

Quanto custa cada um por milhão de tokens?

Nova 2 Lite: US$ 0,30 de entrada e US$ 2,50 de saída. INTELLECT-3: US$ 0,20 de entrada e US$ 1,10 de saída. Nenhum dos dois publicou preço de cache no catálogo — vale confirmar com o provedor.

A INTELLECT-3 roda local?

Sim, é de pesos abertos: 107B parâmetros totais, 12B ativos (Mixture-of-Experts), pós-treinada a partir do GLM-4.5-Air-Base. Quantizada, a porção ativa cabe em GPU única de 24 GB. A Nova 2 Lite é fechada e só atende via API da Amazon.

Leia também