Amazon Nova Premier cobra 31 vezes mais que o Nemotron e entrega IQ quase igual
Comparativo frente a frente entre dois modelos lançados em outubro de 2025 mostra que o preço, e não a capacidade, decide a escolha.
O número que ninguém põe no slide
A Amazon apresentou o Nova Premier como o modelo multimodal mais capaz da casa. O catálogo de hoje registra índice de inteligência 12,72. O Nemotron Super 49B da NVIDIA, lançado oito dias antes, marca 12,40. Diferença: 0,32 ponto em uma escala que vai até o topo de 31 do o3.
Em capacidade, estamos falando de empate técnico. Em preço, estamos falando de universos distintos.
A conta que decide
O Nova Premier cobra US$ 12,50 por milhão de tokens de saída. O Nemotron Super cobra US$ 0,40 pelo mesmo milhão. Isso é 31 vezes mais caro na saída — e a entrada também não ajuda: US$ 2,50 contra US$ 0,40, seis vezes mais.
Para um produto que processa, digamos, 50 milhões de tokens de saída por mês, a diferença entre os dois é US$ 605. É o aluguel de um coworking em São Paulo. Em um ano, são quase R$ 400 mil a mais no cartão corporativo — sem nenhum ganho mensurável de IQ.
Onde o Premier ainda tenta ganhar
Três argumentos restam a favor do Premier, e nenhum deles é a inteligência bruta.
Primeiro, multimodalidade nativa: o Premier aceita imagem e devolve texto; o Nemotron é text-only. Quem precisa extrair informação de PDFs escaneados, fotos de produto ou capturas de tela não tem escolha — o Nemotron não entra.
Segundo, contexto: Premier entrega 1 milhão de tokens de janela contra 131 mil do Nemotron. Para resumir um livro inteiro ou despejar uma base de código inteira em uma única chamada, o Premier é o único dos dois que aguenta.
Terceiro, velocidade declarada: o catálogo aponta 31,91 tokens por segundo no Premier e 52,85 no Nemotron. Curiosamente, o modelo mais barato também é o mais rápido — possivelmente porque ativa todos os 49 bilhões de parâmetros em hardware recente, enquanto o Premier é uma caixa-preta sem detalhe de arquitetura.
| Critério | Nova Premier 1.0 | Llama 3.3 Nemotron Super 49B |
|---|---|---|
| Índice de inteligência | 12.7 | 12.4 |
| Entrada US$/M | 2.5 | 0.4 |
| Saída US$/M | 12.5 | 0.4 |
| Contexto | 1M | 131k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 32 | 53 |
| Índice de código | — | — |
| Índice agêntico | — | — |
E o resto do tabuleiro?
Para situar os dois, o topo do catálogo hoje é o o3, com IQ 31,09 e saída a US$ 8 por milhão. O Claude Haiku 4.5 vem logo atrás, com 29,89 e US$ 5. Ambos entregam quase três vezes a inteligência do Premier por uma fração do preço.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
O Premier não é um mau modelo — é um modelo posicionado em um lugar estranho. Em capacidade, fica abaixo do o3 e do Haiku 4.5. Em preço, fica acima de quase tudo que entrega IQ parecido. E em multimodalidade, enfrenta concorrentes como o GPT-4o que não estão nesta conta.
O peso aberto da NVIDIA
Um detalhe que pesa na régua: o Nemotron tem pesos abertos e 49 bilhões de parâmetros declarados. Isso significa que você pode rodá-lo em infraestrutura própria, ajustar com fine-tuning e até destilar uma versão menor sem pagar token por token. O Premier é API fechada — o que você compra, você consome.
Para equipes que já têm GPU ociosa ou contrato de cloud com desconto, o cálculo do Nemotron fica ainda mais favorável: o US$ 0,40 é teto, não piso.
Quando cada um ganha
O Nova Premier ganha quando você precisa de multimodalidade nativa com contexto de 1 milhão de tokens — resumir uma biblioteca de manuais técnicos com diagramas, por exemplo, ou processar um lote de documentos escaneados em uma única chamada. Nesses cenários, o Nemotron simplesmente não compete.
O Nemotron Super 49B ganha em todo o resto: chatbots de atendimento, agentes que chamam ferramentas, RAG sobre texto puro, geração de código, qualquer fluxo em que o input e o output são só palavras. Você paga 31 vezes menos, roda mais rápido e ainda leva os pesos abertos para casa.
A regra é simples: se a tarefa cabe em texto e em 128 mil tokens, Nemotron. Se não cabe, Premier — e só então.
Para fluxo de texto puro, Nemotron Super 49B custa 31 vezes menos que o Nova Premier com IQ equivalente; reserve o Premier para os casos em que imagem ou contexto de 1M de tokens são inegociáveis.
Perguntas frequentes
O Amazon Nova Premier é melhor que o Llama 3.3 Nemotron Super 49B?
Em índice de inteligência a diferença é de 0,32 ponto, dentro da margem de empate técnico. O Premier só leva vantagem real em multimodalidade nativa e em janela de contexto de 1 milhão de tokens.
Quanto custa rodar o Nemotron Super 49B vs o Nova Premier?
O Nemotron cobra US$ 0,40 por milhão de tokens de entrada e de saída. O Nova Premier cobra US$ 2,50 de entrada e US$ 12,50 de saída — cerca de 31 vezes mais caro na saída.
Posso rodar o Nemotron Super localmente?
Sim. O Nemotron Super 49B tem pesos abertos e 49 bilhões de parâmetros declarados, o que permite hospedagem própria e fine-tuning, diferentemente do Nova Premier que só está disponível via API.