Amazon Nova Premier 1.0 x Nemotron Nano 12B 2 VL: US$ 12,50 contra US$ 0,60 por milhão de tokens
Amazon aposta em raciocínio premium com modelo fechado; NVIDIA entrega pesos abertos, vídeo e preço 20 vezes menor
O que a diferença de US$ 11,90 por milhão de tokens realmente significa
O anúncio da Amazon apresenta o Nova Premier 1.0 como o modelo multimodal mais capaz da família Nova, voltado para raciocínio complexo e destilação de modelos customizados. A NVIDIA, do outro lado, abre o código do Nemotron Nano 12B 2 VL e cobra US$ 0,60 por milhão de tokens de saída. Quando você coloca os dois na mesma planilha, a conversa muda: a conta da API fica 20 vezes mais barata com o modelo da NVIDIA, e essa diferença não é margem — é a estrutura de preço inteira.
Aqui entra o ponto que o release da AWS não destaca: o Nova Premier 1.0 cobra US$ 2,50 por milhão de tokens de entrada e US$ 12,50 por milhão de tokens de saída. O cache de leitura fica em US$ 0,625 por milhão, o que ajuda em workloads com prompt repetido, mas não esconde o custo de saída. Já o Nemotron Nano 12B 2 VL cobra US$ 0,20 de entrada e US$ 0,60 de saída — sem cache publicado. Para um mesmo volume de 10 milhões de tokens de saída, você paga US$ 125 com Amazon e US$ 6 com NVIDIA.
Inteligência medida pela Artificial Analysis
Pelos índices de inteligência medidos hoje, o Nova Premier 1.0 marca 12,7 e o Nemotron Nano 12B 2 VL marca 8,8. A diferença existe e favorece a Amazon, mas ambos ficam distantes do topo do catálogo: o OpenAI o3 lidera com 31,1 e o Claude Haiku 4.5 vem logo atrás com 29,9.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Traduzindo: o Nova Premier 1.0 não entra no ranking dos cinco mais inteligentes do dia. Você não está comprando o modelo mais capaz da categoria — está comprando uma opção intermediária com multimodalidade e integração ao Bedrock. Já o Nemotron Nano 12B 2 VL aparece mais abaixo ainda na régua de inteligência, mas entrega algo que o concorrente da Amazon não entrega: arquitetura híbrida Transformer-Mamba, suporte a vídeo, 13,2 bilhões de parâmetros abertos e a possibilidade de rodar localmente ou fazer self-host.
Modalidades, contexto e o detalhe do vídeo
O Nova Premier 1.0 trabalha com texto e imagem como entrada e gera texto, em janela de 1 milhão de tokens. O Nemotron Nano 12B 2 VL vai além: aceita texto, imagem e vídeo, gera texto, e opera em janela de 131.072 tokens. Para quem precisa processar clipes de vídeo ou documentos longos com páginas escaneadas, essa diferença de modalidades é decisiva. Para quem só joga PDF e prompt no modelo, ela desaparece.
| Critério | Nova Premier 1.0 | Nemotron Nano 12B 2 VL |
|---|---|---|
| Índice de inteligência | 12.7 | 8.8 |
| Entrada US$/M | 2.5 | 0.2 |
| Saída US$/M | 12.5 | 0.6 |
| Contexto | 1M | 131k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 32 | 43 |
| Índice de código | — | — |
| Índice agêntico | — | — |
A velocidade também pesa: o Nemotron Nano 12B 2 VL entrega 42,8 tokens por segundo contra 31,9 do Nova Premier 1.0. Em workloads de inferência em lote, isso significa fila menor e latência menor. A NVIDIA também marca o modelo como raciocinante ("reasoning: true"), enquanto o Nova Premier 1.0 não traz esse rótulo.
Para quem cada um ganha
Nova Premier 1.0 ganha quando você já está no ecossistema AWS, precisa de multimodalidade texto+imagem em janela de 1 milhão de tokens, valoriza o suporte comercial da Amazon e quer usar o modelo como professor para destilar um modelo customizado. É a escolha natural para times que pagam fatura AWS e precisam de um modelo multimodal intermediário sem montar infra própria.
Nemotron Nano 12B 2 VL ganha quando o orçamento é o fator decisivo, quando você precisa processar vídeo, quando quer hospedar o modelo localmente para evitar mandar dado sensível para API de terceiros, ou quando a velocidade de inferência pesa mais que o último ponto de IQ. Equipes que estão construindo pipeline de vídeo-understanding ou que precisam de pesos abertos para auditoria e ajuste fino encontram aqui uma proposta que o Nova Premier 1.0 não cobre.
Para todo o resto — quem busca o topo absoluto de inteligência, quem precisa de raciocínio pesado ou quem já consome Claude Haiku 4.5 e o3 — nenhum dos dois entra no radar hoje.
Se você está na AWS e precisa de multimodal sem montar infra, Nova Premier 1.0; se cada centavo na fatura importa e você quer pesos abertos com vídeo, Nemotron Nano 12B 2 VL entrega por um quinto do preço.
Perguntas frequentes
Qual a diferença de preço entre Amazon Nova Premier 1.0 e NVIDIA Nemotron Nano 12B 2 VL?
O Nova Premier 1.0 cobra US$ 2,50 por milhão de tokens de entrada e US$ 12,50 por milhão de tokens de saída. O Nemotron Nano 12B 2 VL cobra US$ 0,20 de entrada e US$ 0,60 de saída — cerca de 20 vezes mais barato no token de saída.
O Nemotron Nano 12B 2 VL é open weights?
Sim. O modelo tem 13,2 bilhões de parâmetros abertos e pode ser baixado, hospedado localmente ou ajustado. O Nova Premier 1.0 é fechado e roda apenas via API no Amazon Bedrock.
Qual dos dois entende vídeo?
Apenas o Nemotron Nano 12B 2 VL. Ele aceita texto, imagem e vídeo como entrada. O Nova Premier 1.0 trabalha com texto e imagem.