Nova Premier cobra 41 vezes mais que o Llama 4 Scout — vale?
Amazon e Meta disputam o segmento multimodal de texto e imagem com propostas opostas: capacidade máxima contra preço mínimo.
O que o release diz e o que a fatura mostra
A Amazon posicionou o Nova Premier 1.0 como o modelo multimodal mais capaz do seu catálogo, voltado para raciocínio complexo e destilação de modelos customizados. Já o Llama 4 Scout, da Meta, foi lançado em abril deste ano como uma mistura de especialistas (MoE) com 109 bilhões de parâmetros totais e 17 bilhões ativos, multimodal nativo, e a vantagem declarada de ser aberto. Em comum, os dois aceitam imagem e devolvem texto. Em preço, vivem em galáxias diferentes.
A conta, em números crus
O Nova Premier cobra US$ 2,50 por milhão de tokens de entrada e US$ 12,50 por milhão de tokens de saída. O Llama 4 Scout cobra US$ 0,10 e US$ 0,30, respectivamente. Isso significa que cada token que sai do Nova Premier custa cerca de 41 vezes mais do que o mesmo token saindo do Scout. Para um sistema que gera 10 milhões de tokens por mês, a diferença entre as duas faturas é de aproximadamente US$ 122 — e isso só na ponta de saída.
O Scout ainda oferece um bônus que a Amazon não iguala: 1.310.720 tokens de contexto contra 1.000.000 do Premier. Em tarefas que exigem colar documentos longos ou manter histórico extenso, esse 31% a mais de janela pode evitar a conta de um sistema de RAG separado.
| Critério | Nova Premier 1.0 | Llama 4 Scout |
|---|---|---|
| Índice de inteligência | 12.7 | 10.3 |
| Entrada US$/M | 2.5 | 0.1 |
| Saída US$/M | 12.5 | 0.3 |
| Contexto | 1M | 1.31M |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 32 | 112 |
| Índice de código | — | 8.2 |
| Índice agêntico | — | 1.1 |
Inteligência medida e o que isso significa
No índice de inteligência da Artificial Analysis, o Nova Premier marca 12,718 e o Scout marca 10,256. A diferença existe, mas nenhum dos dois está no topo do mercado hoje — o ranking atual é liderado pelo OpenAI o3 (31,096), seguido pelo Claude Haiku 4.5 (29,892). Ou seja: você está pagando caro no Premier para ficar abaixo da metade da escala dos melhores.
O Scout tem um detalhe que pesa: a Meta publicou notas de codificação (8,168) e agentic (1,1), enquanto o Premier não traz essas medições no catálogo. Para quem está montando um pipeline de código ou automação, a ausência de dado da Amazon é por si só uma informação — você está comprando no escuro.
Velocidade, peso de modelo e a questão do open weights
Em tokens por segundo, o Scout entrega 111,53 contra 31,91 do Premier. Em workloads interativos, isso é a diferença entre uma resposta que aparece e uma resposta que faz o usuário esperar. O Scout também é open weights, o que permite self-hosting, destilação local e auditoria do modelo — algo que o Premier, fechado, simplesmente não oferece.
A velocidade do Scout vem com uma contrapartida: o índice de "omnisciência" é -52,15, pior que o -35,383 do Premier. Em outras palavras, o Scout alucina mais. Para tarefas onde a verificação é fácil (extração de dados estruturados, classificação), isso é administrável. Para geração de texto que vai direto ao cliente sem revisão, é um risco real.
Quando cada um ganha
O Nova Premier 1.0 ganha quando você precisa do melhor que a Amazon oferece para raciocínio complexo dentro do ecossistema AWS, tem orçamento para absorver US$ 12,50 por milhão de tokens de saída e não quer lidar com self-hosting. É a escolha de quem já está preso ao Bedrock e quer consistência de fornecedor.
O Llama 4 Scout ganha quando o custo manda, quando a janela de contexto maior faz diferença, quando você quer open weights para rodar localmente ou destilar, e quando a velocidade de resposta importa mais que a taxa de alucinação. É a escolha de quem está construindo um produto enxuto e precisa de margem.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Se a fatura da API é variável sensível, escolha Llama 4 Scout e aceite revisar mais as saídas; se você precisa do topo da linha Amazon e tem orçamento, Nova Premier 1.0 entrega um pouco mais de capacidade pelo preço de um modelo premium.
Perguntas frequentes
Quanto custa usar o Nova Premier 1.0 comparado ao Llama 4 Scout?
O Nova Premier cobra US$ 2,50 por milhão de tokens de entrada e US$ 12,50 por milhão de tokens de saída. O Llama 4 Scout cobra US$ 0,10 e US$ 0,30, respectivamente. Cada token de saída do Premier custa cerca de 41 vezes mais.
O Llama 4 Scout é de código aberto?
Sim. O Scout é open weights, com 109 bilhões de parâmetros totais e 17 bilhões ativos em inferência. Isso permite self-hosting, destilação local e auditoria do modelo, algo que o Nova Premier, fechado, não oferece.
Qual dos dois tem a maior janela de contexto?
O Llama 4 Scout, com 1.310.720 tokens contra 1.000.000 do Nova Premier. Em tarefas que exigem documentos longos ou histórico extenso, essa diferença evita depender de sistemas externos de RAG.