FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nova Premier custa 11x mais que ERNIE 4.5 — e a conta não é óbvia

Comparativo entre o multimodal da Amazon e o MoE open-weights da Baidu mostra onde cada um justifica a fatura — e onde nenhum dos dois deveria estar na sua lista.

Redação FalaVIP IA 3 min de leitura
11xdiferença no preço de saída por milhão de tokens
US$ 12,50preço de saída do Nova Premier por milhão
0,485preço blended do ERNIE 4.5 por milhão

Amazon diz que o Nova Premier é o "mais capaz" da família Nova. Baidu apresenta o ERNIE 4.5 300B como um MoE de 300 bilhões de parâmetros com 47B ativos por token. Os dois estão no catálogo hoje, entre mais de 279 modelos. Os dois cobram por token de saída. Só que um cobra US$ 12,50 por milhão e o outro cobra US$ 1,10 — e essa diferença de 11x não é detalhe de release, é o divisor entre dois produtos que resolvem problemas diferentes.

Índice de inteligência (Artificial Analysis)
Nova Premier 1.012,7ERNIE 4.5 300B A47B 8,9índice
Fonte: Artificial Analysis

O índice de inteligência do Nova Premier marca 12,7. O ERNIE 4.5 fica em 8,9. A distância existe, mas não é abissal — ambos estão longe do topo do catálogo, onde OpenAI o3 lidera com 31,1 e Claude Haiku 4.5 aparece em 29,9. Você não está comparando um modelo de ponta com um medíocre; está comparando dois modelos intermediários que ocupam posições diferentes na mesma faixa.

O que o preço está te dizendo

Preço de saída (US$ por milhão de tokens)
Nova Premier 1.012,5ERNIE 4.5 300B A47B 1,1US$/M
Fonte: OpenRouter

A conta por token de saída é a mais visível, mas a conta real é o blended — o preço médio ponderado que reflete o uso típico, em que entra muito mais token de entrada do que de saída. Nesse indicador, a distância explode: Nova Premier marca 5,0; ERNIE 4.5 marca 0,485. São pouco mais de 10x de diferença no custo efetivo por milhão processado.

Traduzindo em volume: se você roda 100 milhões de tokens por mês no Nova Premier, paga algo em torno de US$ 500. No ERNIE 4.5, a mesma conta fica perto de US$ 50. Em um ano, são US$ 5.400 contra US$ 540. A fatura da API não mente — e o blended é o número que você deveria olhar antes de escolher.

Visão, contexto e o que cada um abre

Aqui está o ponto que o preço sozinho não conta. O Nova Premier é multimodal — aceita imagem e devolve texto. O ERNIE 4.5 é text-only. Se o seu pipeline inclui PDF escaneado, screenshot, gráfico ou foto de produto, o ERNIE 4.5 nem entra no jogo.

O outro diferencial é a janela de contexto. Nova Premier opera com 1 milhão de tokens. ERNIE 4.5 fica em 131 mil. Para colar uma base de código inteira, um livro inteiro ou um ano de logs em uma única chamada, o modelo da Amazon é o único dos dois que aguenta o tranco.

Nova Premier 1.0 × ERNIE 4.5 300B A47B
CritérioNova Premier 1.0ERNIE 4.5 300B A47B
Índice de inteligência12.78.9
Entrada US$/M2.50.28
Saída US$/M12.51.1
Contexto1M131k
Pesos abertosnãosim
Velocidade (tok/s)32
Índice de código
Índice agêntico

A questão dos pesos abertos

ERNIE 4.5 é open weights. Você pode baixar, self-hostar, fazer fine-tuning e rodar em infraestrutura própria — desde que tenha as GPUs para 300B de parâmetros (47B ativos por token via MoE). Nova Premier é fechado. Se a sua empresa tem restrição regulatória que exige rodar o modelo dentro do data center, ou se você quer construir um modelo destilado a partir dele, o ERNIE é o único caminho dos dois.

A descrição do Nova Premier, aliás, diz exatamente isso: ele foi pensado como "melhor professor" para destilação. Mas destilar de uma API fechada significa pagar a fatura da Amazon enquanto treina o seu — e confiar que o modelo não vai mudar de preço ou sair do catálogo no meio do caminho.

Quando cada um ganha

Nova Premier ganha quando: você precisa processar imagem junto com texto; precisa de janela de 1M tokens; o caso de uso justifica pagar ~US$ 500/mês em vez de ~US$ 50.

ERNIE 4.5 ganha quando: o workload é text-only; você quer self-hostar ou tem restrição de soberania de dados; cada centavo por token conta e o IQ de 8,9 é suficiente para o que você está construindo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 279 modelos disponíveis no catálogo nesta data.

O que fazer com isso hoje

Se você está montando um pipeline de visão + texto e o orçamento comporta, Nova Premier é a escolha óbvia entre esses dois. Se está só processando texto e a fatura pesa, ERNIE 4.5 entrega 70% do IQ por 10% do preço. E se nenhum dos dois te serve, o topo do catálogo hoje está em OpenAI o3 e Claude Haiku 4.5 — que custam mais caro por token, mas entregam outro patamar de inteligência.

Em uma frase

Precisa de visão ou de 1M de contexto, vá de Nova Premier; caso de uso text-only com sensibilidade a custo, ERNIE 4.5. Se o IQ de 12 ou 9 não for suficiente para o seu problema, o dinheiro vai para OpenAI o3 ou Claude Haiku 4.5 — não para nenhum desses dois.

Perguntas frequentes

Qual a diferença de preço entre Nova Premier e ERNIE 4.5?

O Nova Premier cobra US$ 12,50 por milhão de tokens de saída, contra US$ 1,10 do ERNIE 4.5 — uma diferença de 11x. No preço blended, que pesa mais a entrada, a diferença fica em pouco mais de 10x (5,0 contra 0,485).

ERNIE 4.5 é open weights?

Sim. O ERNIE 4.5 300B A47B tem pesos abertos e pode ser self-hosted, mas exige infraestrutura para 300B de parâmetros (47B ativos por token via MoE). O Nova Premier é fechado e só roda via API da Amazon.

Quando escolher Nova Premier em vez de ERNIE 4.5?

Quando o pipeline precisa processar imagem junto com texto, ou quando você precisa de janela de contexto de 1 milhão de tokens. Para workloads text-only com sensibilidade a custo, o ERNIE 4.5 entrega o suficiente por uma fração do preço.

Leia também