FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Amazon Nova Premier cobra 11 vezes mais que o Qwen3 Next Instruct

Em inteligência medida, o Qwen vence por pouco. Em preço, por muito. Em janela de contexto e multimodalidade, a Amazon se destaca. Veja em que cenário cada um compensa o investimento.

Redação FalaVIP IA 3 min de leitura
US$ 1,10preço de saída por milhão de tokens (Qwen3 Next Instruct)
US$ 12,50preço de saída por milhão de tokens (Amazon Nova Premier)
173 tokens/svelocidade do Qwen, contra 32 tokens/s do Nova Premier

US$ 12,50 por milhão de tokens de saída é o que o Amazon Nova Premier 1.0 cobra desde 31 de outubro. Pelo mesmo volume, o Qwen3 Next 80B A3B Instruct pede US$ 1,10 — onze vezes menos. A diferença é real; o que está em jogo é decidir se a fatura extra se paga no seu caso de uso.

O preço não mente — mas também não conta tudo

Preço de saída (US$ por milhão de tokens)
Qwen3 Next 80B A3B Instruct1,1Nova Premier 1.012,5US$/M
Fonte: OpenRouter

A conta não melhora em nenhuma métrica. Entrada: US$ 0,10 no Qwen, US$ 2,50 no Nova Premier — 25 vezes mais. No preço "blended" (a média entre entrada e saída usada em comparativos rápidos), o Qwen fica em US$ 0,41 e o Nova em US$ 5,00. Quando o release da Amazon descreve o Premier como "o mais capaz dos modelos multimodais da casa", ninguém falou que ele também é o mais caro deles.

Qwen3 Next 80B A3B Instruct × Nova Premier 1.0
CritérioQwen3 Next 80B A3B InstructNova Premier 1.0
Índice de inteligência13.812.7
Entrada US$/M0.12.5
Saída US$/M1.112.5
Contexto262k1M
Pesos abertossimnão
Velocidade (tok/s)17332
Índice de código
Índice agêntico

Inteligência medida: empate, com vitória apertada do Qwen

Índice de inteligência (Artificial Analysis)
Qwen3 Next 80B A3B Instruct13,8Nova Premier 1.012,7índice
Fonte: Artificial Analysis

No índice de inteligência atual do catálogo, o Qwen3 Next Instruct marca 13,75 e o Nova Premier, 12,72. Diferença pequena, mas existe — e na direção oposta ao que o preço sugere. Para efeitos práticos, trate os dois como a mesma faixa cognitiva. O irmão "Thinking" do mesmo Qwen (16,87), o Claude Haiku 4.5 (29,89) e o o3 da OpenAI (31,09) estão bem acima. Os dois modelos aqui comparados brigam na faixa intermediária do mercado, não no topo.

Onde o Qwen leva vantagem clara

Três pontos colocam o modelo da chinesa Qwen à frente em quase qualquer critério operacional. Velocidade: 173 tokens/s contra 32 tokens/s — mais de cinco vezes mais rápido. Pesos abertos: o Qwen pode ser baixado, auditado e ajustado para o seu caso; o Nova Premier é caixa-preta. Arquitetura MoE: 80 bilhões de parâmetros totais, mas só 3 bilhões ativos por inferência — e essa combinação é o que permite rodar tão barato.

Se você está construindo produto onde o custo marginal por chamada importa — atendimento, geração em massa, pipelines de RAG com alto volume — o Qwen ganha sem precisar de mais argumento.

Onde o Nova Premier ainda justifica a conta

Três cenários sustentam a escolha pela Amazon. Janela de contexto de 1 milhão de tokens contra 262 mil do Qwen, útil para auditar bases de código grandes ou alimentar agentes com contexto amplo. Multimodalidade nativa: o Premier aceita imagem além de texto; o Qwen Instruct desta comparação é exclusivamente texto. Lançamento mais recente: 31 de outubro contra 11 de setembro, com vantagem provável em atualidade — o Qwen tem cutoff em 30 de setembro de 2025; a Amazon não divulga o seu.

Quando usar cada um

Você vai usar o Qwen3 Next Instruct se o orçamento é apertado, o volume é alto, a tarefa é texto puro e a latência pesa na experiência. Pagar US$ 0,41 em vez de US$ 5,00 por milhão de tokens blended muda a economia de qualquer produto que faz milhões de chamadas por mês.

Você vai usar o Amazon Nova Premier 1.0 se você precisa de mais de 262 mil tokens em uma única chamada, se a entrada inclui imagens, ou se o seu stack já mora dentro da AWS Bedrock e você prefere SLA comercial em vez de self-hosting.

São propostas diferentes para problemas diferentes. A tentação de descartar o Nova Premier só pelo preço é tão equivocada quanto pagar onze vezes mais por algo que você não vai usar.

Em uma frase

Para volumes altos de texto puro, escolha o Qwen3 Next Instruct e pague 1/12 do preço; só vale migrar para o Amazon Nova Premier quando você precisa de mais de 262 mil tokens de contexto, entrada de imagem, ou já está dentro do ecossistema AWS Bedrock.

Perguntas frequentes

Qwen3 Next Instruct ou Amazon Nova Premier: qual escolher?

Para volumes altos de texto puro, o Qwen é a escolha óbvia: custa 1/12 do Nova, é mais rápido e tem IQ medido ligeiramente maior. O Nova Premier só compensa quando você precisa de mais de 262 mil tokens de contexto, entrada de imagem, ou já está dentro do ecossistema AWS Bedrock.

Por que o Amazon Nova Premier custa tanto?

Ele é o modelo topo de linha multimodal da Amazon e o mais caro da família Nova. O preço reflete o posicionamento premium, a janela de 1 milhão de tokens e o suporte multimodal. Para a maioria dos casos em produção, é difícil justificar o multiplicador de 11x no preço de saída sem uma necessidade específica.

O Qwen3 Next Instruct roda localmente?

Sim. O modelo é open weights, com 80 bilhões de parâmetros totais e arquitetura MoE — apenas 3 bilhões ficam ativos por inferência, o que reduz bastante o custo de hardware. É possível baixar, ajustar e hospedar em cloud própria ou em provedores compatíveis.

Leia também