FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Amazon Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída

É mais barato que o o3 no output, mas perde feio em custo-benefício para o gpt-oss-120b — exceto quando o requisito é vídeo.

Redação FalaVIP IA 3 min de leitura
US$ 2,50por milhão de tokens de saída
14,7xmais caro que o gpt-oss-120b no output
1.000.000tokens de contexto

Amazon Nova 2 Lite chegou ontem (02/12/2025) e o release da Amazon repete a palavra que todo mundo gosta de colar em anúncio de modelo: "cost-effective". A pergunta que importa é outra — custo-efetivo contra o quê, e em qual fatia do uso?

Índice de inteligência (Artificial Analysis)
Nova 2 Lite19,2gpt-oss-20b15,2gpt-oss-120b24,1Llama 4 Maverick14,5Qwen3 Next 80B A3B Instruct13,8índice
Fonte: Artificial Analysis

No índice de inteligência medido hoje, o Nova 2 Lite marca 19,24. Isso coloca o modelo da Amazon em quarto lugar no catálogo geral, atrás do o3 (31,10), do Claude Haiku 4.5 (29,89) e do gpt-oss-120b da própria OpenAI (24,13). Não é ruim. Só não é o topo.

O preço que entra nos slides

O input do Nova 2 Lite sai por US$ 0,30 por milhão de tokens. O output, US$ 2,50. Aqui é onde a narrativa tropeça.

Preço de saída (US$ por milhão de tokens)
Nova 2 Lite2,5gpt-oss-20b0,13gpt-oss-120b0,17Llama 4 Maverick0,696Qwen3 Next 80B A3B Instruct1,1US$/M
Fonte: OpenRouter

Compare com o gpt-oss-120b, que tem IQ maior (24,13 contra 19,24) e cobra US$ 0,17 no output. O Nova 2 Lite custa 14,7 vezes mais por token gerado. Repita o número devagar: catorze vírgula sete vezes.

No gpt-oss-20b, irmão menor do 120b, o output é US$ 0,13 — quase vinte vezes mais barato. E o IQ é 15,23, não muito abaixo dos 19,24 do Nova 2 Lite.

A defesa da Amazon, claro, é que o Nova 2 Lite é multimodal — aceita texto, imagem, arquivo e vídeo numa única chamada. Os dois modelos abertos da OpenAI são text-only. Concordo. Mas multimodalidade por vinte vezes o preço? É preciso usar muito vídeo para a conta fechar.

Onde o Nova 2 Lite ganha sem precisar brigar

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Nova 2 Lite (o novo)19.20.32.51M
gpt-oss-20b15.20.030.13131k
gpt-oss-120b24.10.0370.17131k
Llama 4 Maverick14.50.20.6961.05M
Qwen3 Next 80B A3B Instruct13.80.11.1262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O Nova 2 Lite tem três coisas que nenhum dos pares listados tem ao mesmo tempo.

Primeira: contexto de 1.000.000 de tokens. O gpt-oss-120b e o gpt-oss-20b operam em 131.072. O Qwen3 Next Instruct, em 262.144. O Llama 4 Maverick também chega a 1M, mas é multimodal só de imagem, não de vídeo.

Segunda: vídeo como entrada. Os outros quatro modelos do comparativo não processam vídeo. Se você precisa transcrever, resumir ou extrair informação de clipes sem montar pipeline externo, o Nova 2 Lite é o único dos pares listados que faz isso nativamente.

Terceira: raciocínio declarado (reasoning: true), coisa que o Llama 4 Maverick e o Qwen3 Next Instruct deste comparativo não trazem.

A velocidade de 153 tokens por segundo coloca o Nova 2 Lite à frente do gpt-oss-20b (112 t/s) e do Llama 4 Maverick (86 t/s), praticamente empatando com o gpt-oss-120b (155 t/s).

Para quem vale — e para quem não

Vale para você se:

  • precisa de vídeo como entrada em produção hoje, sem montar pipeline externo;
  • o workload é majoritariamente de leitura (input) com geração curta, porque aí o input barato (US$ 0,30) compensa o output caro;
  • 1M de contexto muda a arquitetura da sua aplicação — você não quer partir documento;
  • já está no ecossistema Amazon e prefere latência curta a custo mínimo.

Não vale para você se:

  • o trabalho é só texto e você quer pagar o mínimo por inteligência — o gpt-oss-120b é 14,7 vezes mais barato no output e tem IQ maior;
  • você precisa de pesos abertos para rodar local, fazer fine-tune ou auditar — o Nova 2 Lite é fechado;
  • você está montando fluxo agentic — o gpt-oss-120b publicou agentic 13,43; do Nova 2 Lite, esse número não veio a público;
  • você está fazendo codificação pesada — o Nova 2 Lite não publicou métrica de coding.

O que muda na sua decisão de hoje

O Nova 2 Lite não é o mais barato nem o mais inteligente. É o multimodal mais completo entre os pares cotados, com vídeo e 1M de contexto num pacote só. Se vídeo não está no seu roadmap, o dinheiro está melhor empregado em outro lugar. Se está, o Nova 2 Lite é o único da lista que te atende — e você paga o preço disso na fatura.

Em uma frase

Só escolha o Nova 2 Lite se vídeo como entrada for requisito; para qualquer outro caso, o gpt-oss-120b entrega mais inteligência por uma fração do custo.

Perguntas frequentes

O Nova 2 Lite é realmente mais barato que o o3?

Sim, no output: US$ 2,50 contra US$ 8,00 por milhão de tokens. Mas o o3 tem IQ 31,10 contra 19,24 do Nova 2 Lite, então a comparação de custo-benefício depende do que você está construindo — o o3 continua sendo o mais inteligente do catálogo.

Quando o Nova 2 Lite compensa em relação ao gpt-oss-120b?

Quando você precisa de vídeo como entrada ou de contexto de 1M de tokens e não quer montar pipeline multimodal. Para texto puro, o gpt-oss-120b é mais inteligente (IQ 24,13 vs 19,24) e quase 15 vezes mais barato no output.

O Nova 2 Lite tem pesos abertos?

Não. É modelo fechado, hospedado pela Amazon. Todos os pares do comparativo (gpt-oss-20b, gpt-oss-120b, Llama 4 Maverick e Qwen3 Next Instruct) são open weights e podem ser baixados e rodados localmente.

Leia também