Amazon Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída
É mais barato que o o3 no output, mas perde feio em custo-benefício para o gpt-oss-120b — exceto quando o requisito é vídeo.
Amazon Nova 2 Lite chegou ontem (02/12/2025) e o release da Amazon repete a palavra que todo mundo gosta de colar em anúncio de modelo: "cost-effective". A pergunta que importa é outra — custo-efetivo contra o quê, e em qual fatia do uso?
No índice de inteligência medido hoje, o Nova 2 Lite marca 19,24. Isso coloca o modelo da Amazon em quarto lugar no catálogo geral, atrás do o3 (31,10), do Claude Haiku 4.5 (29,89) e do gpt-oss-120b da própria OpenAI (24,13). Não é ruim. Só não é o topo.
O preço que entra nos slides
O input do Nova 2 Lite sai por US$ 0,30 por milhão de tokens. O output, US$ 2,50. Aqui é onde a narrativa tropeça.
Compare com o gpt-oss-120b, que tem IQ maior (24,13 contra 19,24) e cobra US$ 0,17 no output. O Nova 2 Lite custa 14,7 vezes mais por token gerado. Repita o número devagar: catorze vírgula sete vezes.
No gpt-oss-20b, irmão menor do 120b, o output é US$ 0,13 — quase vinte vezes mais barato. E o IQ é 15,23, não muito abaixo dos 19,24 do Nova 2 Lite.
A defesa da Amazon, claro, é que o Nova 2 Lite é multimodal — aceita texto, imagem, arquivo e vídeo numa única chamada. Os dois modelos abertos da OpenAI são text-only. Concordo. Mas multimodalidade por vinte vezes o preço? É preciso usar muito vídeo para a conta fechar.
Onde o Nova 2 Lite ganha sem precisar brigar
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Nova 2 Lite (o novo) | 19.2 | 0.3 | 2.5 | 1M |
| gpt-oss-20b | 15.2 | 0.03 | 0.13 | 131k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Llama 4 Maverick | 14.5 | 0.2 | 0.696 | 1.05M |
| Qwen3 Next 80B A3B Instruct | 13.8 | 0.1 | 1.1 | 262k |
O Nova 2 Lite tem três coisas que nenhum dos pares listados tem ao mesmo tempo.
Primeira: contexto de 1.000.000 de tokens. O gpt-oss-120b e o gpt-oss-20b operam em 131.072. O Qwen3 Next Instruct, em 262.144. O Llama 4 Maverick também chega a 1M, mas é multimodal só de imagem, não de vídeo.
Segunda: vídeo como entrada. Os outros quatro modelos do comparativo não processam vídeo. Se você precisa transcrever, resumir ou extrair informação de clipes sem montar pipeline externo, o Nova 2 Lite é o único dos pares listados que faz isso nativamente.
Terceira: raciocínio declarado (reasoning: true), coisa que o Llama 4 Maverick e o Qwen3 Next Instruct deste comparativo não trazem.
A velocidade de 153 tokens por segundo coloca o Nova 2 Lite à frente do gpt-oss-20b (112 t/s) e do Llama 4 Maverick (86 t/s), praticamente empatando com o gpt-oss-120b (155 t/s).
Para quem vale — e para quem não
Vale para você se:
- precisa de vídeo como entrada em produção hoje, sem montar pipeline externo;
- o workload é majoritariamente de leitura (input) com geração curta, porque aí o input barato (US$ 0,30) compensa o output caro;
- 1M de contexto muda a arquitetura da sua aplicação — você não quer partir documento;
- já está no ecossistema Amazon e prefere latência curta a custo mínimo.
Não vale para você se:
- o trabalho é só texto e você quer pagar o mínimo por inteligência — o gpt-oss-120b é 14,7 vezes mais barato no output e tem IQ maior;
- você precisa de pesos abertos para rodar local, fazer fine-tune ou auditar — o Nova 2 Lite é fechado;
- você está montando fluxo agentic — o gpt-oss-120b publicou agentic 13,43; do Nova 2 Lite, esse número não veio a público;
- você está fazendo codificação pesada — o Nova 2 Lite não publicou métrica de coding.
O que muda na sua decisão de hoje
O Nova 2 Lite não é o mais barato nem o mais inteligente. É o multimodal mais completo entre os pares cotados, com vídeo e 1M de contexto num pacote só. Se vídeo não está no seu roadmap, o dinheiro está melhor empregado em outro lugar. Se está, o Nova 2 Lite é o único da lista que te atende — e você paga o preço disso na fatura.
Só escolha o Nova 2 Lite se vídeo como entrada for requisito; para qualquer outro caso, o gpt-oss-120b entrega mais inteligência por uma fração do custo.
Perguntas frequentes
O Nova 2 Lite é realmente mais barato que o o3?
Sim, no output: US$ 2,50 contra US$ 8,00 por milhão de tokens. Mas o o3 tem IQ 31,10 contra 19,24 do Nova 2 Lite, então a comparação de custo-benefício depende do que você está construindo — o o3 continua sendo o mais inteligente do catálogo.
Quando o Nova 2 Lite compensa em relação ao gpt-oss-120b?
Quando você precisa de vídeo como entrada ou de contexto de 1M de tokens e não quer montar pipeline multimodal. Para texto puro, o gpt-oss-120b é mais inteligente (IQ 24,13 vs 19,24) e quase 15 vezes mais barato no output.
O Nova 2 Lite tem pesos abertos?
Não. É modelo fechado, hospedado pela Amazon. Todos os pares do comparativo (gpt-oss-20b, gpt-oss-120b, Llama 4 Maverick e Qwen3 Next Instruct) são open weights e podem ser baixados e rodados localmente.