FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Amazon Nova 2 Lite cobra 19 vezes mais na saída que o gpt-oss-20b da OpenAI

Dois modelos norte-americanos de baixo custo, mas o preço por token de saída revela quem mira produção em escala e quem mira economia de verdade.

Redação FalaVIP IA 3 min de leitura
US$ 2,50preço de saída do Nova 2 Lite por milhão de tokens
US$ 0,13preço de saída do gpt-oss-20b por milhão de tokens
19×diferença de preço de saída entre os dois modelos

Amazon e OpenAI chegaram ao fim de 2025 com modelos pequenos no catálogo, ambos vendidos como opção de baixo custo. Só que, quando você abre a fatura, a conversa muda: o Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída, enquanto o gpt-oss-20b cobra US$ 0,13. É diferença de quase 19 vezes no mesmo item da conta. E é justamente essa linha — a saída — que destrói orçamento em chat, agente e geração de código.

O que cada um entrega, em uma linha

O Nova 2 Lite é um modelo de raciocínio da Amazon, lançado no começo de dezembro, multimodal (lê texto, imagem, arquivo e vídeo e devolve texto), com contexto de 1 milhão de tokens e velocidade medida em 153 tokens por segundo. O gpt-oss-20b é o modelo de peso aberto da OpenAI, de agosto, só texto, com contexto de 131 mil tokens, 21 bilhões de parâmetros totais e 3,6 bilhões ativos por passagem, sob licença Apache 2.0.

Se você precisa que o modelo "veja" um PDF, uma captura de tela ou um vídeo antes de responder, a resposta é simples: o Nova 2 Lite é o único dos dois que aceita essa entrada.

Onde está a diferença de preço

A entrada do Nova 2 Lite custa US$ 0,30 por milhão de tokens. A do gpt-oss-20b custa US$ 0,03. Dez vezes mais barato na entrada também — mas a maioria das aplicações de chat e agente queima muito mais tokens na resposta do que na pergunta, então é na saída que o custo pesa.

Preço de saída (US$ por milhão de tokens)
Nova 2 Lite2,5gpt-oss-20b0,13US$/M
Fonte: OpenRouter

Para colocar em números reais: 1 milhão de tokens de saída no Nova 2 Lite sai por US$ 2,50. No gpt-oss-20b, o mesmo 1 milhão sai por US$ 0,13. Em um pipeline que gera 50 milhões de tokens de saída por mês — volume comum em agente de suporte, por exemplo — a conta fecha em US$ 125 no Nova 2 Lite e US$ 6,50 no gpt-oss-20b.

Inteligência medida hoje

O índice de inteligência do catálogo, medido nesta data, coloca o Nova 2 Lite em 19,24 e o gpt-oss-20b em 15,23. Em coding, a OpenAI marca 20,70 contra dado não publicado pela Amazon; em agentic, 3,10 também só pela OpenAI.

Índice de inteligência (Artificial Analysis)
Nova 2 Lite19,2gpt-oss-20b15,2índice
Fonte: Artificial Analysis

Traduzindo: o Nova 2 Lite está à frente no índice geral e abre uma frente multimodal que o gpt-oss-20b nem disputa. Mas essa frente custa — e muito.

Nova 2 Lite × gpt-oss-20b
CritérioNova 2 Litegpt-oss-20b
Índice de inteligência19.215.2
Entrada US$/M0.30.03
Saída US$/M2.50.13
Contexto1M131k
Pesos abertosnãosim
Velocidade (tok/s)153113
Índice de código20.7
Índice agêntico3.1

E o resto do tabuleiro?

Em 31 de dezembro de 2025, o catálogo soma mais de 313 modelos de 48 criadores. O topo do índice de inteligência é ocupado pelo Xiaomi MiMo-V2-Flash (34,02), seguido por OpenAI o3 (31,10) e Anthropic Claude Haiku 4.5 (29,89). Os dois modelos deste comparativo ficam bem abaixo — e foram escolhidos justamente porque brigam na faixa de baixo custo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 313 modelos disponíveis no catálogo nesta data.

Quando cada um ganha

O Nova 2 Lite ganha quando você precisa processar documento, imagem ou vídeo junto com texto, e quando cada ponto a mais de raciocínio vale os quase 19 vezes a mais na saída. Pense em análise de PDF jurídico, resumo de vídeo, extração de dados de captura de tela.

O gpt-oss-20b ganha quando o volume de saída é o que manda no orçamento e você não precisa de multimodal. É o caso de chatbot de atendimento, agente que só lê texto, geração de rascunho em massa. O bônus é o peso aberto sob Apache 2.0: você pode hospedar em casa e cortar a API do meio.

Em uma frase

Se a sua fatura explode na saída e multimodal não é requisito, migre para o gpt-oss-20b; se você precisa ler imagem e vídeo, aceite o custo extra do Nova 2 Lite e meça se o ganho de raciocínio compensa.

Perguntas frequentes

O Amazon Nova 2 Lite é mais barato que o gpt-oss-20b?

Não. O Nova 2 Lite custa US$ 2,50 por milhão de tokens de saída, contra US$ 0,13 do gpt-oss-20b — cerca de 19 vezes mais caro na saída. Na entrada a diferença também existe: US$ 0,30 contra US$ 0,03.

Qual dos dois aceita imagem e vídeo?

Apenas o Amazon Nova 2 Lite. Ele é multimodal no entrada (texto, imagem, arquivo e vídeo) e devolve texto. O gpt-oss-20b trabalha só com texto.

O gpt-oss-20b pode ser hospedado localmente?

Sim. Ele é distribuído sob licença Apache 2.0 como modelo de peso aberto, com 21 bilhões de parâmetros totais e 3,6 bilhões ativos por passagem, o que permite rodar em hardware próprio e eliminar o custo recorrente da API.

Leia também