Nova 2 Lite cobra o dobro do Qwen3 Next e entrega mais IQ
Comparativo frente a frente entre os dois modelos de raciocínio que disputam a faixa barata do catálogo em dezembro de 2025.
O que está em jogo
A Amazon lançou a Nova 2 Lite no dia 2 de dezembro e quatro dias depois ela já aparece no meio do catálogo, cobrando US$ 2,50 por milhão de tokens de saída. O Qwen3 Next 80B A3B Thinking, da chinesa Qwen, está no mercado desde 11 de setembro e cobra US$ 1,20 pela mesma unidade. Em outras palavras: para cada milhão de tokens que o seu sistema cospe, a Lite custa mais que o dobro da Qwen.
A pergunta que paga a conta é simples: esse extra de US$ 1,30 por milhão se traduz em algo que você vê no produto final?
Inteligência medida hoje, não promessa de release
A Lite marca 19,24 no índice de inteligência da Artificial Analysis medido nesta data. A Qwen3 Next marca 16,867. Diferença real, de cerca de 14% a favor da americana. Em tarefas de raciocínio, ambas são modelos "thinking" — emitem cadeia de pensamento antes da resposta — então a comparação não é entre um pensador e um papagaio.
Mas a Lite também lê imagem e vídeo, enquanto a Qwen só processa texto. Se o seu fluxo recebe print de erro, foto de nota fiscal ou frame de câmera, a Lite entra e a Qwen nem sabe do que você está falando.
Onde a conta muda
O preço de entrada da Lite é US$ 0,30 por milhão de tokens; o da Qwen é US$ 0,15. Mesma proporção: Lite custa o dobro para ler e para escrever. O catálogo não publicou preço de cache para nenhum dos dois, então não dá para economizar com prompt cacheado — é bom saber antes de montar a arquitetura.
| Critério | Nova 2 Lite | Qwen3 Next 80B A3B Thinking |
|---|---|---|
| Índice de inteligência | 19.2 | 16.9 |
| Entrada US$/M | 0.3 | 0.15 |
| Saída US$/M | 2.5 | 1.2 |
| Contexto | 1M | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 153 | 197 |
| Índice de código | — | 17.4 |
| Índice agêntico | — | 2.1 |
Velocidade: a Qwen entrega 196,94 tokens por segundo contra 153,24 da Lite. Em um chatbot com 10 mil respostas por dia, essa diferença de ~44 tokens/s aparece como latência percebida pelo usuário final. Não é dramática, mas é visível.
Para quem cada um ganha
A Lite ganha quando o seu produto precisa enxergar — multimodal de verdade, com vídeo no pipeline — e quando cada 2,4 pontos de IQ a mais no índice se traduzem em menos alucinações que cheguem ao cliente. Paga-se o dobro do token para isso.
A Qwen3 Next ganha quando o volume é alto, o input é só texto e o orçamento é o que manda. Ela ainda tem pesos abertos (open weights), o que significa que você pode hospedar, fazer fine-tuning ou rodar offline se a régua de compliance pedir. A Lite não oferece nada disso.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Nova 2 Lite | 19.2 | 2.5 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
Para situar: as duas estão bem abaixo do topo do catálogo, onde OpenAI o3 lidera com 31,096 e Claude Haiku 4.5 vem em segundo com 29,892. A Lite está em quarto lugar geral, a Qwen em quinto. Você não está escolhendo entre o melhor do mercado; está escolhendo entre duas opções baratas que entregam raciocínio honesto sem cobrar preço de fronteira.
Na prática, hoje
Se você está montando um agente que lê screenshots e gera relatório, a Lite é a escolha óbvia — o multimodal compensa o token mais caro. Se você está processando milhares de chamadas de texto por dia num pipeline de classificação ou extração, a Qwen3 Next custa a metade e roda mais rápido, com a vantagem extra de poder sair da API quando o volume justificar.
E o detalhe que ninguém comenta: ambas são modelos de raciocínio, então a resposta chega depois de uma cadeia de pensamento que consome tokens de saída. Quanto mais raciocínio, mais você paga por token de saída. Nesse regime, a diferença de US$ 1,30 por milhão entre as duas vira diferença de conta no fim do mês — e é exatamente isso que decide qual das duas entra no seu roteamento.
Lite para multimodal com texto e vídeo, Qwen3 Next para alto volume só-texto onde o custo por token manda e pesos abertos são um diferencial.
Perguntas frequentes
Nova 2 Lite é mais inteligente que a Qwen3 Next 80B A3B Thinking?
Sim, segundo o índice da Artificial Analysis medido em dezembro de 2025: 19,24 contra 16,867, uma diferença de cerca de 14% a favor da Lite. Em troca, a Lite custa mais que o dobro por milhão de tokens de saída.
Qual dos dois aceita imagem e vídeo?
A Nova 2 Lite. A modalidade declarada é texto + imagem + arquivo + vídeo gerando texto. A Qwen3 Next 80B A3B Thinking é apenas texto → texto, então qualquer entrada multimodal precisa ser convertida antes.
A Qwen3 Next tem pesos abertos?
Sim. O campo open_weights vem marcado como true e a Qwen declara 80B de parâmetros totais com 3B ativos, formato mixture-of-experts. A Nova 2 Lite não tem pesos abertos publicados.