FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nova 2 Lite cobra o dobro do Qwen3 Next e entrega mais IQ

Comparativo frente a frente entre os dois modelos de raciocínio que disputam a faixa barata do catálogo em dezembro de 2025.

Redação FalaVIP IA 3 min de leitura
US$ 2,50por milhão de tokens de saída da Nova 2 Lite
US$ 1,20por milhão de tokens de saída do Qwen3 Next
19,24índice de inteligência da Nova 2 Lite

O que está em jogo

A Amazon lançou a Nova 2 Lite no dia 2 de dezembro e quatro dias depois ela já aparece no meio do catálogo, cobrando US$ 2,50 por milhão de tokens de saída. O Qwen3 Next 80B A3B Thinking, da chinesa Qwen, está no mercado desde 11 de setembro e cobra US$ 1,20 pela mesma unidade. Em outras palavras: para cada milhão de tokens que o seu sistema cospe, a Lite custa mais que o dobro da Qwen.

Preço de saída (US$ por milhão de tokens)
Nova 2 Lite2,5Qwen3 Next 80B A3B Thinking1,2US$/M
Fonte: OpenRouter

A pergunta que paga a conta é simples: esse extra de US$ 1,30 por milhão se traduz em algo que você vê no produto final?

Inteligência medida hoje, não promessa de release

A Lite marca 19,24 no índice de inteligência da Artificial Analysis medido nesta data. A Qwen3 Next marca 16,867. Diferença real, de cerca de 14% a favor da americana. Em tarefas de raciocínio, ambas são modelos "thinking" — emitem cadeia de pensamento antes da resposta — então a comparação não é entre um pensador e um papagaio.

Índice de inteligência (Artificial Analysis)
Nova 2 Lite19,2Qwen3 Next 80B A3B Thinking16,9índice
Fonte: Artificial Analysis

Mas a Lite também lê imagem e vídeo, enquanto a Qwen só processa texto. Se o seu fluxo recebe print de erro, foto de nota fiscal ou frame de câmera, a Lite entra e a Qwen nem sabe do que você está falando.

Onde a conta muda

O preço de entrada da Lite é US$ 0,30 por milhão de tokens; o da Qwen é US$ 0,15. Mesma proporção: Lite custa o dobro para ler e para escrever. O catálogo não publicou preço de cache para nenhum dos dois, então não dá para economizar com prompt cacheado — é bom saber antes de montar a arquitetura.

Nova 2 Lite × Qwen3 Next 80B A3B Thinking
CritérioNova 2 LiteQwen3 Next 80B A3B Thinking
Índice de inteligência19.216.9
Entrada US$/M0.30.15
Saída US$/M2.51.2
Contexto1M262k
Pesos abertosnãosim
Velocidade (tok/s)153197
Índice de código17.4
Índice agêntico2.1

Velocidade: a Qwen entrega 196,94 tokens por segundo contra 153,24 da Lite. Em um chatbot com 10 mil respostas por dia, essa diferença de ~44 tokens/s aparece como latência percebida pelo usuário final. Não é dramática, mas é visível.

Para quem cada um ganha

A Lite ganha quando o seu produto precisa enxergar — multimodal de verdade, com vídeo no pipeline — e quando cada 2,4 pontos de IQ a mais no índice se traduzem em menos alucinações que cheguem ao cliente. Paga-se o dobro do token para isso.

A Qwen3 Next ganha quando o volume é alto, o input é só texto e o orçamento é o que manda. Ela ainda tem pesos abertos (open weights), o que significa que você pode hospedar, fazer fine-tuning ou rodar offline se a régua de compliance pedir. A Lite não oferece nada disso.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Nova 2 Lite19.22.5
Qwen3 Next 80B A3B Thinking16.91.2
Entre os 294 modelos disponíveis no catálogo nesta data.

Para situar: as duas estão bem abaixo do topo do catálogo, onde OpenAI o3 lidera com 31,096 e Claude Haiku 4.5 vem em segundo com 29,892. A Lite está em quarto lugar geral, a Qwen em quinto. Você não está escolhendo entre o melhor do mercado; está escolhendo entre duas opções baratas que entregam raciocínio honesto sem cobrar preço de fronteira.

Na prática, hoje

Se você está montando um agente que lê screenshots e gera relatório, a Lite é a escolha óbvia — o multimodal compensa o token mais caro. Se você está processando milhares de chamadas de texto por dia num pipeline de classificação ou extração, a Qwen3 Next custa a metade e roda mais rápido, com a vantagem extra de poder sair da API quando o volume justificar.

E o detalhe que ninguém comenta: ambas são modelos de raciocínio, então a resposta chega depois de uma cadeia de pensamento que consome tokens de saída. Quanto mais raciocínio, mais você paga por token de saída. Nesse regime, a diferença de US$ 1,30 por milhão entre as duas vira diferença de conta no fim do mês — e é exatamente isso que decide qual das duas entra no seu roteamento.

Em uma frase

Lite para multimodal com texto e vídeo, Qwen3 Next para alto volume só-texto onde o custo por token manda e pesos abertos são um diferencial.

Perguntas frequentes

Nova 2 Lite é mais inteligente que a Qwen3 Next 80B A3B Thinking?

Sim, segundo o índice da Artificial Analysis medido em dezembro de 2025: 19,24 contra 16,867, uma diferença de cerca de 14% a favor da Lite. Em troca, a Lite custa mais que o dobro por milhão de tokens de saída.

Qual dos dois aceita imagem e vídeo?

A Nova 2 Lite. A modalidade declarada é texto + imagem + arquivo + vídeo gerando texto. A Qwen3 Next 80B A3B Thinking é apenas texto → texto, então qualquer entrada multimodal precisa ser convertida antes.

A Qwen3 Next tem pesos abertos?

Sim. O campo open_weights vem marcado como true e a Qwen declara 80B de parâmetros totais com 3B ativos, formato mixture-of-experts. A Nova 2 Lite não tem pesos abertos publicados.

Leia também