FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nova 2 Lite custa o triplo do Qwen3 Next e entrega 40% mais IQ

Amazon aposta em multimodal e reasoning; Qwen responde com pesos abertos e 1M de tokens de cache barato. Cada um ganha num tipo de tarefa — e nenhum dos dois ganha em todas.

Redação FalaVIP IA 3 min de leitura
US$ 2,50por milhão de tokens de saída na Nova 2 Lite
US$ 1,10por milhão de tokens de saída no Qwen3 Next 80B A3B
19,24índice de inteligência da Nova 2 Lite

A conta que ninguém faz na hora do "uau"

Saiu no catálogo um modelo da Amazon a US$ 2,50 por milhão de tokens de saída. Saiu também um modelo da Qwen a US$ 1,10 pelo mesmo milhão. Em release, ambos parecem "baratos". Na fatura, a diferença é de 127% — e é aí que o seu CFO acorda. Vamos colocar os dois lado a lado sem marketing no meio.

Inteligência medida hoje, não promessa de release

A Nova 2 Lite marca 19,24 no índice de inteligência da Artificial Analysis. O Qwen3 Next 80B A3B Instruct marca 13,75. Em termos absolutos, a Lite entrega 40% mais IQ. Em termos relativos, ela se senta entre o Claude Haiku 4.5 (29,89) e o Devstral 2 (19,24), enquanto o Qwen fica mais perto da faixa intermediária do catálogo.

Índice de inteligência (Artificial Analysis)
Nova 2 Lite19,2Qwen3 Next 80B A3B Instruct13,8índice
Fonte: Artificial Analysis

Detalhe que importa: o índice é medido hoje, não na data de lançamento. Então não dá para dizer que a Lite "subiu" desde dezembro — só dá para dizer que, nesta semana, ela está à frente do Qwen3 Next.

O que você paga em cada um

A Lite cobra US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de saída. O Qwen3 Next cobra US$ 0,10 de entrada e US$ 1,10 de saída — e ainda oferece cache a US$ 0,07 por milhão, recurso que a Amazon não publicou preço nesta data.

Preço de saída (US$ por milhão de tokens)
Nova 2 Lite2,5Qwen3 Next 80B A3B Instruct1,1US$/M
Fonte: OpenRouter

Traduzindo: se o seu fluxo é 80% entrada e 20% saída, a Lite custa em média US$ 0,85 por milhão de tokens misturados; o Qwen custa US$ 0,41. Em 100 milhões de tokens por mês, são US$ 85 contra US$ 41 — diferença de US$ 44 que some rápido quando você escala.

Multimodal contra texto puro

Aqui está a virada que o preço não conta. A Nova 2 Lite aceita texto, imagem, arquivo e vídeo e devolve texto. O Qwen3 Next é estritamente texto→texto. Se o seu pipeline precisa descrever frames de vídeo, ler PDFs escaneados ou interpretar screenshots, o Qwen3 Next nem entra na conversa — é o tipo de tarefa em que a Lite ganha sem disputa.

Nova 2 Lite × Qwen3 Next 80B A3B Instruct
CritérioNova 2 LiteQwen3 Next 80B A3B Instruct
Índice de inteligência19.213.8
Entrada US$/M0.30.1
Saída US$/M2.51.1
Contexto1M262k
Pesos abertosnãosim
Velocidade (tok/s)153173
Índice de código
Índice agêntico

Outro ponto: a Lite tem flag de reasoning, o Qwen3 Next Instruct não. Para workloads que precisam de cadeia de raciocínio explícita (planejamento, agentic loops, debug de código), a Lite tem a arquitetura a favor. O Qwen3 Next é otimizado para respostas rápidas e estáveis sem traços de "thinking" — o oposto do perfil.

Janela de contexto e velocidade

A Lite oferece 1 milhão de tokens de contexto. O Qwen3 Next oferece 262 mil. Em tarefas que exigem colar um repositório inteiro ou um livro, a Lite leva vantagem. Em velocidade bruta, o Qwen entrega 173 tokens por segundo contra 153 da Lite — diferença pequena, mas que pesa em UX de chatbot.

Onde cada um ganha

A Nova 2 Lite ganha quando você precisa de multimodalidade, reasoning ativo, ou contexto de 1M. Paga-se o premium: US$ 2,50 por milhão de saída é quase o que o Claude Haiku 4.5 cobra (US$ 5,00), só que sem chegar lá em IQ.

O Qwen3 Next 80B A3B Instruct ganha quando o workload é texto puro, o orçamento é apertado e você quer pesos abertos (open_weights: true) — pode self-host, ajustar, fine-tunar. A arquitetura Mixture-of-Experts com 80B totais e 3B ativos explica o custo baixo por token.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 313 modelos disponíveis no catálogo nesta data.

A escolha pragmática

Se você está pagando API e o caso de uso cabe em texto, o Qwen3 Next custa menos da metade e entrega 71% do IQ. Se você precisa ver imagens ou vídeo, a Lite é a única opção entre as duas — e o preço é o preço. O erro comum é escolher pela métrica de inteligência isolada: ela não conta multimodalidade, nem cache, nem a possibilidade de tirar o modelo do API.

Em uma frase

Texto puro e orçamento curto: Qwen3 Next 80B A3B. Imagem, vídeo ou reasoning pesado: Nova 2 Lite, e aceite pagar o dobro por milhão de saída.

Perguntas frequentes

Qual a diferença de preço entre Nova 2 Lite e Qwen3 Next 80B A3B?

A Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída, contra US$ 1,10 do Qwen3 Next. Na média ponderada (80% entrada, 20% saída), a Lite custa cerca de US$ 0,85 por milhão e o Qwen US$ 0,41.

A Nova 2 Lite aceita imagens e vídeo?

Sim. A Nova 2 Lite é multimodal: aceita texto, imagem, arquivo e vídeo e devolve texto. O Qwen3 Next 80B A3B Instruct só trabalha com texto→texto.

Qual tem índice de inteligência maior?

A Nova 2 Lite marca 19,24 no índice da Artificial Analysis, contra 13,75 do Qwen3 Next 80B A3B Instruct. A Lite fica entre o Claude Haiku 4.5 e o Devstral 2; o Qwen fica na faixa intermediária do catálogo.

Leia também