Nova 2 Lite custa o triplo do Qwen3 Next e entrega 40% mais IQ
Amazon aposta em multimodal e reasoning; Qwen responde com pesos abertos e 1M de tokens de cache barato. Cada um ganha num tipo de tarefa — e nenhum dos dois ganha em todas.
A conta que ninguém faz na hora do "uau"
Saiu no catálogo um modelo da Amazon a US$ 2,50 por milhão de tokens de saída. Saiu também um modelo da Qwen a US$ 1,10 pelo mesmo milhão. Em release, ambos parecem "baratos". Na fatura, a diferença é de 127% — e é aí que o seu CFO acorda. Vamos colocar os dois lado a lado sem marketing no meio.
Inteligência medida hoje, não promessa de release
A Nova 2 Lite marca 19,24 no índice de inteligência da Artificial Analysis. O Qwen3 Next 80B A3B Instruct marca 13,75. Em termos absolutos, a Lite entrega 40% mais IQ. Em termos relativos, ela se senta entre o Claude Haiku 4.5 (29,89) e o Devstral 2 (19,24), enquanto o Qwen fica mais perto da faixa intermediária do catálogo.
Detalhe que importa: o índice é medido hoje, não na data de lançamento. Então não dá para dizer que a Lite "subiu" desde dezembro — só dá para dizer que, nesta semana, ela está à frente do Qwen3 Next.
O que você paga em cada um
A Lite cobra US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de saída. O Qwen3 Next cobra US$ 0,10 de entrada e US$ 1,10 de saída — e ainda oferece cache a US$ 0,07 por milhão, recurso que a Amazon não publicou preço nesta data.
Traduzindo: se o seu fluxo é 80% entrada e 20% saída, a Lite custa em média US$ 0,85 por milhão de tokens misturados; o Qwen custa US$ 0,41. Em 100 milhões de tokens por mês, são US$ 85 contra US$ 41 — diferença de US$ 44 que some rápido quando você escala.
Multimodal contra texto puro
Aqui está a virada que o preço não conta. A Nova 2 Lite aceita texto, imagem, arquivo e vídeo e devolve texto. O Qwen3 Next é estritamente texto→texto. Se o seu pipeline precisa descrever frames de vídeo, ler PDFs escaneados ou interpretar screenshots, o Qwen3 Next nem entra na conversa — é o tipo de tarefa em que a Lite ganha sem disputa.
| Critério | Nova 2 Lite | Qwen3 Next 80B A3B Instruct |
|---|---|---|
| Índice de inteligência | 19.2 | 13.8 |
| Entrada US$/M | 0.3 | 0.1 |
| Saída US$/M | 2.5 | 1.1 |
| Contexto | 1M | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 153 | 173 |
| Índice de código | — | — |
| Índice agêntico | — | — |
Outro ponto: a Lite tem flag de reasoning, o Qwen3 Next Instruct não. Para workloads que precisam de cadeia de raciocínio explícita (planejamento, agentic loops, debug de código), a Lite tem a arquitetura a favor. O Qwen3 Next é otimizado para respostas rápidas e estáveis sem traços de "thinking" — o oposto do perfil.
Janela de contexto e velocidade
A Lite oferece 1 milhão de tokens de contexto. O Qwen3 Next oferece 262 mil. Em tarefas que exigem colar um repositório inteiro ou um livro, a Lite leva vantagem. Em velocidade bruta, o Qwen entrega 173 tokens por segundo contra 153 da Lite — diferença pequena, mas que pesa em UX de chatbot.
Onde cada um ganha
A Nova 2 Lite ganha quando você precisa de multimodalidade, reasoning ativo, ou contexto de 1M. Paga-se o premium: US$ 2,50 por milhão de saída é quase o que o Claude Haiku 4.5 cobra (US$ 5,00), só que sem chegar lá em IQ.
O Qwen3 Next 80B A3B Instruct ganha quando o workload é texto puro, o orçamento é apertado e você quer pesos abertos (open_weights: true) — pode self-host, ajustar, fine-tunar. A arquitetura Mixture-of-Experts com 80B totais e 3B ativos explica o custo baixo por token.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
A escolha pragmática
Se você está pagando API e o caso de uso cabe em texto, o Qwen3 Next custa menos da metade e entrega 71% do IQ. Se você precisa ver imagens ou vídeo, a Lite é a única opção entre as duas — e o preço é o preço. O erro comum é escolher pela métrica de inteligência isolada: ela não conta multimodalidade, nem cache, nem a possibilidade de tirar o modelo do API.
Texto puro e orçamento curto: Qwen3 Next 80B A3B. Imagem, vídeo ou reasoning pesado: Nova 2 Lite, e aceite pagar o dobro por milhão de saída.
Perguntas frequentes
Qual a diferença de preço entre Nova 2 Lite e Qwen3 Next 80B A3B?
A Nova 2 Lite cobra US$ 2,50 por milhão de tokens de saída, contra US$ 1,10 do Qwen3 Next. Na média ponderada (80% entrada, 20% saída), a Lite custa cerca de US$ 0,85 por milhão e o Qwen US$ 0,41.
A Nova 2 Lite aceita imagens e vídeo?
Sim. A Nova 2 Lite é multimodal: aceita texto, imagem, arquivo e vídeo e devolve texto. O Qwen3 Next 80B A3B Instruct só trabalha com texto→texto.
Qual tem índice de inteligência maior?
A Nova 2 Lite marca 19,24 no índice da Artificial Analysis, contra 13,75 do Qwen3 Next 80B A3B Instruct. A Lite fica entre o Claude Haiku 4.5 e o Devstral 2; o Qwen fica na faixa intermediária do catálogo.