Qwen3 Coder Next custa 3× menos que Nova 2 Lite na saída
Modelo chinês open-weight ganha em preço e benchmark de coding; Amazon responde com multimodalidade, raciocínio e contexto de 1 milhão
US$ 0,80 ou US$ 2,50 — a pergunta que decide o orçamento do mês
A primeira linha da fatura de API é o token de saída. E nesse indicador o Qwen3 Coder Next cobra US$ 0,80 por milhão de tokens, contra US$ 2,50 da Amazon Nova 2 Lite. Para um coding agent que gera 10 milhões de tokens por dia, são US$ 8 contra US$ 25 — diferença que, multiplicada por um mês, vira mais de US$ 500 só na saída. No input a proporção repete: US$ 0,12 contra US$ 0,30, 2,5× mais barato no chinês. No cache, o Qwen3 cobra US$ 0,07 por milhão; a Amazon não publicou esse valor para a Nova 2 Lite. Lançado em 4 de fevereiro de 2026, três dias antes deste comparativo, o Qwen3 Coder Next entra direto no orçamento de quem roda agente em produção.
Feitos para problemas diferentes
A escolha não é sobre qual é "melhor" no vácuo. É sobre qual problema cada um resolve, e a ficha técnica mostra o desenho de cada um.
O Qwen3 Coder Next é causal, open-weight, do Qwen. São 79,7 bilhões de parâmetros totais com apenas 3 bilhões ativos por inferência — um design MoE esparso pensado para rodar em hardware comum sem queimar orçamento de GPU. Treinado especificamente para coding agents e fluxos locais de desenvolvimento, não é modelo de raciocínio e só trabalha com texto. Você baixa os pesos e hospeda onde quiser.
O Amazon Nova 2 Lite é o oposto complementar: fechado, multimodal (texto, imagem, arquivo e vídeo na entrada, texto na saída) e marcado como reasoning model. Chegou ao catálogo em 2 de dezembro de 2025, dois meses antes deste comparativo. A Amazon não publicou o número de parâmetros nem os scores de coding e agentic, embora o modelo seja vendido como opção de "raciocínio rápido e custo-efetivo" para cargas do dia a dia.
| Critério | Qwen3 Coder Next | Nova 2 Lite |
|---|---|---|
| Índice de inteligência | 21.3 | 19.2 |
| Entrada US$/M | 0.12 | 0.3 |
| Saída US$/M | 0.8 | 2.5 |
| Contexto | 262k | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 130 | 153 |
| Índice de código | 36.2 | — |
| Índice agêntico | 8.9 | — |
Inteligência e código: os números que a Nova escolheu não mostrar
No índice de inteligência da Artificial Analysis, o Qwen3 Coder Next marca 21,29 e o Nova 2 Lite, 19,24. Diferença pequena, mas a favor do chinês. Onde a distância explode é em coding: 36,23 do Qwen contra dado não publicado da Amazon. Em agentic, mesma história — 8,86 do Qwen, nada da Nova.
A ausência de benchmark da Nova 2 Lite nesses dois eixos vale como informação. A Amazon costuma destacar o que mede bem; quando o recorte é coding agents, o silêncio não é neutro — é escolha editorial de quem não quer ser comparado onde sabe que perde.
Para situar no tabuleiro: o Qwen3 Coder Next está em quinto lugar no índice de inteligência do catálogo nesta data, abaixo do Xiaomi MiMo-V2-Flash (34,02), do OpenAI o3 (31,10) e do Anthropic Claude Haiku 4.5 (29,89). O Nova 2 Lite vem logo atrás, fora do top 5.
Contexto e modalidades: o território exclusivo da Nova
Aqui o jogo vira. A Nova 2 Lite aceita 1 milhão de tokens de contexto, quase 4× mais que os 262 mil do Qwen3, e processa imagem, PDF e vídeo na entrada. Se o seu caso de uso é "anexar um print de erro, mandar um trecho de PDF de especificações, ou resumir um vídeo", só a Nova entra no páreo. O Qwen3 Coder Next é estritamente texto.
Em velocidade a Nova também leva: 153,24 tokens por segundo contra 129,5 do Qwen3, segundo a medição do catálogo. Não chega a dobrar, mas pesa em UX quando a interface mostra streaming em tempo real para o usuário.
Quando cada um ganha — sem "depende"
Escolha o Qwen3 Coder Next quando o caso de uso é coding agent em produção, a fatura mensal pesa, você quer hospedar localmente ou só opera com texto. É 3,1× mais barato na saída, é open-weight, foi treinado para o trabalho e tem benchmark público de coding.
Escolha o Amazon Nova 2 Lite quando multimodalidade é requisito não negociável, o prompt passa de 262 mil tokens, ou você quer traços explícitos de raciocínio encadeado sem montar agente por cima.
A fronteira é nítida: se o seu fluxo é coding em texto, vai de Qwen3 e leva os 3,1× de economia; se precisa de imagem, PDF, vídeo ou contexto longo, paga os US$ 2,50 da Nova e usa o que só ela entrega.
Coding agent em texto roda 3,1× mais barato no Qwen3 e ainda tem benchmark público; só vale pagar os US$ 2,50 da Nova se você precisa de multimodalidade, raciocínio encadeado ou contexto acima de 262 mil tokens.
Perguntas frequentes
Qwen3 Coder Next é de graça?
Não. Pela API, custa US$ 0,12 por milhão de tokens de entrada e US$ 0,80 por milhão de saída. O que é livre são os pesos: como o modelo é open-weight, você pode baixar e hospedar em infraestrutura própria, o que muda a conta dependendo do volume.
Quando a Amazon Nova 2 Lite vale pagar mais caro?
Quando o caso de uso exige multimodalidade (imagem, PDF ou vídeo na entrada), prompt acima de 262 mil tokens, ou traços de raciocínio encadeado sem montar agente por cima. Nessas três situações, nenhuma das capacidades está no Qwen3 Coder Next.
Qual dos dois é melhor para coding agent?
O Qwen3 Coder Next, com 36,23 no benchmark de coding da Artificial Analysis, contra dado não publicado pela Amazon para a Nova 2 Lite. A ausência de número da Nova nesse eixo, somada ao fato de o Qwen3 ter sido treinado especificamente para coding agents, fecha a questão.