FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Coder Next custa US$ 0,80 e bate Maverick em código

Modelo chinês de 3B ativos por token supera o multimodal da Meta em coding e agentic, com metade do preço de saída.

Redação FalaVIP IA 3 min de leitura
US$ 0,80por milhão de tokens de saída (Qwen3 Coder Next)
US$ 0,696por milhão de tokens de saída (Llama 4 Maverick)
36,23 vs 16,28nota de coding (Qwen3 Coder Next × Llama 4 Maverick)

O preço não mente, mas esconde o resto

Você viu o lançamento do Qwen3 Coder Next, olhou o preço de US$ 0,80 por milhão de tokens de saída e pensou: "mais um modelo chinês barato". A conta, porém, não conta a história inteira. Em coding, o índice da Artificial Analysis marca 36,23 para o Qwen3 Coder Next e apenas 16,28 para o Llama 4 Maverick — mais que o dobro de vantagem em uma categoria onde o modelo da Meta foi, por meses, a referência de multimodal aberto.

Índice de inteligência (Artificial Analysis)
Qwen3 Coder Next21,3Llama 4 Maverick14,5índice
Fonte: Artificial Analysis

A diferença não é de margem. É de categoria.

O que cada um entrega de verdade

O Qwen3 Coder Next é um MoE aberto com 79,7B de parâmetros totais mas só 3B ativos por token. É a mesma estratégia do MiMo-V2-Flash da Xiaomi, que lidera o ranking de inteligência hoje com 34,02 de IQ. Pense num restaurante com 80 chefs no quadro: cada pedido vai direto para os 3 que sabem fazer aquele prato. Você paga a estrutura inteira, mas só consome a fração que importa.

O Llama 4 Maverick é multimodal — aceita imagem, não só texto — e roda com 17B ativos de um total de 402B. É maior, mais versátil, e foi lançado em abril de 2025 com corte de conhecimento em agosto de 2024. Hoje, dez meses depois, o catálogo mostra onde isso pesa: coding 16,28, agentic 1,24, IQ 14,48. O Qwen3 Coder Next, lançado em 4 de fevereiro de 2026, marca agentic 8,86 — sete vezes mais.

Qwen3 Coder Next × Llama 4 Maverick
CritérioQwen3 Coder NextLlama 4 Maverick
Índice de inteligência21.314.5
Entrada US$/M0.120.2
Saída US$/M0.80.696
Contexto262k1.05M
Pesos abertossimsim
Velocidade (tok/s)13086
Índice de código36.216.3
Índice agêntico8.91.2

A conta que você paga de verdade

O preço de saída do Qwen3 é US$ 0,80 por milhão de tokens. O do Maverick é US$ 0,696. Parece que o Meta ganha. Mas o cache de leitura do Qwen sai por US$ 0,07 — o da Meta não está publicado no catálogo. Em workloads de coding agent, onde o mesmo trecho de código é relido dezenas de vezes enquanto o agente itera, esse campo muda tudo. Multiplique por um pipeline que consome 50 milhões de tokens de cache por mês: a diferença deixa de ser centavos.

Preço de saída (US$ por milhão de tokens)
Qwen3 Coder Next0,8Llama 4 Maverick0,696US$/M
Fonte: OpenRouter

E tem mais: o contexto do Qwen é 262k tokens. O do Maverick é 1M. Aqui o Meta vence de lavada — e é a única categoria onde isso acontece de forma clara.

Onde cada um ganha — e onde nenhum dos dois serve

Qwen3 Coder Next ganha quando: você está montando um agente de código, um copilot que precisa iterar em arquivos longos, ou qualquer fluxo onde agentic > 8 e coding > 30 importam mais que visão. O preço de saída é 15% mais caro, mas a entrega por dólar é outra escala.

Llama 4 Maverick ganha quando: você precisa processar imagem junto com texto — screenshots, UI mockups, diagramas — e quer um modelo aberto americano com janela de 1M tokens. Para chat geral e RAG com PDFs cheios de figura, ele ainda tem serventia.

Nenhum dos dois serve quando: você quer o topo absoluto de inteligência. O ranking de hoje tem Xiaomi MiMo-V2-Flash em 34,02, OpenAI o3 em 31,10 e Claude Haiku 4.5 em 29,89 — todos acima dos dois. O Qwen3 Coder Next aparece em quinto com 21,29 de IQ, mas em coding está acima de qualquer modelo de chat geral nessa faixa.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 334 modelos disponíveis no catálogo nesta data.

O que muda no seu pipeline

Se você está pagando API para rodar agentes de código hoje, a pergunta não é "Qwen ou Meta". A pergunta é: por que você está pagando 8 dólares por milhão em um modelo topo de gama quando existe um open weights de 0,80 que entrega mais que o dobro de coding score? O Qwen3 Coder Next não é o melhor modelo do mercado — é o melhor modelo para essa tarefa específica, e essa diferença paga a sua fatura do fim do mês.

Para visão e contexto longo, o Maverick continua na jogada. Mas a era de pagar caro por modelo generalista americano para fazer trabalho de coding specialist chinês acabou.

Em uma frase

Para agentes de código, troque Llama 4 Maverick pelo Qwen3 Coder Next e ganhe 2x em coding por praticamente o mesmo preço; só não troque se você depende de entrada de imagem ou de janela de 1M tokens.

Perguntas frequentes

Qwen3 Coder Next é melhor que Llama 4 Maverick para programar?

Sim, em métricas de coding (36,23 contra 16,28) e agentic (8,86 contra 1,24). O Maverick só leva vantagem em multimodalidade (aceita imagem) e em janela de contexto (1M contra 262k tokens).

Quanto custa cada modelo por milhão de tokens?

Qwen3 Coder Next cobra US$ 0,12 de entrada, US$ 0,80 de saída e US$ 0,07 de cache. Llama 4 Maverick cobra US$ 0,20 de entrada e US$ 0,696 de saída — o preço de cache não está publicado no catálogo.

Os dois modelos são open weights?

Sim. Ambos têm pesos abertos: o Qwen3 Coder Next é um MoE de 79,7B totais com 3B ativos, e o Llama 4 Maverick é um MoE de 402B totais com 17B ativos. Os dois podem ser baixados e rodados localmente em hardware compatível.

Leia também