Qwen3 Coder Next custa US$ 0,80 e bate Maverick em código
Modelo chinês de 3B ativos por token supera o multimodal da Meta em coding e agentic, com metade do preço de saída.
O preço não mente, mas esconde o resto
Você viu o lançamento do Qwen3 Coder Next, olhou o preço de US$ 0,80 por milhão de tokens de saída e pensou: "mais um modelo chinês barato". A conta, porém, não conta a história inteira. Em coding, o índice da Artificial Analysis marca 36,23 para o Qwen3 Coder Next e apenas 16,28 para o Llama 4 Maverick — mais que o dobro de vantagem em uma categoria onde o modelo da Meta foi, por meses, a referência de multimodal aberto.
A diferença não é de margem. É de categoria.
O que cada um entrega de verdade
O Qwen3 Coder Next é um MoE aberto com 79,7B de parâmetros totais mas só 3B ativos por token. É a mesma estratégia do MiMo-V2-Flash da Xiaomi, que lidera o ranking de inteligência hoje com 34,02 de IQ. Pense num restaurante com 80 chefs no quadro: cada pedido vai direto para os 3 que sabem fazer aquele prato. Você paga a estrutura inteira, mas só consome a fração que importa.
O Llama 4 Maverick é multimodal — aceita imagem, não só texto — e roda com 17B ativos de um total de 402B. É maior, mais versátil, e foi lançado em abril de 2025 com corte de conhecimento em agosto de 2024. Hoje, dez meses depois, o catálogo mostra onde isso pesa: coding 16,28, agentic 1,24, IQ 14,48. O Qwen3 Coder Next, lançado em 4 de fevereiro de 2026, marca agentic 8,86 — sete vezes mais.
| Critério | Qwen3 Coder Next | Llama 4 Maverick |
|---|---|---|
| Índice de inteligência | 21.3 | 14.5 |
| Entrada US$/M | 0.12 | 0.2 |
| Saída US$/M | 0.8 | 0.696 |
| Contexto | 262k | 1.05M |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 130 | 86 |
| Índice de código | 36.2 | 16.3 |
| Índice agêntico | 8.9 | 1.2 |
A conta que você paga de verdade
O preço de saída do Qwen3 é US$ 0,80 por milhão de tokens. O do Maverick é US$ 0,696. Parece que o Meta ganha. Mas o cache de leitura do Qwen sai por US$ 0,07 — o da Meta não está publicado no catálogo. Em workloads de coding agent, onde o mesmo trecho de código é relido dezenas de vezes enquanto o agente itera, esse campo muda tudo. Multiplique por um pipeline que consome 50 milhões de tokens de cache por mês: a diferença deixa de ser centavos.
E tem mais: o contexto do Qwen é 262k tokens. O do Maverick é 1M. Aqui o Meta vence de lavada — e é a única categoria onde isso acontece de forma clara.
Onde cada um ganha — e onde nenhum dos dois serve
Qwen3 Coder Next ganha quando: você está montando um agente de código, um copilot que precisa iterar em arquivos longos, ou qualquer fluxo onde agentic > 8 e coding > 30 importam mais que visão. O preço de saída é 15% mais caro, mas a entrega por dólar é outra escala.
Llama 4 Maverick ganha quando: você precisa processar imagem junto com texto — screenshots, UI mockups, diagramas — e quer um modelo aberto americano com janela de 1M tokens. Para chat geral e RAG com PDFs cheios de figura, ele ainda tem serventia.
Nenhum dos dois serve quando: você quer o topo absoluto de inteligência. O ranking de hoje tem Xiaomi MiMo-V2-Flash em 34,02, OpenAI o3 em 31,10 e Claude Haiku 4.5 em 29,89 — todos acima dos dois. O Qwen3 Coder Next aparece em quinto com 21,29 de IQ, mas em coding está acima de qualquer modelo de chat geral nessa faixa.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Coder Next | 21.3 | 0.8 |
O que muda no seu pipeline
Se você está pagando API para rodar agentes de código hoje, a pergunta não é "Qwen ou Meta". A pergunta é: por que você está pagando 8 dólares por milhão em um modelo topo de gama quando existe um open weights de 0,80 que entrega mais que o dobro de coding score? O Qwen3 Coder Next não é o melhor modelo do mercado — é o melhor modelo para essa tarefa específica, e essa diferença paga a sua fatura do fim do mês.
Para visão e contexto longo, o Maverick continua na jogada. Mas a era de pagar caro por modelo generalista americano para fazer trabalho de coding specialist chinês acabou.
Para agentes de código, troque Llama 4 Maverick pelo Qwen3 Coder Next e ganhe 2x em coding por praticamente o mesmo preço; só não troque se você depende de entrada de imagem ou de janela de 1M tokens.
Perguntas frequentes
Qwen3 Coder Next é melhor que Llama 4 Maverick para programar?
Sim, em métricas de coding (36,23 contra 16,28) e agentic (8,86 contra 1,24). O Maverick só leva vantagem em multimodalidade (aceita imagem) e em janela de contexto (1M contra 262k tokens).
Quanto custa cada modelo por milhão de tokens?
Qwen3 Coder Next cobra US$ 0,12 de entrada, US$ 0,80 de saída e US$ 0,07 de cache. Llama 4 Maverick cobra US$ 0,20 de entrada e US$ 0,696 de saída — o preço de cache não está publicado no catálogo.
Os dois modelos são open weights?
Sim. Ambos têm pesos abertos: o Qwen3 Coder Next é um MoE de 79,7B totais com 3B ativos, e o Llama 4 Maverick é um MoE de 402B totais com 17B ativos. Os dois podem ser baixados e rodados localmente em hardware compatível.