Qwen3 Coder Plus cobra US$ 4,40 por milhão de saída — vale para o seu pipeline?
Versão proprietária da Alibaba para o coder open source chega três dias depois com contexto de 1M e preço que não é o menor da categoria.
A conta que ninguém mostra no release
A Alibaba lançou o Qwen3 Coder Plus em 23 de setembro, três dias antes desta análise. O comunicado destaca a herança do Qwen3 Coder 480B A35B open source e o foco em agente autônomo de programação via tool calling. O que o comunicado não destaca é a aritmética: a versão proprietária cobra US$ 3,25 por milhão de tokens de saída, contra US$ 0,17 do gpt-oss-120b da OpenAI que aparece no topo do catálogo por inteligência. Em outras palavras, o Coder Plus custa cerca de 19 vezes mais por token gerado do que o modelo open weight da OpenAI sentado na segunda posição do ranking.
Traduzindo o marketing: o que ficou mais caro foi exatamente o que um agente de código consome — a saída. Entrada custa US$ 0,65 por milhão, número intermediário, e o cache de prompt sai por US$ 0,13, competitivo. Mas um agente que escreve, testa, corrige e reescreve código queima tokens de saída a cada iteração, e é aí que a fatura dispara.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3-coder-plus |
| Criador | qwen |
| Preço de entrada | US$ 0.650 / M tokens |
| Preço de saída | US$ 3.25 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text->text |
| Leitura de cache | US$ 0.130 / M (80% de desconto) |
Onde o Coder Plus se encaixa no tabuleiro
O catálogo de hoje reúne 239 modelos de 40 criadores, e o topo por inteligência é ocupado por OpenAI o3 (IQ 31,096), gpt-oss-120b (IQ 24,126) e Qwen3 Next 80B A3B Thinking (IQ 16,867). O Qwen3 Coder Plus não tem índice de inteligência publicado no catálogo, e também não tem nota de coding, agentic ou blended — a Alibaba não disponibilizou essas medições. Sem número, não dá para dizer se ele bate o3 ou se perde para o próprio Qwen3 Next Thinking da casa. Quem está comparando precisa rodar benchmark próprio antes de colocar em produção.
O concorrente natural é o próprio ecossistema Qwen: o Qwen3 Next 80B A3B Thinking custa US$ 1,20 por milhão de saída, quase três vezes mais barato que o Coder Plus, e já tem IQ medido. Para tarefas de raciocínio sobre código, a conta pesa contra a versão Plus.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Para quem vale — e para quem não muda nada
Vale para você se: seu agente roda em pipelines curtos, com prompts bem cacheados e saídas pequenas; o cache a US$ 0,13 por milhão entra como vantagem real quando o mesmo contexto é reenviado a cada chamada. Vale também se você precisa do contexto de 1 milhão de tokens — é um dos maiores do catálogo — para despejar repositórios inteiros sem fragmentar.
Não vale se: você está migrando do gpt-oss-120b esperando pagar parecido. Não vale se o seu agente gasta muitos tokens por execução, porque a saída a US$ 3,25 por milhão corrói a economia do cache. E não vale se você já roda o Qwen3 Coder 480B A35B open source: a versão proprietária não traz dado público que justifique o ágio sobre o próprio irmão open weight.
O detalhe que decide a compra
A Alibaba não publicou país de origem, número de parâmetros, velocidade e knowledge cutoff além de 30 de junho de 2025. Para um modelo de código lançado em 23 de setembro, corte de conhecimento de quase três meses é aceitável, mas a ausência de benchmark próprio é o calcanhar de Aquiles. Você está pagando preço premium por um modelo cuja capacidade relativa ao restante do mercado ainda não foi medida de forma independente.
O que fazer com isso
Se o seu agente hoje roda em modelo open weight e você está olhando para o Coder Plus só pela marca Alibaba, espere. Se a sua dor é contexto de 1M tokens com cache barato, monte um teste A/B curto entre ele e o Qwen3 Next Thinking, meça tokens de saída por tarefa e multiplique pelo seu volume mensal. A diferença entre US$ 1,20 e US$ 3,25 por milhão aparece rápido na fatura — e é ela, não o release, que vai dizer se o Coder Plus entra ou fica de fora.
Rode benchmark próprio antes de trocar seu coder atual: o Coder Plus ganha no contexto e no cache, mas perde feio no preço de saída, e a Alibaba não publicou IQ nem nota de coding para comparar.
Perguntas frequentes
Quanto custa o Qwen3 Coder Plus por token?
US$ 0,65 por milhão de tokens de entrada, US$ 3,25 por milhão de tokens de saída e US$ 0,13 por milhão com cache de prompt. O preço de saída é o mais salgado entre os modelos Qwen listados hoje.
O Qwen3 Coder Plus é melhor que o gpt-oss-120b?
Não há dado público de IQ, coding ou agentic para o Cwen3 Coder Plus no catálogo. O gpt-oss-120b tem IQ 24,126 medido e custa US$ 0,17 por milhão de saída, então a comparação de preço favorece a OpenAI até que a Alibaba publique benchmarks próprios.
Quando o cache de prompt compensa no Coder Plus?
Compensa quando o mesmo contexto é reenviado em várias chamadas do agente, porque o token cacheado sai por US$ 0,13 por milhão — quase cinco vezes mais barato que a entrada normal. Em pipelines de uma execução só, o cache não entra.