FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Coder Plus cobra US$ 4,40 por milhão de saída — vale para o seu pipeline?

Versão proprietária da Alibaba para o coder open source chega três dias depois com contexto de 1M e preço que não é o menor da categoria.

Redação FalaVIP IA 3 min de leitura
US$ 4,40por milhão de tokens de saída (US$ 3,25 + ágio de ~35%)
US$ 0,65por milhão de tokens de entrada
US$ 0,13por milhão de tokens com cache de prompt

A conta que ninguém mostra no release

A Alibaba lançou o Qwen3 Coder Plus em 23 de setembro, três dias antes desta análise. O comunicado destaca a herança do Qwen3 Coder 480B A35B open source e o foco em agente autônomo de programação via tool calling. O que o comunicado não destaca é a aritmética: a versão proprietária cobra US$ 3,25 por milhão de tokens de saída, contra US$ 0,17 do gpt-oss-120b da OpenAI que aparece no topo do catálogo por inteligência. Em outras palavras, o Coder Plus custa cerca de 19 vezes mais por token gerado do que o modelo open weight da OpenAI sentado na segunda posição do ranking.

Traduzindo o marketing: o que ficou mais caro foi exatamente o que um agente de código consome — a saída. Entrada custa US$ 0,65 por milhão, número intermediário, e o cache de prompt sai por US$ 0,13, competitivo. Mas um agente que escreve, testa, corrige e reescreve código queima tokens de saída a cada iteração, e é aí que a fatura dispara.

Ficha técnica — Qwen3 Coder Plus
CampoValor
Identificadorqwen/qwen3-coder-plus
Criadorqwen
Preço de entradaUS$ 0.650 / M tokens
Preço de saídaUS$ 3.25 / M tokens
Janela de contexto1M
Modalidadetext->text
Leitura de cacheUS$ 0.130 / M (80% de desconto)

Onde o Coder Plus se encaixa no tabuleiro

O catálogo de hoje reúne 239 modelos de 40 criadores, e o topo por inteligência é ocupado por OpenAI o3 (IQ 31,096), gpt-oss-120b (IQ 24,126) e Qwen3 Next 80B A3B Thinking (IQ 16,867). O Qwen3 Coder Plus não tem índice de inteligência publicado no catálogo, e também não tem nota de coding, agentic ou blended — a Alibaba não disponibilizou essas medições. Sem número, não dá para dizer se ele bate o3 ou se perde para o próprio Qwen3 Next Thinking da casa. Quem está comparando precisa rodar benchmark próprio antes de colocar em produção.

O concorrente natural é o próprio ecossistema Qwen: o Qwen3 Next 80B A3B Thinking custa US$ 1,20 por milhão de saída, quase três vezes mais barato que o Coder Plus, e já tem IQ medido. Para tarefas de raciocínio sobre código, a conta pesa contra a versão Plus.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 239 modelos disponíveis no catálogo nesta data.

Para quem vale — e para quem não muda nada

Vale para você se: seu agente roda em pipelines curtos, com prompts bem cacheados e saídas pequenas; o cache a US$ 0,13 por milhão entra como vantagem real quando o mesmo contexto é reenviado a cada chamada. Vale também se você precisa do contexto de 1 milhão de tokens — é um dos maiores do catálogo — para despejar repositórios inteiros sem fragmentar.

Não vale se: você está migrando do gpt-oss-120b esperando pagar parecido. Não vale se o seu agente gasta muitos tokens por execução, porque a saída a US$ 3,25 por milhão corrói a economia do cache. E não vale se você já roda o Qwen3 Coder 480B A35B open source: a versão proprietária não traz dado público que justifique o ágio sobre o próprio irmão open weight.

O detalhe que decide a compra

A Alibaba não publicou país de origem, número de parâmetros, velocidade e knowledge cutoff além de 30 de junho de 2025. Para um modelo de código lançado em 23 de setembro, corte de conhecimento de quase três meses é aceitável, mas a ausência de benchmark próprio é o calcanhar de Aquiles. Você está pagando preço premium por um modelo cuja capacidade relativa ao restante do mercado ainda não foi medida de forma independente.

O que fazer com isso

Se o seu agente hoje roda em modelo open weight e você está olhando para o Coder Plus só pela marca Alibaba, espere. Se a sua dor é contexto de 1M tokens com cache barato, monte um teste A/B curto entre ele e o Qwen3 Next Thinking, meça tokens de saída por tarefa e multiplique pelo seu volume mensal. A diferença entre US$ 1,20 e US$ 3,25 por milhão aparece rápido na fatura — e é ela, não o release, que vai dizer se o Coder Plus entra ou fica de fora.

Em uma frase

Rode benchmark próprio antes de trocar seu coder atual: o Coder Plus ganha no contexto e no cache, mas perde feio no preço de saída, e a Alibaba não publicou IQ nem nota de coding para comparar.

Perguntas frequentes

Quanto custa o Qwen3 Coder Plus por token?

US$ 0,65 por milhão de tokens de entrada, US$ 3,25 por milhão de tokens de saída e US$ 0,13 por milhão com cache de prompt. O preço de saída é o mais salgado entre os modelos Qwen listados hoje.

O Qwen3 Coder Plus é melhor que o gpt-oss-120b?

Não há dado público de IQ, coding ou agentic para o Cwen3 Coder Plus no catálogo. O gpt-oss-120b tem IQ 24,126 medido e custa US$ 0,17 por milhão de saída, então a comparação de preço favorece a OpenAI até que a Alibaba publique benchmarks próprios.

Quando o cache de prompt compensa no Coder Plus?

Compensa quando o mesmo contexto é reenviado em várias chamadas do agente, porque o token cacheado sai por US$ 0,13 por milhão — quase cinco vezes mais barato que a entrada normal. Em pipelines de uma execução só, o cache não entra.

Leia também