FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Coder Plus custa 25 vezes mais que o gpt-oss-20b sem benchmark

Versão proprietária do modelo aberto da própria Qwen cobra US$ 3,25 por milhão de tokens de saída e entra no catálogo sem nota de inteligência, coding ou agentic

Redação FalaVIP IA 3 min de leitura
US$ 3,25por milhão de tokens de saída
US$ 0,65por milhão de tokens de entrada
1.000.000tokens de contexto

Três dias depois do lançamento, o Qwen3 Coder Plus continua sendo um dos modelos mais caros do catálogo por milhão de tokens de saída, e o catálogo ainda não publicou nota de inteligência, coding ou agentic para ele. Pagar US$ 3,25 por milhão de tokens sem ter como comparar com a alternativa mais barata é um problema real para quem decide com base em planilha.

O que o release diz — e o que não diz

A Qwen apresenta o modelo como uma versão proprietária do Qwen3 Coder 480B A35B open source, especializado em programação autônoma via tool calling. Traduzindo do marketing: é o primo pago do modelo aberto da própria Qwen, ajustado para operar como agente — receber instruções longas, chamar ferramentas externas, devolver código executável. O contexto de 1 milhão de tokens é competitivo para tarefas que precisam de repositórios inteiros na janela, e o corte de conhecimento em junho de 2025 é razoável para um modelo de coding.

Mas o que o catálogo não diz é, em boa medida, mais relevante que o que diz. Não há nota de inteligência publicada. Não há nota de coding. Não há nota agentic. Não há velocidade. Não há país de origem, não há contagem de parâmetros. Para um modelo que entrou no mercado há 72 horas cobrando 25 vezes mais que o gpt-oss-20b, a ausência de qualquer métrica de comparação é mais do que um detalhe: é a decisão de compra inteira.

O preço no tabuleiro

Coloque lado a lado o que está no topo da lista de inteligência hoje e onde o Qwen3 Coder Plus entra:

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 239 modelos disponíveis no catálogo nesta data.

O o3 lidera o ranking de IQ com 31,096 e custa US$ 8 por milhão de saída. O gpt-oss-120b, segunda posição, sai por US$ 0,17. O Qwen3 Next 80B A3B Thinking, terceiro, US$ 1,2. O gpt-oss-20b, US$ 0,13. O Llama 4 Maverick, US$ 0,696. O Coder Plus entra nesse seleto grupo acima de US$ 3 por milhão — mas, diferentemente dos outros quatro, sem nenhuma nota que sustente o prêmio.

E há uma assimetria incômoda: o modelo aberto que ele emula, o Qwen3 Coder 480B A35B, é do mesmo criador. Você não está comparando um desconhecido contra um conhecido — está comparando duas linhas do mesmo fornecedor, em que a versão fechada custa 25 vezes mais que o gpt-oss-20b e desconhecidamente mais que o próprio irmão open weights.

O que está faltando para decidir

Ficha técnica — Qwen3 Coder Plus
CampoValor
Identificadorqwen/qwen3-coder-plus
Criadorqwen
Preço de entradaUS$ 0.650 / M tokens
Preço de saídaUS$ 3.25 / M tokens
Janela de contexto1M
Modalidadetext->text
Leitura de cacheUS$ 0.130 / M (80% de desconto)

A lacuna não parece acidental. O catálogo tem mais de 239 modelos hoje, distribuídos por 40 criadores, e 21 deles foram lançados nos últimos 30 dias. Há precedente e espaço para incluir benchmarks de coding e agentic — o catálogo faz isso com outros modelos do topo da lista. A escolha de não publicar para o Coder Plus deixa você com duas opções: confiar no release, ou medir você mesmo. Para uma assinatura mensal relevante, a primeira opção sai cara.

Para quem faz sentido — e para quem não muda nada

Vale olhar de perto se você já roda a stack Alibaba em produção, precisa especificamente de tool calling em contexto longo de 1M tokens, ou está conduzindo uma avaliação interna de coding agents. O modelo pode entregar o que promete — só não dá para confirmar a partir de dados públicos.

Não muda nada para a maioria. Se o caso de uso é completar código, revisar funções ou gerar testes, o gpt-oss-20b a US$ 0,13 por milhão cumpre sem o mesmo gasto. Se a tarefa é raciocínio forte sobre problemas abertos, o o3 está lá em cima e tem nota. Se o caso é coding agent e você não está casado com o ecossistema Qwen, o Llama 4 Maverick segue como a referência aberta mais barata com benchmarks públicos.

O que você faz com isso amanhã

Não assine antes de medir. Se for testar, rode o mesmo conjunto de tarefas no Qwen3 Coder 480B A35B open weights e no Coder Plus. A diferença de preço só se justifica se o ajuste proprietário entregar ganho mensurável em tool calling — não em qualidade geral de código, que é onde modelos mais baratos já competem de igual para igual. Se o ganho for de 5% e o custo 25x, a conta não fecha. Se for de 50% em tarefas agentic específicas, talvez. A resposta está no seu caso de uso, não no release.

Em uma frase

Só assine o Qwen3 Coder Plus depois de medir contra o próprio Qwen3 Coder 480B A35B open weights — sem benchmark público, a diferença de 25x sobre o gpt-oss-20b não se justifica por default.

Perguntas frequentes

Quanto custa o Qwen3 Coder Plus?

Cobra US$ 0,65 por milhão de tokens de entrada, US$ 3,25 por milhão de tokens de saída e US$ 0,13 por milhão de tokens em cache. É um dos modelos mais caros do catálogo por token gerado.

Qwen3 Coder Plus serve para quê?

É focado em coding agent via tool calling, ou seja, programação autônoma em que o modelo chama ferramentas externas. O contexto de 1 milhão de tokens permite operar com repositórios inteiros na janela.

Dá para comparar o Qwen3 Coder Plus com o o3 ou o gpt-oss-120b?

Não a partir de dados públicos. O catálogo não publicou nota de inteligência, coding ou agentic para o Qwen3 Coder Plus, então qualquer comparação hoje depende de teste próprio do seu lado.

Leia também