FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Coder Next cobra 6× mais caro que gpt-oss-20b no token de saída

Dois modelos open weights com focos opostos: 75% a mais em coding para o chinês, um sexto do preço por milhão de tokens para o americano.

Redação FalaVIP IA 3 min de leitura
US$ 0,80 × US$ 0,13preço de saída por milhão de tokens (Qwen3 vs gpt-oss-20b)
36,2 × 20,7nota de coding (Qwen3 Coder Next vs gpt-oss-20b)
262 mil × 131 miljanela de contexto em tokens

US$ 0,80 contra US$ 0,13 por milhão de tokens de saída. É o tamanho da diferença entre o Qwen3 Coder Next e o gpt-oss-20b na conta de API. Em coding, a vantagem do chinês é de 75%. Em volume, a economia do americano é brutal. Veja em qual cenário cada um ganha.

Os dois têm pesos abertos. Os dois usam arquitetura MoE. Lançaram com seis meses de distância: gpt-oss-20b em agosto de 2025, Qwen3 Coder Next em 4 de fevereiro, há nove dias. Ambos estão entre os mais de 334 modelos do catálogo de hoje. Mas servem a públicos diferentes.

O abismo em coding

Índice de inteligência (Artificial Analysis)
Qwen3 Coder Next21,3gpt-oss-20b15,2índice
Fonte: Artificial Analysis

O índice de inteligência geral do Qwen3 Coder Next é 21,3. O do gpt-oss-20b, 15,2. Em coding, a diferença explode: 36,2 contra 20,7. Em agentic — tarefas em que o modelo precisa orquestrar ferramentas, planejar etapas e reagir a erros — o Qwen3 marca 8,9, quase três vezes mais que os 3,1 do gpt-oss-20b.

Se você está montando um coding agent que vai ler repositório grande, chamar funções e corrigir o próprio código, esses números não são detalhe. O gpt-oss-20b chega como opção viável para geração local simples; o Qwen3 Coder Next chega como concorrente de modelos fechados em workflow agentic.

A conta que ninguém quer ver

Preço de saída (US$ por milhão de tokens)
Qwen3 Coder Next0,8gpt-oss-20b0,13US$/M
Fonte: OpenRouter

O token de saída é onde mora a dor de cabeça. Qwen3 Coder Next cobra US$ 0,80 por milhão. gpt-oss-20b cobra US$ 0,13. No input, a diferença é menor: US$ 0,12 contra US$ 0,03 — quatro vezes mais barato o americano. O cache do gpt-oss-20b sai a US$ 0,03 por milhão; o do Qwen, a US$ 0,07.

Traduzindo para a prática: se o seu agente emite 50 milhões de tokens de saída por mês, o Qwen3 Coder Next cobra US$ 40. O gpt-oss-20b, US$ 6,50. Em volume, essa diferença paga a assinatura de outro serviço inteiro.

Qwen3 Coder Next × gpt-oss-20b
CritérioQwen3 Coder Nextgpt-oss-20b
Índice de inteligência21.315.2
Entrada US$/M0.120.03
Saída US$/M0.80.13
Contexto262k131k
Pesos abertossimsim
Velocidade (tok/s)130113
Índice de código36.220.7
Índice agêntico8.93.1

Contexto, velocidade e um detalhe que pesa

O Qwen3 Coder Next tem 262 mil tokens de contexto — o dobro dos 131 mil do gpt-oss-20b. Em repositórios grandes ou em sessões longas de agente, isso significa menos truncamento e menos resumo intermediário. A velocidade de processamento também é maior: 129,5 tokens por segundo contra 112,6.

Um ponto que costuma passar batido: o gpt-oss-20b tem modo de raciocínio nativo. O Qwen3 Coder Next, não. Para problemas que pedem cadeia de pensamento explícita antes da resposta final, o modelo da OpenAI tem uma carta que o chinês não joga — pelo menos não nesta versão. Detalhe: o conhecimento do gpt-oss-20b está travado em junho de 2024; o do Qwen3 não foi divulgado.

Onde cada um se encaixa no mercado

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 334 modelos disponíveis no catálogo nesta data.

O Qwen3 Coder Next entra no catálogo como quinto colocado em inteligência, logo abaixo do gpt-oss-120b da própria OpenAI (24,1). Os dois modelos do comparativo ficam abaixo do MiMo-V2-Flash da Xiaomi (34,0), do o3 da OpenAI (31,1) e do Claude Haiku 4.5 da Anthropic (29,9). Nenhum dos dois aparece na lista de mais baratos com IQ acima de 45 — essa faixa está vazia hoje.

O gpt-oss-20b segue competitivo em preço mesmo seis meses depois do lançamento. O Qwen3 Coder Next é novato, e os preços podem mudar conforme a Qwen ajusta a estratégia comercial. Por ora, a proposta de valor dele é qualidade em coding, não economia.

Quando cada um ganha

Se você precisa de um coding agent com leitura de contexto amplo, tolerância a chamadas de função em sequência e benchmark alto em agentic, o Qwen3 Coder Next é a escolha — e o custo maior é justificado pelo salto de capacidade. Use para devtools locais, automações internas e produtos onde qualidade de código é o diferencial.

Se o seu caso é volume alto, tarefas curtas, completions baratas, ou se você precisa de raciocínio nativo sem pipeline extra, o gpt-oss-20b entrega o suficiente por uma fração do preço. É o cavalo para processamento em massa onde cada centavo conta.

A escolha não é ideológica — é de quanto você paga pelo salto de 20 para 36 pontos de coding, ou de quanto você economiza aceitando 20 quando 36 não é necessário.

Em uma frase

Coding agent com contexto longo e benchmark alto: escolha Qwen3 Coder Next e arque com US$ 0,80 por milhão de saída. Volume alto, tarefas curtas ou raciocínio nativo: gpt-oss-20b, a US$ 0,13, resolve.

Perguntas frequentes

Qwen3 Coder Next ou gpt-oss-20b: qual escolher para coding agent?

Para coding agent com orquestração de ferramentas e contexto longo, o Qwen3 Coder Next ganha: marca 36,2 em coding contra 20,7 do gpt-oss-20b e tem 262 mil tokens de contexto. Para volume alto com tarefas curtas, o gpt-oss-20b sai seis vezes mais barato no token de saída.

Qual a diferença de preço entre Qwen3 Coder Next e gpt-oss-20b?

O Qwen3 Coder Next cobra US$ 0,12 por milhão de tokens de entrada, US$ 0,80 de saída e US$ 0,07 em cache. O gpt-oss-20b cobra US$ 0,03 de entrada, US$ 0,13 de saída e US$ 0,03 em cache. A maior diferença está na saída: 6,15 vezes mais caro o Qwen3.

Os dois modelos têm pesos abertos?

Sim. O Qwen3 Coder Next é um MoE de 79,7 bilhões de parâmetros totais com 3 bilhões ativos por passagem. O gpt-oss-20b tem 21 bilhões totais e 3,6 bilhões ativos, sob licença Apache 2.0. Os dois rodam local.

Leia também