Qwen3 Coder Next cobra 6× mais caro que gpt-oss-20b no token de saída
Dois modelos open weights com focos opostos: 75% a mais em coding para o chinês, um sexto do preço por milhão de tokens para o americano.
US$ 0,80 contra US$ 0,13 por milhão de tokens de saída. É o tamanho da diferença entre o Qwen3 Coder Next e o gpt-oss-20b na conta de API. Em coding, a vantagem do chinês é de 75%. Em volume, a economia do americano é brutal. Veja em qual cenário cada um ganha.
Os dois têm pesos abertos. Os dois usam arquitetura MoE. Lançaram com seis meses de distância: gpt-oss-20b em agosto de 2025, Qwen3 Coder Next em 4 de fevereiro, há nove dias. Ambos estão entre os mais de 334 modelos do catálogo de hoje. Mas servem a públicos diferentes.
O abismo em coding
O índice de inteligência geral do Qwen3 Coder Next é 21,3. O do gpt-oss-20b, 15,2. Em coding, a diferença explode: 36,2 contra 20,7. Em agentic — tarefas em que o modelo precisa orquestrar ferramentas, planejar etapas e reagir a erros — o Qwen3 marca 8,9, quase três vezes mais que os 3,1 do gpt-oss-20b.
Se você está montando um coding agent que vai ler repositório grande, chamar funções e corrigir o próprio código, esses números não são detalhe. O gpt-oss-20b chega como opção viável para geração local simples; o Qwen3 Coder Next chega como concorrente de modelos fechados em workflow agentic.
A conta que ninguém quer ver
O token de saída é onde mora a dor de cabeça. Qwen3 Coder Next cobra US$ 0,80 por milhão. gpt-oss-20b cobra US$ 0,13. No input, a diferença é menor: US$ 0,12 contra US$ 0,03 — quatro vezes mais barato o americano. O cache do gpt-oss-20b sai a US$ 0,03 por milhão; o do Qwen, a US$ 0,07.
Traduzindo para a prática: se o seu agente emite 50 milhões de tokens de saída por mês, o Qwen3 Coder Next cobra US$ 40. O gpt-oss-20b, US$ 6,50. Em volume, essa diferença paga a assinatura de outro serviço inteiro.
| Critério | Qwen3 Coder Next | gpt-oss-20b |
|---|---|---|
| Índice de inteligência | 21.3 | 15.2 |
| Entrada US$/M | 0.12 | 0.03 |
| Saída US$/M | 0.8 | 0.13 |
| Contexto | 262k | 131k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 130 | 113 |
| Índice de código | 36.2 | 20.7 |
| Índice agêntico | 8.9 | 3.1 |
Contexto, velocidade e um detalhe que pesa
O Qwen3 Coder Next tem 262 mil tokens de contexto — o dobro dos 131 mil do gpt-oss-20b. Em repositórios grandes ou em sessões longas de agente, isso significa menos truncamento e menos resumo intermediário. A velocidade de processamento também é maior: 129,5 tokens por segundo contra 112,6.
Um ponto que costuma passar batido: o gpt-oss-20b tem modo de raciocínio nativo. O Qwen3 Coder Next, não. Para problemas que pedem cadeia de pensamento explícita antes da resposta final, o modelo da OpenAI tem uma carta que o chinês não joga — pelo menos não nesta versão. Detalhe: o conhecimento do gpt-oss-20b está travado em junho de 2024; o do Qwen3 não foi divulgado.
Onde cada um se encaixa no mercado
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Coder Next | 21.3 | 0.8 |
O Qwen3 Coder Next entra no catálogo como quinto colocado em inteligência, logo abaixo do gpt-oss-120b da própria OpenAI (24,1). Os dois modelos do comparativo ficam abaixo do MiMo-V2-Flash da Xiaomi (34,0), do o3 da OpenAI (31,1) e do Claude Haiku 4.5 da Anthropic (29,9). Nenhum dos dois aparece na lista de mais baratos com IQ acima de 45 — essa faixa está vazia hoje.
O gpt-oss-20b segue competitivo em preço mesmo seis meses depois do lançamento. O Qwen3 Coder Next é novato, e os preços podem mudar conforme a Qwen ajusta a estratégia comercial. Por ora, a proposta de valor dele é qualidade em coding, não economia.
Quando cada um ganha
Se você precisa de um coding agent com leitura de contexto amplo, tolerância a chamadas de função em sequência e benchmark alto em agentic, o Qwen3 Coder Next é a escolha — e o custo maior é justificado pelo salto de capacidade. Use para devtools locais, automações internas e produtos onde qualidade de código é o diferencial.
Se o seu caso é volume alto, tarefas curtas, completions baratas, ou se você precisa de raciocínio nativo sem pipeline extra, o gpt-oss-20b entrega o suficiente por uma fração do preço. É o cavalo para processamento em massa onde cada centavo conta.
A escolha não é ideológica — é de quanto você paga pelo salto de 20 para 36 pontos de coding, ou de quanto você economiza aceitando 20 quando 36 não é necessário.
Coding agent com contexto longo e benchmark alto: escolha Qwen3 Coder Next e arque com US$ 0,80 por milhão de saída. Volume alto, tarefas curtas ou raciocínio nativo: gpt-oss-20b, a US$ 0,13, resolve.
Perguntas frequentes
Qwen3 Coder Next ou gpt-oss-20b: qual escolher para coding agent?
Para coding agent com orquestração de ferramentas e contexto longo, o Qwen3 Coder Next ganha: marca 36,2 em coding contra 20,7 do gpt-oss-20b e tem 262 mil tokens de contexto. Para volume alto com tarefas curtas, o gpt-oss-20b sai seis vezes mais barato no token de saída.
Qual a diferença de preço entre Qwen3 Coder Next e gpt-oss-20b?
O Qwen3 Coder Next cobra US$ 0,12 por milhão de tokens de entrada, US$ 0,80 de saída e US$ 0,07 em cache. O gpt-oss-20b cobra US$ 0,03 de entrada, US$ 0,13 de saída e US$ 0,03 em cache. A maior diferença está na saída: 6,15 vezes mais caro o Qwen3.
Os dois modelos têm pesos abertos?
Sim. O Qwen3 Coder Next é um MoE de 79,7 bilhões de parâmetros totais com 3 bilhões ativos por passagem. O gpt-oss-20b tem 21 bilhões totais e 3,6 bilhões ativos, sob licença Apache 2.0. Os dois rodam local.