Qwen3 Next 80B cobra 9 vezes mais saída que gpt-oss-20b
Comparativo frente a frente mostra qual dos dois modelos de código aberto vale o que custa — e em qual cenário cada um leva a melhor.
O que o release não fala: a diferença de 9x
A conta chega antes da resposta. O Qwen3 Next 80B A3B Thinking foi anunciado em 11 de setembro de 2025 e o gpt-oss-20b chegou em 5 de agosto. Os dois são modelos de raciocínio, os dois são open weights, os dois têm MoE com poucos parâmetros ativos por passagem (3B no Qwen, 3,6B no OpenAI). Em superfície parecem o mesmo produto. Não são.
Quando você compara o que custa cada token gerado, a distância explode. US$ 1,20 por milhão de tokens de saída no Qwen3 Next 80B contra US$ 0,13 no gpt-oss-20b — quase nove vezes de diferença. O preço de entrada é mais suave: US$ 0,15 contra US$ 0,03, cinco vezes. Para a maioria das aplicações reais, em que o sistema gera muito mais do que consome, a saída dita a conta no fim do mês.
Inteligência e codificação: quem ganha em quê
No índice geral de inteligência medido hoje, o Qwen3 Next 80B está à frente: 16,867 contra 15,225 do gpt-oss-20b. Olhando para a régua completa do mercado, o chinês entra no top 3 do catálogo.
Mas e codificação? Aí a história inverte. O gpt-oss-20b marca 20,697 em codificação, contra 17,419 do Qwen. Para um agente que vai iterar muito, gerar e corrigir trechos, o modelo mais barato da OpenAI entrega mais por token. Em agentic, a diferença é menor mas favorável ao gpt-oss-20b (3,103 contra 2,062).
| Critério | Qwen3 Next 80B A3B Thinking | gpt-oss-20b |
|---|---|---|
| Índice de inteligência | 16.9 | 15.2 |
| Entrada US$/M | 0.15 | 0.03 |
| Saída US$/M | 1.2 | 0.13 |
| Contexto | 262k | 131k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 197 | 113 |
| Índice de código | 17.4 | 20.7 |
| Índice agêntico | 2.1 | 3.1 |
Velocidade, contexto e o detalhe que muda tudo
O Qwen3 Next 80B roda a 196,94 tokens por segundo, quase o dobro dos 112,6 do gpt-oss-20b. Janela de contexto também é maior: 262 mil contra 131 mil tokens. Em tarefas longas, com livros de código inteiros dentro do prompt, isso pesa.
Mas existe um sinal que ninguém comenta. A nota de omniscience do gpt-oss-20b é -63,05; a do Qwen3 Next 80B é -51,417. Quanto mais perto de zero, menos o modelo "alucina" fatos. A vantagem chinesa aqui é clara, e o knowledge cutoff ajuda a explicar: o Qwen vai até 30 de setembro de 2025, enquanto o gpt-oss-20b corta em junho de 2024 — mais de um ano de diferença em eventos e APIs recentes.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Quando cada um vale o que cobra
Para quem quer rodar raciocínio pesado, agentes longos, prompts de centenas de milhares de tokens e não pode estourar orçamento em servidores próprios, o Qwen3 Next 80B é o mais inteligente do catálogo aberto hoje, com velocidade superior e janela quase dobrada. Paga-se caro na fatura, mas economiza-se em chamadas de API concorrentes — a conta pode fechar.
Para quem está prototipando, gerando trechos de código, depurando funções ou embarcando o modelo em um pipeline que consome muitos tokens por minuto, o gpt-oss-20b entrega mais por real. Codificação melhor, agentic melhor, preço por token de saída quase nove vezes menor. Em setembro de 2025 ele é a escolha racional para o desenvolvedor sozinho ou startup queimando caixa.
E aí está a régua concreta: chinês caro-rápido-inteligente para os casos em que a janela de contexto e a atualidade do conhecimento justificam o gasto; americano barato-eficiente-codificador para o resto.
Use o Qwen3 Next 80B quando a janela de contexto ou o raciocínio profundo mandam na conta; use o gpt-oss-20b quando cada centavo por token de saída e a qualidade de código decidem o orçamento.
Perguntas frequentes
Qwen3 Next 80B ou gpt-oss-20b: qual é mais barato por token?
O gpt-oss-20b é mais barato em todas as métricas: US$ 0,03 por milhão de tokens de entrada e US$ 0,13 de saída, contra US$ 0,15 e US$ 1,20 do Qwen3 Next 80B. Em custo de saída, a diferença é de cerca de nove vezes.
Qual dos dois é melhor para programação?
O gpt-oss-20b leva a melhor em codificação, com nota 20,697 contra 17,419 do Qwen3 Next 80B. Em tarefas agentic também fica à frente (3,103 contra 2,062).
Os dois modelos são open weights?
Sim. O Qwen3 Next 80B A3B Thinking foi lançado com pesos abertos em 11 de setembro de 2025, e o gpt-oss-20b foi liberado pela OpenAI em agosto sob licença Apache 2.0, ambos com arquitetura MoE.