FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3 Next 80B cobra 9 vezes mais saída que gpt-oss-20b

Comparativo frente a frente mostra qual dos dois modelos de código aberto vale o que custa — e em qual cenário cada um leva a melhor.

Redação FalaVIP IA 2 min de leitura
US$ 1,20preço de saída por milhão de tokens do Qwen3 Next 80B
US$ 0,13preço de saída por milhão de tokens do gpt-oss-20b
17,419nota de codificação do gpt-oss-20b vs 17,419 do Qwen3

O que o release não fala: a diferença de 9x

A conta chega antes da resposta. O Qwen3 Next 80B A3B Thinking foi anunciado em 11 de setembro de 2025 e o gpt-oss-20b chegou em 5 de agosto. Os dois são modelos de raciocínio, os dois são open weights, os dois têm MoE com poucos parâmetros ativos por passagem (3B no Qwen, 3,6B no OpenAI). Em superfície parecem o mesmo produto. Não são.

Quando você compara o que custa cada token gerado, a distância explode. US$ 1,20 por milhão de tokens de saída no Qwen3 Next 80B contra US$ 0,13 no gpt-oss-20b — quase nove vezes de diferença. O preço de entrada é mais suave: US$ 0,15 contra US$ 0,03, cinco vezes. Para a maioria das aplicações reais, em que o sistema gera muito mais do que consome, a saída dita a conta no fim do mês.

Preço de saída (US$ por milhão de tokens)
Qwen3 Next 80B A3B Thinking1,2gpt-oss-20b0,13US$/M
Fonte: OpenRouter

Inteligência e codificação: quem ganha em quê

No índice geral de inteligência medido hoje, o Qwen3 Next 80B está à frente: 16,867 contra 15,225 do gpt-oss-20b. Olhando para a régua completa do mercado, o chinês entra no top 3 do catálogo.

Índice de inteligência (Artificial Analysis)
Qwen3 Next 80B A3B Thinking16,9gpt-oss-20b15,2índice
Fonte: Artificial Analysis

Mas e codificação? Aí a história inverte. O gpt-oss-20b marca 20,697 em codificação, contra 17,419 do Qwen. Para um agente que vai iterar muito, gerar e corrigir trechos, o modelo mais barato da OpenAI entrega mais por token. Em agentic, a diferença é menor mas favorável ao gpt-oss-20b (3,103 contra 2,062).

Qwen3 Next 80B A3B Thinking × gpt-oss-20b
CritérioQwen3 Next 80B A3B Thinkinggpt-oss-20b
Índice de inteligência16.915.2
Entrada US$/M0.150.03
Saída US$/M1.20.13
Contexto262k131k
Pesos abertossimsim
Velocidade (tok/s)197113
Índice de código17.420.7
Índice agêntico2.13.1

Velocidade, contexto e o detalhe que muda tudo

O Qwen3 Next 80B roda a 196,94 tokens por segundo, quase o dobro dos 112,6 do gpt-oss-20b. Janela de contexto também é maior: 262 mil contra 131 mil tokens. Em tarefas longas, com livros de código inteiros dentro do prompt, isso pesa.

Mas existe um sinal que ninguém comenta. A nota de omniscience do gpt-oss-20b é -63,05; a do Qwen3 Next 80B é -51,417. Quanto mais perto de zero, menos o modelo "alucina" fatos. A vantagem chinesa aqui é clara, e o knowledge cutoff ajuda a explicar: o Qwen vai até 30 de setembro de 2025, enquanto o gpt-oss-20b corta em junho de 2024 — mais de um ano de diferença em eventos e APIs recentes.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 227 modelos disponíveis no catálogo nesta data.

Quando cada um vale o que cobra

Para quem quer rodar raciocínio pesado, agentes longos, prompts de centenas de milhares de tokens e não pode estourar orçamento em servidores próprios, o Qwen3 Next 80B é o mais inteligente do catálogo aberto hoje, com velocidade superior e janela quase dobrada. Paga-se caro na fatura, mas economiza-se em chamadas de API concorrentes — a conta pode fechar.

Para quem está prototipando, gerando trechos de código, depurando funções ou embarcando o modelo em um pipeline que consome muitos tokens por minuto, o gpt-oss-20b entrega mais por real. Codificação melhor, agentic melhor, preço por token de saída quase nove vezes menor. Em setembro de 2025 ele é a escolha racional para o desenvolvedor sozinho ou startup queimando caixa.

E aí está a régua concreta: chinês caro-rápido-inteligente para os casos em que a janela de contexto e a atualidade do conhecimento justificam o gasto; americano barato-eficiente-codificador para o resto.

Em uma frase

Use o Qwen3 Next 80B quando a janela de contexto ou o raciocínio profundo mandam na conta; use o gpt-oss-20b quando cada centavo por token de saída e a qualidade de código decidem o orçamento.

Perguntas frequentes

Qwen3 Next 80B ou gpt-oss-20b: qual é mais barato por token?

O gpt-oss-20b é mais barato em todas as métricas: US$ 0,03 por milhão de tokens de entrada e US$ 0,13 de saída, contra US$ 0,15 e US$ 1,20 do Qwen3 Next 80B. Em custo de saída, a diferença é de cerca de nove vezes.

Qual dos dois é melhor para programação?

O gpt-oss-20b leva a melhor em codificação, com nota 20,697 contra 17,419 do Qwen3 Next 80B. Em tarefas agentic também fica à frente (3,103 contra 2,062).

Os dois modelos são open weights?

Sim. O Qwen3 Next 80B A3B Thinking foi lançado com pesos abertos em 11 de setembro de 2025, e o gpt-oss-20b foi liberado pela OpenAI em agosto sob licença Apache 2.0, ambos com arquitetura MoE.

Leia também