Qwen3 Next grátis: o que 80 bilhões entregam de verdade
Versão Instruct do Qwen3-Next chega sem custo, mas não é troca direta do modelo de raciocínio.
Tem um padrão curioso nas estreias da Alibaba pelo catálogo: o modelo mais inteligente chega cobrando, e a versão chat do mesmo projeto entra de graça. Foi assim em setembro de 2025. O Qwen3 Next 80B A3B Instruct, listado no catálogo em 11 de setembro com quatro dias de mercado, é o irmão sem "thinking" do Qwen3 Next 80B A3B Thinking — e por enquanto não pesa no bolso.
O que muda em relação ao Thinking
A diferença não é preço, é comportamento. A versão Thinking do Qwen3 Next — que ocupa o terceiro lugar no ranking de inteligência do catálogo nesta data, com IQ 16,867 — foi treinada para gastar tokens raciocinando antes de responder, e cobra US$ 1,20 por milhão de tokens de saída. A Instruct, que está em análise aqui, corta esse passo intermediário: entrega direto, sem traços de raciocínio visíveis, otimizada para respostas rápidas e estáveis.
Em tradução prática: você não paga nada — US$ 0 de entrada, US$ 0 de saída — mas também não tem a camada de raciocínio que faz o Thinking se posicionar entre os cinco mais fortes do catálogo hoje. Para a rotina de chat, QA de conhecimento e código direto, a Instruct dá conta. Para problemas que precisam de planejamento explícito, não é a peça certa.
O 80B no nome vale quanto
A descrição fala em 80B de parâmetros com 3B ativos, característica da família A3B da Qwen. Isso não é dado oficial publicado junto da listagem, mas é a arquitetura que a Alibaba vem usando na linha Next. O que importa para a conta é a janela de contexto: 262.144 tokens, maior do que o que a maioria dos modelos pagos do catálogo entrega. É espaço para jogar documento inteiro, base de código longa ou transcrição de reunião sem precisar picotar.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3-next-80b-a3b-instruct:free |
| Criador | qwen |
| Preço de entrada | US$ 0.000 / M tokens |
| Preço de saída | US$ 0.000 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text->text |
Onde ele se encaixa no tabuleiro
O catálogo tem 227 modelos hoje, vindos de 38 criadores. No topo de inteligência, o o3 da OpenAI lidera com IQ 31,096 e cobra US$ 8 por milhão de saída. O gpt-oss-120b, da própria OpenAI, marca IQ 24,126 cobrando US$ 0,17. O Thinking da Qwen, terceiro, cobra US$ 1,20. A Instruct gratuita está fora desse ranking de IQ porque a listagem não traz índice publicado — e não dá para inventar nota.
O ponto é o seguinte: o Qwen3 Next Instruct entra no catálogo como mais uma opção de custo zero, ao lado do gpt-oss-20b (IQ 15,225, US$ 0,13 de saída) e do próprio gpt-oss-120b (US$ 0,17). A diferença da Qwen é a janela gigante de 262k tokens, coisa que os modelos OpenAI dessa faixa não entregam.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Para quem vale
Se você está prototipando um sistema que precisa de contexto longo sem estourar orçamento, faz sentido testar primeiro. Ingestão de documentos, resumo de logs, classificação em massa de tickets, chatbots de primeiro nível — tudo isso roda aqui sem gerar fatura. Treze modelos foram lançados nos últimos 30 dias no catálogo, e essa é uma das poucas entradas gratuitas com 262k de janela.
Também serve como segundo modelo numa cascata: usa o Thinking pago quando a tarefa exige raciocínio explícito e cai para a Instruct quando o caso é conversação pura. Como ambos são da mesma família, a troca não exige reformular prompt do zero.
Para quem não muda nada
Se você já tem o gpt-oss-120b no stack, a vantagem da Instruct é basicamente a janela de contexto maior — desde que você de fato use esse espaço extra. Em tarefas curtas, a diferença desaparece.
E atenção a um detalhe: o preço está em US$ 0, mas listagens gratuitas costumam ser gratuitas "até mudar de ideia". A Alibaba já reposicionou modelos da linha antes. Se isso for entrar em produção com volume, planeje contingência.
Um último ponto honesto: não há benchmark público de IQ, código, agente ou raciocínio para essa versão Instruct específica nos dados disponíveis. Comparação direta de capacidade com o Thinking ou com os modelos OpenAI não dá para cravar por número — só por inferência de comportamento descrito. Teste com seu caso real antes de comprometer arquitetura.
O que fazer com isso
Roteie tarefas de contexto longo e baixa exigência de raciocínio para o Instruct gratuito. Reserve o Thinking da mesma família para o que precisa de cadeia explícita. E meça custo por requisição completa, não só por token — taxa de retrabalho muda o cálculo.
Use a versão Instruct gratuita para tarefas longas e conversacionais; quando precisar de raciocínio explícito, pague o Thinking da mesma família.
Perguntas frequentes
O Qwen3 Next 80B A3B Instruct é realmente gratuito?
Sim, na listagem atual o modelo aparece com US$ 0 por milhão de tokens de entrada e de saída. Isso não é garantia permanente — promoções e gratuidades em catálogos costumam ser revisadas pelo criador sem aviso prévio.
Qual a diferença entre Qwen3 Next Instruct e Thinking?
A versão Thinking foi treinada para gastar tokens raciocinando antes de responder e custa US$ 1,20 por milhão de saída. A Instruct corta esse passo intermediário e entrega direto, com foco em velocidade e estabilidade para chat, código e QA.
A janela de contexto de 262k tokens funciona bem para documentos longos?
É uma das maiores janelas entre modelos gratuitos listados hoje. Para ingestão de PDFs extensos, bases de código ou transcrições longas, é um diferencial real frente a opções como o gpt-oss-20b, que tem contexto bem menor.