Qwen3.6 Plus chega a US$ 1,95 por milhão de saída e mira o meio do mercado
Modelo multimodal da Alibaba entra no catálogo com preço de token entre os menores do topo, mas sem índice de inteligência publicado
O que muda quando o token de saída custa menos de dois dólares
Você já deve ter reparado: o topo do catálogo de IA virou um clubinho caro. Os dois modelos com índice de inteligência acima de 45 hoje — Gemini 3.1 Pro Preview, da Google, e GPT-5.3-Codex, da OpenAI — custam US$ 12 e US$ 14 por milhão de tokens de saída, respectivamente. É um piso de mercado que faz qualquer desenvolvedor olhar duas vezes antes de colocar um agente em produção. Pois a Qwen, da Alibaba, acabou de enfiar um modelo novo exatamente nesse buraco.
O Qwen3.6 Plus apareceu no catálogo hoje, 2 de abril, com preço de US$ 1,95 por milhão de tokens de saída e US$ 0,325 por milhão de entrada. Em outras palavras: para cada resposta que o modelo gera, você paga cerca de sete vezes menos do que pagaria no Gemini 3.1 Pro Preview — e mais de sete vezes menos do que no GPT-5.3-Codex. Para um agente que cospe muito texto por dia, essa diferença não é cosmético, é linha da fatura.
O que o release diz e o que o catálogo mostra
A descrição oficial fala em uma arquitetura híbrida que mistura atenção linear eficiente com roteamento esparsa de mixture-of-experts — o tipo de combinação que permite escalar bem sem multiplicar o custo de inferência. É a mesma família de escolhas técnicas que a Qwen vinha usando na série 3.5. O catálogo também informa que o modelo aceita texto, imagem e vídeo como entrada e devolve texto, com janela de um milhão de tokens de contexto.
O problema é o que está em branco. O índice de inteligência não foi publicado, assim como coding, agentic, blended, velocidade e conhecimento de corte. Sem esses números, qualquer comparação direta com o Gemini 3.1 Pro Preview ou com o GPT-5.3-Codex vira chute. Você está pagando barato, mas não tem como saber, hoje, se está pagando barato por um modelo equivalente ou por um modelo que entrega metade da capacidade.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.6-plus |
| Criador | qwen |
| Preço de entrada | US$ 0.325 / M tokens |
| Preço de saída | US$ 1.95 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+video->text |
Onde o Qwen3.6 Plus se encaixa no tabuleiro
Olhando o catálogo como um todo, o cenário de hoje tem 386 modelos listados, vindos de 54 criadores diferentes. Nos últimos 30 dias, 34 modelos novos entraram — o Qwen3.6 Plus é mais um nessa fila, mas com um perfil de preço que se destaca. Entre os modelos com índice de inteligência acima de 45, os dois disponíveis continuam sendo os mais caros do topo. O próximo degrau, o Xiaomi MiMo-V2-Omni, sai por US$ 2 por milhão de tokens e marca 35,9 de inteligência — um patamar intermediário onde o Qwen3.6 Plus pode acabar competindo, dependendo de como performar nos benchmarks.
O Claude Sonnet 4.6, da Anthropic, aparece logo abaixo, com 35,1 de inteligência e US$ 15 por milhão de saída. E o próprio Qwen3.5 397B A17B, da geração anterior, marca 34,3 de inteligência por US$ 2,34. Ou seja: a Qwen já tem um histórico de oferecer modelos na faixa dos US$ 2 por milhão de saída. O 3.6 Plus mantém essa tradição e aperta um pouco mais o preço.
Para quem vale e para quem não muda nada
Se você roda um agente que consome muito token de saída — geração de código em loop, sumarização de documentos longos, pipelines de dados que devolvem relatórios extensos — o Qwen3.6 Plus merece um teste de fogo esta semana. A economia potencial em relação ao Gemini 3.1 Pro Preview é grande o suficiente para justificar um piloto, mesmo sem o índice de inteligência publicado: você roda seu benchmark interno, mede qualidade no seu caso de uso e compara com a conta.
Se você precisa de garantia de capacidade de ponta — raciocínio complexo, tarefas agentic pesadas, código crítico — o cenário de hoje não mudou. Os dois únicos modelos com índice acima de 45 continuam sendo o Gemini 3.1 Pro Preview e o GPT-5.3-Codex, e nenhum dos dois cedeu preço. O Qwen3.6 Plus é uma aposta no custo-benefício, não uma troca direta.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Qwen3.6 Plus (o novo) | — | 0.325 | 1.95 | 1M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
O que fazer com essa informação hoje
A implicação prática é direta: inclua o Qwen3.6 Plus na sua próxima rodada de testes A/B contra o modelo que você usa hoje para tarefas de alto volume. Meça qualidade no seu domínio específico — não confie em benchmark genérico enquanto o índice oficial não sair. Se a entrega for aceitável, a economia mensal pode pagar um estagiário. Se não for, você volta para o topo do catálogo sem ter perdido mais do que algumas horas de teste.
E fique de olho: a Qwen costuma publicar os índices de inteligência poucos dias depois do lançamento. Quando aparecer, a história deste modelo pode mudar de "barato e promissor" para "barato e equivalente" — ou para "barato e decepcionante". Hoje, é um ingresso barato para um filme sem sinopse.
Rode o Qwen3.6 Plus em piloto esta semana se você gasta muito token de saída; espere os benchmarks oficiais antes de migrar cargas críticas.
Perguntas frequentes
Quanto custa o Qwen3.6 Plus?
O modelo cobra US$ 0,325 por milhão de tokens de entrada e US$ 1,95 por milhão de tokens de saída. O catálogo não publicou preço de cache para esta versão.
O Qwen3.6 Plus é melhor que o Gemini 3.1 Pro Preview?
Hoje não dá para afirmar. O índice de inteligência do Qwen3.6 Plus não foi publicado, enquanto o Gemini 3.1 Pro Preview marca 47,7. A comparação direta depende de benchmarks que ainda não saíram.
O Qwen3.6 Plus aceita imagem e vídeo?
Sim. A modalidade declarada é texto, imagem e vídeo como entrada, com saída em texto, e a janela de contexto é de um milhão de tokens.