FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3.6 Max Preview cobra US$ 6 por milhão de saída e chega sem nota de IQ

Modelo da Alibaba com 1 trilhão de parâmetros entra no catálogo como preview caro, sem benchmark publicado e contra três concorrentes que custam até sete vezes menos para gerar texto.

Redação FalaVIP IA 3 min de leitura
US$ 6,16por milhão de tokens de saída
US$ 1,03por milhão de tokens de entrada
262.144tokens de contexto

Dezenove dias após o lançamento, o Qwen3.6 Max Preview continua sem nota de inteligência publicada no catálogo. Em um mercado onde os cinco modelos mais bem colocados já têm índice aferido, isso não é detalhe: é a informação que falta para você decidir se o preço faz sentido.

O que está na ficha

A Alibaba descreve o modelo como frontier proprietário, construído em arquitetura sparse mixture-of-experts com cerca de 1 trilhão de parâmetros totais. A descrição oficial destaca três usos: codificação agentic, uso de ferramentas e tarefas longas. O contexto é de 262.144 tokens. Modalidade: text-to-text. Não é gratuito.

Ficha técnica — Qwen3.6 Max Preview
CampoValor
Identificadorqwen/qwen3.6-max-preview
Criadorqwen
Preço de entradaUS$ 1.03 / M tokens
Preço de saídaUS$ 6.16 / M tokens
Janela de contexto262k
Modalidadetext->text

O preço é o ponto que precisa ser lido com lupa. Entrada custa US$ 1,027 por milhão de tokens; saída, US$ 6,162 por milhão. Para um app que só consome contexto — sumarização, classificação, embedding via prompt — o custo é razoável. Para um agente que escreve muito código e imprime respostas longas, a conta de saída pesa. Não há preço de cache publicado, então qualquer otimização com cache hit fica no escuro.

Quem está na frente hoje

O topo do catálogo, nesta data, é o Google Gemini 3.1 Pro Preview, com IQ 47,74 e saída a US$ 12 por milhão. Logo abaixo vem o OpenAI GPT-5.3-Codex, IQ 45,51, também a US$ 14 de saída — o mais caro do pódio. Em terceiro, o DeepSeek V4 Pro 0423, IQ 45,27, com saída a US$ 1,74 por milhão. É o único acima de IQ 45 que custa menos de US$ 2 para gerar.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 443 modelos disponíveis no catálogo nesta data.

Repare na assimetria. Pelo preço de um milhão de tokens de saída do Qwen3.6 Max Preview (US$ 6,16), você paga quase quatro gerações completas no DeepSeek V4 Pro. Pelo mesmo valor, o Gemini 3.1 Pro Preview entrega meio milhão de tokens. A conta não mente: em capacidade bruta de geração, o chinês da DeepSeek é o mais barato entre os modelos acima de IQ 45.

O que o preço está pagando

Aqui entra a leitura honesta. O Qwen3.6 Max Preview não publicou IQ, coding, agentic, blended nem velocidade. Sem esses números, o catálogo não consegue dizer se ele está mais perto do Gemini 3.1 Pro ou do MiMo-V2.5-Pro (IQ 42,88, saída a US$ 0,87). O preço de US$ 6,16 de saída sugere posicionamento premium — está acima do DeepSeek e abaixo do GPT-5.3-Codex —, mas a fatura é sua até alguém publicar um benchmark.

A descrição oficial fala em MoE com 1 trilhão de parâmetros totais. Pense assim: é como um restaurante com cardápio enorme onde só alguns pratos ficam prontos rápido. Em MoE, cada token ativa só uma fração dos parâmetros, então o custo de inferência pode ser menor do que o número total sugere — mas isso é uma promessa de arquitetura, não uma garantia de preço.

Para quem vale

Vale para três perfis. Primeiro, equipes já rodando na infraestrutura Alibaba Cloud, onde o atrito de integração é menor. Segundo, times que precisam testar agentic coding e tool use em um modelo novo antes de comprometer budget com GPT-5.3-Codex ou Gemini 3.1 Pro Preview — o preview serve justamente para isso. Terceiro, workloads que exigem 262k de contexto e não toleram o preço de saída do Gemini.

Para quem não muda nada

Se você está rodando agente de código em produção e a conta de saída dói, o DeepSeek V4 Pro continua sendo a referência de custo-benefício acima de IQ 45. Se você precisa de benchmark público para defender a escolha diante de um time financeiro ou de segurança, um preview sem nota de IQ não serve — espere a versão estável ou um índice aferido. E se o seu caso é tarefa curta e barata, o MiMo-V2.5 (US$ 0,28 de saída) resolve por uma fração do custo.

O que fazer com isso

Antes de trocar de modelo, meça seu consumo real de tokens de saída. Se a maioria dos seus prompts gasta menos de 2 mil tokens por resposta, a diferença entre US$ 1,74 e US$ 6,16 por milhão é pequena no fim do mês. Se você roda agente que escreve arquivos inteiros ou faz debug iterativo, a diferença explode. O Qwen3.6 Max Preview entra na fila como opção a testar quando você já esgotou o caminho barato e quer comparar um terceiro player antes de subir para o tier do Google ou da OpenAI.

Em uma frase

Teste o Qwen3.6 Max Preview se você já está no ecossistema Alibaba ou precisa de 262k de contexto; ignore se a conta de saída dói ou se você precisa de benchmark público para justificar a escolha.

Perguntas frequentes

Quanto custa o Qwen3.6 Max Preview?

US$ 1,027 por milhão de tokens de entrada e US$ 6,162 por milhão de tokens de saída. O catálogo não publicou preço de cache.

O Qwen3.6 Max Preview tem benchmark de IQ?

Não. O índice de inteligência não foi publicado no catálogo até esta data, assim como coding, agentic e velocidade. Isso impede comparação direta com Gemini 3.1 Pro, GPT-5.3-Codex e DeepSeek V4 Pro.

Qwen3.6 Max Preview vs DeepSeek V4 Pro: qual escolher?

Se preço de saída é o critério, DeepSeek V4 Pro ganha: custa US$ 1,74 por milhão contra US$ 6,16 do Qwen, e tem IQ 45,27 publicado. O Qwen só compensa se você já roda na Alibaba Cloud ou precisa testar um terceiro modelo frontier antes de subir de tier.

Leia também