Qwen3.6 Max Preview cobra US$ 6 por milhão de saída e chega sem nota de IQ
Modelo da Alibaba com 1 trilhão de parâmetros entra no catálogo como preview caro, sem benchmark publicado e contra três concorrentes que custam até sete vezes menos para gerar texto.
Dezenove dias após o lançamento, o Qwen3.6 Max Preview continua sem nota de inteligência publicada no catálogo. Em um mercado onde os cinco modelos mais bem colocados já têm índice aferido, isso não é detalhe: é a informação que falta para você decidir se o preço faz sentido.
O que está na ficha
A Alibaba descreve o modelo como frontier proprietário, construído em arquitetura sparse mixture-of-experts com cerca de 1 trilhão de parâmetros totais. A descrição oficial destaca três usos: codificação agentic, uso de ferramentas e tarefas longas. O contexto é de 262.144 tokens. Modalidade: text-to-text. Não é gratuito.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.6-max-preview |
| Criador | qwen |
| Preço de entrada | US$ 1.03 / M tokens |
| Preço de saída | US$ 6.16 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text->text |
O preço é o ponto que precisa ser lido com lupa. Entrada custa US$ 1,027 por milhão de tokens; saída, US$ 6,162 por milhão. Para um app que só consome contexto — sumarização, classificação, embedding via prompt — o custo é razoável. Para um agente que escreve muito código e imprime respostas longas, a conta de saída pesa. Não há preço de cache publicado, então qualquer otimização com cache hit fica no escuro.
Quem está na frente hoje
O topo do catálogo, nesta data, é o Google Gemini 3.1 Pro Preview, com IQ 47,74 e saída a US$ 12 por milhão. Logo abaixo vem o OpenAI GPT-5.3-Codex, IQ 45,51, também a US$ 14 de saída — o mais caro do pódio. Em terceiro, o DeepSeek V4 Pro 0423, IQ 45,27, com saída a US$ 1,74 por milhão. É o único acima de IQ 45 que custa menos de US$ 2 para gerar.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Repare na assimetria. Pelo preço de um milhão de tokens de saída do Qwen3.6 Max Preview (US$ 6,16), você paga quase quatro gerações completas no DeepSeek V4 Pro. Pelo mesmo valor, o Gemini 3.1 Pro Preview entrega meio milhão de tokens. A conta não mente: em capacidade bruta de geração, o chinês da DeepSeek é o mais barato entre os modelos acima de IQ 45.
O que o preço está pagando
Aqui entra a leitura honesta. O Qwen3.6 Max Preview não publicou IQ, coding, agentic, blended nem velocidade. Sem esses números, o catálogo não consegue dizer se ele está mais perto do Gemini 3.1 Pro ou do MiMo-V2.5-Pro (IQ 42,88, saída a US$ 0,87). O preço de US$ 6,16 de saída sugere posicionamento premium — está acima do DeepSeek e abaixo do GPT-5.3-Codex —, mas a fatura é sua até alguém publicar um benchmark.
A descrição oficial fala em MoE com 1 trilhão de parâmetros totais. Pense assim: é como um restaurante com cardápio enorme onde só alguns pratos ficam prontos rápido. Em MoE, cada token ativa só uma fração dos parâmetros, então o custo de inferência pode ser menor do que o número total sugere — mas isso é uma promessa de arquitetura, não uma garantia de preço.
Para quem vale
Vale para três perfis. Primeiro, equipes já rodando na infraestrutura Alibaba Cloud, onde o atrito de integração é menor. Segundo, times que precisam testar agentic coding e tool use em um modelo novo antes de comprometer budget com GPT-5.3-Codex ou Gemini 3.1 Pro Preview — o preview serve justamente para isso. Terceiro, workloads que exigem 262k de contexto e não toleram o preço de saída do Gemini.
Para quem não muda nada
Se você está rodando agente de código em produção e a conta de saída dói, o DeepSeek V4 Pro continua sendo a referência de custo-benefício acima de IQ 45. Se você precisa de benchmark público para defender a escolha diante de um time financeiro ou de segurança, um preview sem nota de IQ não serve — espere a versão estável ou um índice aferido. E se o seu caso é tarefa curta e barata, o MiMo-V2.5 (US$ 0,28 de saída) resolve por uma fração do custo.
O que fazer com isso
Antes de trocar de modelo, meça seu consumo real de tokens de saída. Se a maioria dos seus prompts gasta menos de 2 mil tokens por resposta, a diferença entre US$ 1,74 e US$ 6,16 por milhão é pequena no fim do mês. Se você roda agente que escreve arquivos inteiros ou faz debug iterativo, a diferença explode. O Qwen3.6 Max Preview entra na fila como opção a testar quando você já esgotou o caminho barato e quer comparar um terceiro player antes de subir para o tier do Google ou da OpenAI.
Teste o Qwen3.6 Max Preview se você já está no ecossistema Alibaba ou precisa de 262k de contexto; ignore se a conta de saída dói ou se você precisa de benchmark público para justificar a escolha.
Perguntas frequentes
Quanto custa o Qwen3.6 Max Preview?
US$ 1,027 por milhão de tokens de entrada e US$ 6,162 por milhão de tokens de saída. O catálogo não publicou preço de cache.
O Qwen3.6 Max Preview tem benchmark de IQ?
Não. O índice de inteligência não foi publicado no catálogo até esta data, assim como coding, agentic e velocidade. Isso impede comparação direta com Gemini 3.1 Pro, GPT-5.3-Codex e DeepSeek V4 Pro.
Qwen3.6 Max Preview vs DeepSeek V4 Pro: qual escolher?
Se preço de saída é o critério, DeepSeek V4 Pro ganha: custa US$ 1,74 por milhão contra US$ 6,16 do Qwen, e tem IQ 45,27 publicado. O Qwen só compensa se você já roda na Alibaba Cloud ou precisa testar um terceiro modelo frontier antes de subir de tier.