: Qwen3.8 Max chega a US$ 6 por milhão de saída e fica entre os 5 mais inteligentes do catálogo
Lançado nesta segunda como sucessor da versão preview, o modelo da Alibaba cobra 4 vezes menos que o Claude Opus 5 no token de saída e abre a janela dos multimodais chineses acima de IQ 58.
O número que importa não está no release
Se você só ler o comunicado da Alibaba, vai achar que o Qwen3.8 Max é só mais um flagship chinês tentando beliscar o topo. Mas o que muda a sua conta de API está numa linha que ninguém destaca: US$ 6 por milhão de tokens de saída. É quatro vezes mais barato que o Claude Opus 5 (US$ 25) e quase dois terços do preço do GPT-5.6 Sol (US$ 10), os dois modelos que aparecem acima dele no índice de inteligência do catálogo hoje.
Em outras palavras: o Qwen3.8 Max entrou no top 5 de inteligência sem cobrar tarifa de flagship.
O que ele é, de fato
O Qwen3.8 Max é a versão de disponibilidade geral do Qwen3.8 Max Preview, multimodal (texto, imagem e vídeo como entrada; texto como saída), com janela de 1 milhão de tokens e modo de raciocínio ativo. Pelo catálogo, ele pontua 58,077 de índice de inteligência, 71,813 em coding e 58,403 em agentic — números consistentes com um modelo pensado para fluxos longos, não para respostas curtas e baratas.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.8-max |
| Criador | qwen |
| Preço de entrada | US$ 2.00 / M tokens |
| Preço de saída | US$ 6.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+video->text |
| Leitura de cache | US$ 0.250 / M (88% de desconto) |
| Índice de inteligência (AA) | 58.1 |
| Índice de código | 71.8 |
| Índice agêntico | 58.4 |
| Pesos | fechados |
| Velocidade de saída | 39 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
O detalhe que pesa no bolso é o cache: US$ 0,25 por milhão de tokens cacheados, contra US$ 2 da entrada e US$ 6 da saída. Quem repete o mesmo prompt em loop (RAG, sumarização de documentos, agentes) paga uma fração do preço cheio. Quem só dispara pergunta-avulsa não sente esse alívio.
Onde ele se encaixa no tabuleiro
O catálogo de hoje tem 529 modelos listados (piso — modelos removidos depois não aparecem), vindos de 67 criadores. Nos últimos 30 dias, 47 modelos entraram — ou seja, o Qwen3.8 Max chega num mercado que não parou de receber coisa nova.
Olhando só o topo por inteligência, a fotografia é esta: Claude Opus 5 (63,053) na frente, Claude Fable 5 (62,073) logo atrás, GPT-5.6 Sol (60,93) em terceiro, MoonshotAI Kimi K3 (59,699) em quarto e o Qwen3.8 Max (58,077) fechando o top 5. Todos fechados num intervalo de cinco pontos. O Qwen é o mais barato desse grupo por uma margem enorme.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| Qwen3.8 Max | 58.1 | 6 |
Traduzindo o marketing da Alibaba em uma frase: você paga preço de modelo intermediário para rodar um modelo que aparece no topo do índice.
Para quem vale — e para quem não muda nada
Vale para três perfis. Primeiro, quem já roda agente em produção e quer trocar de provedor sem perder qualidade: o índice agentic de 58,4 é competitivo e o cache a US$ 0,25 reduz o custo de prompts repetidos. Segundo, quem consome multimodal (imagem e vídeo como entrada) e quer manter tudo dentro de uma única chamada — entrada de US$ 2 por milhão é razoável para esse perfil. Terceiro, quem está rodando benchmark interno com modelos chineses e precisa de um ponto de referência acima de IQ 58.
Não muda nada para quem usa DeepSeek V4 Flash 0731 (51,767 de IQ, US$ 0,18 por milhão de saída) só para classificar texto curto: o salto de inteligência não paga a diferença de 33 vezes no token. Também não muda nada para quem já está no Claude Opus 5 e mediu que a diferença de 5 pontos de IQ muda o resultado do produto — nesse caso, trocar para economizar é furada.
Comparativo direto
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Qwen3.8 Max (o novo) | 58.1 | 2 | 6 | 1M |
| Claude Opus 5 | 63.1 | 5 | 25 | 1M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| GPT-5.6 Sol | 60.9 | 2 | 10 | 1.05M |
| DeepSeek V4 Flash 0731 | 51.8 | 0.065 | 0.18 | 1.31M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
A leitura rápida: o Qwen3.8 Max cobra 24% do preço do Claude Opus 5 e entrega 92% do índice de inteligência. Cobra 60% do preço do GPT-5.6 Sol e entrega 95% do índice. É a melhor relação custo-benefício dentro do top 5 atual — e isso é o que faz a conta fechar.
O que fazer com isso hoje
Se você tem um fluxo com prompt repetido (cache hit alto), o caminho é testar o Qwen3.8 Max como substituto do GPT-5.6 Sol ou do Claude Fable 5 e medir latência — o catálogo informa 38,67 tokens por segundo, número que precisa bater com a sua realidade antes de migrar. Se você roda multimodal pesado, vale fazer um piloto de uma semana olhando custo por tarefa concluída, não só por token. E se você está apenas namorando o topo do índice, lembre que o Kimi K3 da MoonshotAI está logo acima (59,699) por US$ 15 — diferença pequena de IQ, diferença grande de preço.
Trocar o GPT-5.6 Sol ou o Claude Fable 5 pelo Qwen3.8 Max promete 40-75% de economia no token de saída com perda de até 5% no índice de inteligência — vale piloto em fluxo com cache alto antes de migrar de vez.
Perguntas frequentes
Quanto custa o Qwen3.8 Max por milhão de tokens?
Entrada US$ 2, saída US$ 6 e cache US$ 0,25 por milhão de tokens, segundo o catálogo. É quatro vezes mais barato na saída que o Claude Opus 5 e 60% do preço do GPT-5.6 Sol.
O Qwen3.8 Max é multimodal?
Sim. Aceita texto, imagem e vídeo como entrada e devolve texto. A janela de contexto é de 1 milhão de tokens e o modo de raciocínio está ativo por padrão.
O Qwen3.8 Max tem pesos abertos?
Não. O catálogo lista open_weights como false, então o acesso é via API, sem download de pesos.