FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

: Qwen3.8 Max chega a US$ 6 por milhão de saída e fica entre os 5 mais inteligentes do catálogo

Lançado nesta segunda como sucessor da versão preview, o modelo da Alibaba cobra 4 vezes menos que o Claude Opus 5 no token de saída e abre a janela dos multimodais chineses acima de IQ 58.

Redação FalaVIP IA 3 min de leitura
US$ 6por milhão de tokens de saída
58,077índice de inteligência do Qwen3.8 Max
47modelos lançados nos últimos 30 dias no catálogo

O número que importa não está no release

Se você só ler o comunicado da Alibaba, vai achar que o Qwen3.8 Max é só mais um flagship chinês tentando beliscar o topo. Mas o que muda a sua conta de API está numa linha que ninguém destaca: US$ 6 por milhão de tokens de saída. É quatro vezes mais barato que o Claude Opus 5 (US$ 25) e quase dois terços do preço do GPT-5.6 Sol (US$ 10), os dois modelos que aparecem acima dele no índice de inteligência do catálogo hoje.

Preço de saída (US$ por milhão de tokens)
Qwen3.8 Max6Claude Opus 525Claude Fable 550GPT-5.6 Sol10DeepSeek V4 Flash 07310,18MiniMax M31,2US$/M
Fonte: OpenRouter

Em outras palavras: o Qwen3.8 Max entrou no top 5 de inteligência sem cobrar tarifa de flagship.

O que ele é, de fato

O Qwen3.8 Max é a versão de disponibilidade geral do Qwen3.8 Max Preview, multimodal (texto, imagem e vídeo como entrada; texto como saída), com janela de 1 milhão de tokens e modo de raciocínio ativo. Pelo catálogo, ele pontua 58,077 de índice de inteligência, 71,813 em coding e 58,403 em agentic — números consistentes com um modelo pensado para fluxos longos, não para respostas curtas e baratas.

Ficha técnica — Qwen3.8 Max
CampoValor
Identificadorqwen/qwen3.8-max
Criadorqwen
Preço de entradaUS$ 2.00 / M tokens
Preço de saídaUS$ 6.00 / M tokens
Janela de contexto1M
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.250 / M (88% de desconto)
Índice de inteligência (AA)58.1
Índice de código71.8
Índice agêntico58.4
Pesosfechados
Velocidade de saída39 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

O detalhe que pesa no bolso é o cache: US$ 0,25 por milhão de tokens cacheados, contra US$ 2 da entrada e US$ 6 da saída. Quem repete o mesmo prompt em loop (RAG, sumarização de documentos, agentes) paga uma fração do preço cheio. Quem só dispara pergunta-avulsa não sente esse alívio.

Onde ele se encaixa no tabuleiro

O catálogo de hoje tem 529 modelos listados (piso — modelos removidos depois não aparecem), vindos de 67 criadores. Nos últimos 30 dias, 47 modelos entraram — ou seja, o Qwen3.8 Max chega num mercado que não parou de receber coisa nova.

Índice de inteligência (Artificial Analysis)
Qwen3.8 Max58,1Claude Opus 563,1Claude Fable 562,1GPT-5.6 Sol60,9DeepSeek V4 Flash 073151,8MiniMax M345,4índice
Fonte: Artificial Analysis

Olhando só o topo por inteligência, a fotografia é esta: Claude Opus 5 (63,053) na frente, Claude Fable 5 (62,073) logo atrás, GPT-5.6 Sol (60,93) em terceiro, MoonshotAI Kimi K3 (59,699) em quarto e o Qwen3.8 Max (58,077) fechando o top 5. Todos fechados num intervalo de cinco pontos. O Qwen é o mais barato desse grupo por uma margem enorme.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
Qwen3.8 Max58.16
Entre os 529 modelos disponíveis no catálogo nesta data.

Traduzindo o marketing da Alibaba em uma frase: você paga preço de modelo intermediário para rodar um modelo que aparece no topo do índice.

Para quem vale — e para quem não muda nada

Vale para três perfis. Primeiro, quem já roda agente em produção e quer trocar de provedor sem perder qualidade: o índice agentic de 58,4 é competitivo e o cache a US$ 0,25 reduz o custo de prompts repetidos. Segundo, quem consome multimodal (imagem e vídeo como entrada) e quer manter tudo dentro de uma única chamada — entrada de US$ 2 por milhão é razoável para esse perfil. Terceiro, quem está rodando benchmark interno com modelos chineses e precisa de um ponto de referência acima de IQ 58.

Não muda nada para quem usa DeepSeek V4 Flash 0731 (51,767 de IQ, US$ 0,18 por milhão de saída) só para classificar texto curto: o salto de inteligência não paga a diferença de 33 vezes no token. Também não muda nada para quem já está no Claude Opus 5 e mediu que a diferença de 5 pontos de IQ muda o resultado do produto — nesse caso, trocar para economizar é furada.

Inteligência × preço de saída
Qwen3.8 MaxClaude Opus 5Claude Fable 5GPT-5.6 SolDeepSeek V4 Flash 0731MiniMax M3US$ por milhão (saída, escala log)índice de inteligência

Comparativo direto

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Qwen3.8 Max (o novo)58.1261M
Claude Opus 563.15251M
Claude Fable 562.110501M
GPT-5.6 Sol60.92101.05M
DeepSeek V4 Flash 073151.80.0650.181.31M
MiniMax M345.40.31.21.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A leitura rápida: o Qwen3.8 Max cobra 24% do preço do Claude Opus 5 e entrega 92% do índice de inteligência. Cobra 60% do preço do GPT-5.6 Sol e entrega 95% do índice. É a melhor relação custo-benefício dentro do top 5 atual — e isso é o que faz a conta fechar.

O que fazer com isso hoje

Se você tem um fluxo com prompt repetido (cache hit alto), o caminho é testar o Qwen3.8 Max como substituto do GPT-5.6 Sol ou do Claude Fable 5 e medir latência — o catálogo informa 38,67 tokens por segundo, número que precisa bater com a sua realidade antes de migrar. Se você roda multimodal pesado, vale fazer um piloto de uma semana olhando custo por tarefa concluída, não só por token. E se você está apenas namorando o topo do índice, lembre que o Kimi K3 da MoonshotAI está logo acima (59,699) por US$ 15 — diferença pequena de IQ, diferença grande de preço.

Em uma frase

Trocar o GPT-5.6 Sol ou o Claude Fable 5 pelo Qwen3.8 Max promete 40-75% de economia no token de saída com perda de até 5% no índice de inteligência — vale piloto em fluxo com cache alto antes de migrar de vez.

Perguntas frequentes

Quanto custa o Qwen3.8 Max por milhão de tokens?

Entrada US$ 2, saída US$ 6 e cache US$ 0,25 por milhão de tokens, segundo o catálogo. É quatro vezes mais barato na saída que o Claude Opus 5 e 60% do preço do GPT-5.6 Sol.

O Qwen3.8 Max é multimodal?

Sim. Aceita texto, imagem e vídeo como entrada e devolve texto. A janela de contexto é de 1 milhão de tokens e o modo de raciocínio está ativo por padrão.

O Qwen3.8 Max tem pesos abertos?

Não. O catálogo lista open_weights como false, então o acesso é via API, sem download de pesos.

Leia também