FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3.5 397B A17B lidera por 0,24 ponto e cobra 8 vezes menos que o3

Modelo chinês de pesos abertos estreia no topo do índice de inteligência, mas o barato de verdade continua sendo o MiMo-V2-Flash da Xiaomi.

Redação FalaVIP IA 3 min de leitura
US$ 2,34por milhão de tokens de saída
34,26de índice de inteligência (topo do catálogo)
397B / 17Bparâmetros totais vs. ativos (MoE híbrido)

Tem um modelo chinês sentado no topo do índice de inteligência do catálogo hoje, e ele não é o mais barato da festa. O Qwen3.5 397B A17B estreia com nota 34,26, à frente do Xiaomi MiMo-V2-Flash (34,02), do OpenAI o3 (31,10) e do Anthropic Claude Haiku 4.5 (29,89). A diferença para o segundo colocado? Menos de um quarto de ponto. Para o o3, referência de raciocínio da OpenAI, são mais de três pontos.

O que o release diz vs. o que a conta mostra

A Alibaba/Qwen soltou a ficha: arquitetura híbrida que mistura atenção linear com mistura esparsa de especialistas, 397 bilhões de parâmetros totais e apenas 17 bilhões ativos por inferência. Em outras palavras, é um MoE enorme que gasta pouco por token gerado — é como um restaurante com cardápio de 397 pratos, mas onde só 17 panelas estão acesas quando você pede o seu.

O preço de entrada é US$ 0,39 por milhão de tokens e o de saída, US$ 2,34. Em relação ao o3, a saída é quase 3,5 vezes mais barata (US$ 8,00/M). Frente ao Claude Haiku 4.5, a economia é de 53%. Só que o MiMo-V2-Flash, que está logo abaixo no ranking, cobra US$ 0,30 de saída — quase oito vezes menos que o novo Qwen.

Índice de inteligência (Artificial Analysis)
Qwen3.5 397B A17B34,3MiMo-V2-Flash34Claude Haiku 4.529,9o331,1índice
Fonte: Artificial Analysis
Preço de saída (US$ por milhão de tokens)
Qwen3.5 397B A17B3,5MiMo-V2-Flash0,3Claude Haiku 4.55o38US$/M
Fonte: OpenRouter

Onde ele brilha — e onde não

A nota de codificação do Qwen3.5 397B A17B é 48,21, acima do Claude Haiku 4.5 (43,89). Em tarefas agentic, marca 19,85 contra 16,47 do Haiku. Ou seja, nas duas frentes que mais importam para quem monta produto, ele entrega mais que o Haiku cobrando menos da metade na saída.

A velocidade reportada é 87,91 tokens por segundo, contra 90,21 do Haiku e 108,93 do o3. Não é o mais rápido, mas está no mesmo bairro do Haiku, que é o que a Anthropic vende como "rápido e barato". O contexto é de 262 mil tokens, maior que os 200 mil do Haiku e do o3. A modalidade aceita texto, imagem e vídeo como entrada e devolve texto — o Haiku e o o3 também leem imagem e arquivo, mas não vídeo.

Ficha técnica — Qwen3.5 397B A17B
CampoValor
Identificadorqwen/qwen3.5-397b-a17b
Criadorqwen
Preço de entradaUS$ 0.550 / M tokens
Preço de saídaUS$ 3.50 / M tokens
Janela de contexto262k
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.225 / M (59% de desconto)
Índice de inteligência (AA)34.3
Índice de código48.2
Índice agêntico19.8
Parâmetros397B (17B ativos por token)
Pesosabertos
Velocidade de saída88 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Para quem vale — e para quem não muda nada

Vale a pena olhar de perto se você:

  • está construindo um agente ou ferramenta de codificação e quer qualidade de o3 sem pagar o3;
  • precisa de um modelo de pesos abertos (diferencial real frente ao Haiku e ao o3, que são fechados);
  • opera com multimodalidade de vídeo além de imagem.

Não muda nada se você:

  • já está no MiMo-V2-Flash e o orçamento é o fator decisivo — a nota é quase a mesma e o preço é outra ordem de grandeza;
  • depende de SLA e suporte enterprise típico de fornecedor americano, caso do Haiku e do o3;
  • quer o raciocínio mais rápido do mercado, onde o o3 ainda lidera em tokens por segundo.

O tabuleiro em 16 de fevereiro

O topo do catálogo hoje é 100% chinês nas duas primeiras posições e americano na terceira e na quarta. O o3, lançado em abril de 2025, segue como referência de raciocínio, mas está sendo cercado por modelos abertos mais novos e mais baratos. O Haiku 4.5, de outubro de 2025, perde em inteligência, codificação e agentic para o novo Qwen, e perde em preço também.

Inteligência × preço de saída
Qwen3.5 397B A17BMiMo-V2-FlashClaude Haiku 4.5o3US$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Qwen3.5 397B A17B (o novo)34.30.553.5262k
MiMo-V2-Flash34.00.10.3262k
Claude Haiku 4.529.915200k
o331.128200k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Entre os 336 modelos disponíveis no catálogo nesta data.

O que fazer com isso

Se você está pagando o3 para tarefas de codificação ou agentic, vale rodar uma amostra do Qwen3.5 397B A17B no seu pipeline e comparar token a token. Se o MiMo-V2-Flash já resolve, mantenha-o — a economia é grande demais para trocar por 0,24 ponto de índice. E se Haiku 4.5 era o seu padrão de "barato que presta", o novo Qwen entrega mais por menos: é a troca que faz sentido neste mês.

Em uma frase

Teste o Qwen3.5 397B A17B em codificação e agentic se você paga o3; mantenha o MiMo-V2-Flash se o orçamento manda; troque o Haiku 4.5 sem pensar duas vezes.

Perguntas frequentes

O Qwen3.5 397B A17B é realmente o melhor modelo disponível hoje?

É o que lidera o índice de inteligência do catálogo nesta data, com 34,26, mas a vantagem sobre o Xiaomi MiMo-V2-Flash (34,02) é de menos de 0,3 ponto. Em velocidade, o OpenAI o3 segue à frente (108,93 vs. 87,91 tokens/s).

Quanto custa usar o Qwen3.5 397B A17B na API?

US$ 0,39 por milhão de tokens de entrada e US$ 2,34 por milhão de tokens de saída. O catálogo não publicou preço de cache nesta data.

Posso rodar o Qwen3.5 397B A17B localmente, já que tem pesos abertos?

O modelo é listado como open_weights, com 397B parâmetros totais e 17B ativos por inferência. Isso significa que os pesos estão disponíveis, mas a infraestrutura para servir 397B é exigente — a maioria dos usos práticos continua passando pela API.

Leia também