FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Qwen3.6 35B A3B chega sem benchmark e cobra US$ 0,90 por milhão

Multimodal open-weight da Alibaba Cloud tem 35B parâmetros, 3B ativos por token e 262 mil de contexto — só que a régua de IQ ainda não foi publicada.

Redação FalaVIP IA 3 min de leitura
US$ 0,90por milhão de tokens de saída
US$ 0,10por milhão de tokens de entrada
262.144tokens de contexto

Vinte dias sem régua

A Qwen soltou um multimodal open-weight no catálogo no fim de abril. Vinte dias depois, este texto sai e o IQ ainda não foi publicado — nem coding, nem agentic, nem velocidade. Você consegue contratar o modelo, mas não consegue comparar por número. É o caso raro em que a planilha de preço chega antes da régua de qualidade.

Para quem paga a conta, isso muda o cálculo. A pergunta deixa de ser "qual modelo é melhor" e vira "vale pagar pra descobrir sozinho?". Numa praça com mais de 443 modelos ativos no catálogo, escolher sem régua é escolher por fé.

O que a ficha mostra e o que ela esconde

Ficha técnica — Qwen3.6 35B A3B
CampoValor
Identificadorqwen/qwen3.6-35b-a3b
Criadorqwen
Preço de entradaUS$ 0.100 / M tokens
Preço de saídaUS$ 0.900 / M tokens
Janela de contexto262k
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.050 / M (50% de desconto)

A ficha é honesta no que mostra. São 35 bilhões de parâmetros totais, 3 bilhões ativos por token numa arquitetura MoE esparsa híbrida. Contexto de 262.144 tokens, espaço para enfiar um documento grande de uma vez. Multimodal de verdade: aceita texto, imagem e vídeo na entrada, devolve só texto. Alibaba Cloud no crédito. Preço: US$ 0,10 o milhão de entrada, US$ 0,90 o de saída, US$ 0,05 o de cache.

A ficha é muda no que esconde. Os campos de IQ, coding, agentic, raciocínio e velocidade existem no catálogo — todos vazios para esse modelo. Dos 61 criadores listados hoje, este é um dos que chegam sem régua.

Onde ele entra no tabuleiro

Em 30 dias, 51 modelos novos entraram no catálogo. Boa parte sem benchmark também. É um mercado que cresce mais rápido do que a régua de qualidade consegue acompanhar.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 443 modelos disponíveis no catálogo nesta data.

O topo medido hoje: Google Gemini 3.1 Pro Preview, IQ 47,7, US$ 12 por milhão de saída. OpenAI GPT-5.3-Codex, 45,5, US$ 14. DeepSeek V4 Pro 0423, 45,2, US$ 1,74. Xiaomi MiMo-V2.5-Pro, 42,8, US$ 0,87. Mais abaixo, o MiMo-V2.5 comum a US$ 0,28 com IQ 38.

O Qwen3.6 35B A3B entra em US$ 0,90 de saída. Está colado no MiMo-V2.5-Pro em preço, abaixo do DeepSeek e imbatível frente a Google e OpenAI. Só que o MiMo tem 42,8 medido, o DeepSeek tem 45,2, e o Qwen3.6 não tem régua. Se você não mede antes de adotar, está apostando.

Para quem vale a pena — e para quem não

Dois perfis tiram proveito real. Quem roda infraestrutura própria — open-weight permite baixar e hospedar — e está disposto a montar um painel de avaliação interno. Para esse público, US$ 0,90 de saída em inferência auto-hospedada é barulho de fundo; o que importa é a arquitetura (35B totais, 3B ativos) e o contexto de 262 mil, que cabe documento inteiro numa tacada.

O outro perfil é quem experimenta multimodal barato para tarefas descartáveis: classificar imagem, extrair dado de vídeo curto, resumir documento grande. Para workload que tolera erro e não exige raciocínio pesado, pagar 90 centavos é mais barato que o MiMo-V2.5-Pro a 87 e muito mais barato que qualquer coisa acima de IQ 45.

Quem não muda nada: se sua produção roda em cima de GPT-5.3-Codex, Gemini 3.1 Pro Preview ou DeepSeek V4 Pro, ignore este modelo por enquanto. Sem régua, pagar barato é atalho pra retrabalho. E se você precisa de coding agentic, planejamento multi-step ou matemática pesada, um modelo sem benchmark nessas dimensões é buraco na decisão. Espere a régua sair — ou meça você mesmo com seu próprio golden set antes de trocar.

O que fazer agora

Não troque seu stack principal. Se multimodal barato te interessa, baixe os pesos do Qwen3.6 35B A3B, monte um benchmark próprio com 30 a 50 prompts do seu domínio real, e só então decida se o US$ 0,90 vale a migração. O catálogo não vai responder por você. Você vai ter que medir.

Em uma frase

Trate o Qwen3.6 35B A3B como hipótese, não como substituto: meça no seu domínio antes de migrar qualquer workload de produção.

Perguntas frequentes

O Qwen3.6 35B A3B tem benchmark de IQ publicado?

Não. Até a publicação deste texto, o catálogo não traz nota de IQ, coding nem agentic para o modelo. Para efeito de comparação, o topo do catálogo hoje vai de IQ 38 a 47,7 — todos medidos.

Quanto custa usar o Qwen3.6 35B A3B?

US$ 0,10 por milhão de tokens de entrada, US$ 0,90 por milhão de tokens de saída e US$ 0,05 por milhão em cache de leitura. Está entre as tarifas mais baixas do catálogo entre modelos multimodais.

O Qwen3.6 35B A3B é open-weight?

Sim, segundo a descrição publicada, é um modelo de pesos abertos do Alibaba Cloud com 35 bilhões de parâmetros totais e 3 bilhões ativos por token, em arquitetura MoE esparsa híbrida.

Leia também