Qwen3.6 35B A3B chega sem benchmark e cobra US$ 0,90 por milhão
Multimodal open-weight da Alibaba Cloud tem 35B parâmetros, 3B ativos por token e 262 mil de contexto — só que a régua de IQ ainda não foi publicada.
Vinte dias sem régua
A Qwen soltou um multimodal open-weight no catálogo no fim de abril. Vinte dias depois, este texto sai e o IQ ainda não foi publicado — nem coding, nem agentic, nem velocidade. Você consegue contratar o modelo, mas não consegue comparar por número. É o caso raro em que a planilha de preço chega antes da régua de qualidade.
Para quem paga a conta, isso muda o cálculo. A pergunta deixa de ser "qual modelo é melhor" e vira "vale pagar pra descobrir sozinho?". Numa praça com mais de 443 modelos ativos no catálogo, escolher sem régua é escolher por fé.
O que a ficha mostra e o que ela esconde
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.6-35b-a3b |
| Criador | qwen |
| Preço de entrada | US$ 0.100 / M tokens |
| Preço de saída | US$ 0.900 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image+video->text |
| Leitura de cache | US$ 0.050 / M (50% de desconto) |
A ficha é honesta no que mostra. São 35 bilhões de parâmetros totais, 3 bilhões ativos por token numa arquitetura MoE esparsa híbrida. Contexto de 262.144 tokens, espaço para enfiar um documento grande de uma vez. Multimodal de verdade: aceita texto, imagem e vídeo na entrada, devolve só texto. Alibaba Cloud no crédito. Preço: US$ 0,10 o milhão de entrada, US$ 0,90 o de saída, US$ 0,05 o de cache.
A ficha é muda no que esconde. Os campos de IQ, coding, agentic, raciocínio e velocidade existem no catálogo — todos vazios para esse modelo. Dos 61 criadores listados hoje, este é um dos que chegam sem régua.
Onde ele entra no tabuleiro
Em 30 dias, 51 modelos novos entraram no catálogo. Boa parte sem benchmark também. É um mercado que cresce mais rápido do que a régua de qualidade consegue acompanhar.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
O topo medido hoje: Google Gemini 3.1 Pro Preview, IQ 47,7, US$ 12 por milhão de saída. OpenAI GPT-5.3-Codex, 45,5, US$ 14. DeepSeek V4 Pro 0423, 45,2, US$ 1,74. Xiaomi MiMo-V2.5-Pro, 42,8, US$ 0,87. Mais abaixo, o MiMo-V2.5 comum a US$ 0,28 com IQ 38.
O Qwen3.6 35B A3B entra em US$ 0,90 de saída. Está colado no MiMo-V2.5-Pro em preço, abaixo do DeepSeek e imbatível frente a Google e OpenAI. Só que o MiMo tem 42,8 medido, o DeepSeek tem 45,2, e o Qwen3.6 não tem régua. Se você não mede antes de adotar, está apostando.
Para quem vale a pena — e para quem não
Dois perfis tiram proveito real. Quem roda infraestrutura própria — open-weight permite baixar e hospedar — e está disposto a montar um painel de avaliação interno. Para esse público, US$ 0,90 de saída em inferência auto-hospedada é barulho de fundo; o que importa é a arquitetura (35B totais, 3B ativos) e o contexto de 262 mil, que cabe documento inteiro numa tacada.
O outro perfil é quem experimenta multimodal barato para tarefas descartáveis: classificar imagem, extrair dado de vídeo curto, resumir documento grande. Para workload que tolera erro e não exige raciocínio pesado, pagar 90 centavos é mais barato que o MiMo-V2.5-Pro a 87 e muito mais barato que qualquer coisa acima de IQ 45.
Quem não muda nada: se sua produção roda em cima de GPT-5.3-Codex, Gemini 3.1 Pro Preview ou DeepSeek V4 Pro, ignore este modelo por enquanto. Sem régua, pagar barato é atalho pra retrabalho. E se você precisa de coding agentic, planejamento multi-step ou matemática pesada, um modelo sem benchmark nessas dimensões é buraco na decisão. Espere a régua sair — ou meça você mesmo com seu próprio golden set antes de trocar.
O que fazer agora
Não troque seu stack principal. Se multimodal barato te interessa, baixe os pesos do Qwen3.6 35B A3B, monte um benchmark próprio com 30 a 50 prompts do seu domínio real, e só então decida se o US$ 0,90 vale a migração. O catálogo não vai responder por você. Você vai ter que medir.
Trate o Qwen3.6 35B A3B como hipótese, não como substituto: meça no seu domínio antes de migrar qualquer workload de produção.
Perguntas frequentes
O Qwen3.6 35B A3B tem benchmark de IQ publicado?
Não. Até a publicação deste texto, o catálogo não traz nota de IQ, coding nem agentic para o modelo. Para efeito de comparação, o topo do catálogo hoje vai de IQ 38 a 47,7 — todos medidos.
Quanto custa usar o Qwen3.6 35B A3B?
US$ 0,10 por milhão de tokens de entrada, US$ 0,90 por milhão de tokens de saída e US$ 0,05 por milhão em cache de leitura. Está entre as tarifas mais baixas do catálogo entre modelos multimodais.
O Qwen3.6 35B A3B é open-weight?
Sim, segundo a descrição publicada, é um modelo de pesos abertos do Alibaba Cloud com 35 bilhões de parâmetros totais e 3 bilhões ativos por token, em arquitetura MoE esparsa híbrida.