Qwen3.6 Flash custa US$ 1,125 por milhão de saída, mas sem nota de IQ
Modelo da Alibaba aceita vídeo e tem 1M de contexto, mas o catálogo não publicou benchmark nenhum — nem IQ, nem código, nem agentic.
A conta que parece boa
O catálogo soma 443 modelos em circulação hoje, e 51 deles chegaram nos últimos 30 dias. O Qwen3.6 Flash é um dos mais novos — três semanas de mercado, multimodal na entrada (texto, imagem, vídeo) e janela de 1 milhão de tokens. O preço de saída: US$ 1,125 por milhão. Na ponta de entrada, US$ 0,1875 por milhão. Para colocar em perspectiva: o DeepSeek V4 Pro, único modelo acima de IQ 45 com preço parecido, cobra US$ 1,74 por milhão de saída. O Gemini 3.1 Pro Preview, topo do ranking de inteligência, cobra US$ 12. Em outras palavras, o Flash é cerca de 35% mais barato em saída que o DeepSeek e quase 11 vezes mais barato que o Gemini no mesmo parâmetro.
Só que existe um porém do tamanho do catálogo.
O que falta (e o que isso significa)
O Qwen3.6 Flash foi lançado em 27 de abril e, até agora, não tem nota de IQ publicada. Também não há benchmark de coding nem agentic. Sem esses números, dá pra comparar preço, mas não dá pra comparar competência. É como saber o preço da passagem sem saber se o voo é direto ou faz duas conexões.
A descrição oficial diz que a série Qwen 3.6 é "rápida e eficiente" e menciona precificação tiered — o que significa que o valor de tabela pode mudar em volume. O catálogo também não publicou preço de cache para esse modelo, então o desconto por reuso de prompt não está visível na ficha. Se você depende de cache de prompt para baratear chamadas longas, esse é um buraco na comparação.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.6-flash |
| Criador | qwen |
| Preço de entrada | US$ 0.188 / M tokens |
| Preço de saída | US$ 1.13 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+video->text |
Onde ele entra no tabuleiro
Olhando o topo de IQ hoje, a régua é Gemini 3.1 Pro Preview (47,7), GPT-5.3-Codex (45,5) e DeepSeek V4 Pro (45,3). Xiaomi MiMo-V2.5-Pro aparece logo abaixo com 42,9 a US$ 0,87 de saída — mais barato que o Flash. O Qwen3.6 Flash, sem nota, fica numa zona cinzenta: pode competir com o MiMo em preço, pode performar melhor, pode performar pior. O catálogo não te dá a resposta.
A origem é chinesa (Alibaba), e o multimodalismo é diferencial real — não são muitos os modelos abaixo de US$ 2 de saída que aceitam vídeo como entrada. O MiMo-V2.5-Pro também aceita, mas cobra 23% menos. Então o argumento do Flash não é ser o multimodal mais barato, e sim oferecer 1M de contexto a um preço que nenhum concorrente medido ainda atingiu.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Para quem vale — e para quem não muda nada
Vale para quem está testando multimodal barato, precisa de janela grande e aceita rodar um piloto para descobrir a qualidade na prática. Se você é o tipo de dev que mede latência e taxa de acerto em workload próprio antes de subir pra produção, o Flash é candidato a teste curto.
Não vale se você precisa de garantia de benchmark antes de qualquer deploy, se o caso de uso é raciocínio pesado (código complexo, agentes longos, planejamento multi-step) ou se você já está feliz com DeepSeek V4 Pro ou MiMo-V2.5-Pro — porque ambos têm nota e custam parecido ou menos. Também não muda nada para quem usa Gemini ou GPT topo de linha: o Flash não está disputando essa faixa, está brigando lá embaixo com modelos chineses rápidos.
O movimento prático: rode o Qwen3.6 Flash num workload multimodal pequeno (algumas dezenas de vídeos curtos com prompt fixo), meça latência e qualidade no seu critério, e acompanhe a publicação da nota de IQ. Se ela sair abaixo de 40, migre pro MiMo-V2.5-Pro. Se sair acima de 45, é candidato sério a substituir o DeepSeek V4 Pro em casos onde multimodal entra na jogada e o cache não é crítico.
O Qwen3.6 Flash é um teste, não uma troca: rode um piloto multimodal pequeno, meça qualidade no seu workload e espere a nota de IQ aparecer antes de migrar produção.
Perguntas frequentes
O Qwen3.6 Flash tem nota de IQ no catálogo?
Não. O modelo foi lançado em 27 de abril e, até hoje, o catálogo não publicou IQ, coding nem agentic. Dá pra comparar preço, mas a comparação de qualidade depende de teste próprio.
Quanto custa o Qwen3.6 Flash comparado ao DeepSeek V4 Pro?
Na saída, o Flash cobra US$ 1,125 por milhão de tokens contra US$ 1,74 do DeepSeek V4 Pro — cerca de 35% mais barato. A diferença de entrada não está publicada para o DeepSeek no recorte deste dado.
O Qwen3.6 Flash vale para aplicações com vídeo?
É um dos poucos modelos abaixo de US$ 2 por milhão de saída que aceita vídeo como entrada, então serve como piloto barato. Sem benchmark, o ideal é testar com volume pequeno antes de escalar.