Qwen3.5 Plus custa US$ 1,56 por milhão de saída e mira o meio do tabuleiro
Lançado há dois dias pela Alibaba, o modelo aposta em contexto de um milhão de tokens e preço agressivo para brigar com Claude e GPT sem entrar na faixa premium.
O que está circulando
A Alibaba soltou o Qwen3.5 Plus na segunda passada, em 16 de fevereiro, e o catálogo já mostra o modelo a US$ 0,26 por milhão de tokens de entrada e US$ 1,56 por milhão de tokens de saída. É uma conta que cabe no bolso de quem roda agente ou processa documento grande — mas só faz sentido se a qualidade entregar o que o preço promete.
| Campo | Valor |
|---|---|
| Identificador | qwen/qwen3.5-plus-02-15 |
| Criador | qwen |
| Preço de entrada | US$ 0.260 / M tokens |
| Preço de saída | US$ 1.56 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+video->text |
O tabuleiro em que ele entra
Para situar o preço, vale olhar quem está na faixa acima dele. Hoje, o Claude Sonnet 4.6 da Anthropic lidera o índice de inteligência do catálogo com IQ 35,1 e cobra US$ 15 por milhão de tokens de saída — quase dez vezes o que o Qwen3.5 Plus pede pelo mesmo volume. O OpenAI o3 aparece logo abaixo, com IQ 31,1, a US$ 8 por milhão de saída. Mais perto da proposta da Alibaba, o Xiaomi MiMo-V2-Flash cobra US$ 0,30 por milhão de saída, e o Qwen3.5 397B A17B (irmão mais pesado da mesma família) sai a US$ 2,34.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
Ou seja: o Plus não está brigando pelo topo de inteligência, e provavelmente não vai estar. Está brigando pelo meio do tabuleiro, onde o critério de escolha costuma ser preço por token multiplicado por volume de uso.
O que a Alibaba está vendendo — e o que não está
O release descreve o modelo como parte da série Qwen3.5 de visão-linguagem, construída sobre uma arquitetura híbrida que combina atenção linear com mistura esparsa de especialistas. Traduzindo: é um desenho pensado para gastar menos computação por token gerado, mantendo capacidade multimodal — aceita texto, imagem e vídeo como entrada e devolve texto. A janela de contexto anunciada é de um milhão de tokens, o que permite enfiar um livro inteiro, um dump de código grande ou uma transcrição longa numa única chamada.
O que o dado não entrega: nota de inteligência, benchmark de código, benchmark agentic, velocidade de inferência, data de corte de conhecimento, número de parâmetros e até o país de origem. Sem isso, qualquer comparação de capacidade é chute. O catálogo também não publicou preço para cache de leitura, então quem depende de prompt cacheado para economizar não tem como calcular o custo total ainda.
Para quem vale — e para quem não muda nada
O Qwen3.5 Plus faz sentido para você se: roda volume alto de tarefas multimodiais com entrada grande (documentos longos, vídeos transcritos, bases de código inteiras) e o gargalo da conta é o token de saída; ou se está montando um pipeline de agente onde precisa de contexto amplo sem pagar US$ 15 por milhão como no Sonnet 4.6. Para esse perfil, a economia potencial é real — basta rodar um piloto de uma semana com seu workload real e comparar.
Não muda nada para você se: o trabalho depende de raciocínio pesado, codificação competitiva ou benchmarks agentic de ponta — aí o Claude Sonnet 4.6 e o OpenAI o3 continuam sendo a referência e o preço se justifica. Também não muda nada se você já usa o Xiaomi MiMo-V2-Flash ou o Qwen3.5 397B A17B com resultado satisfatório: o Plus é mais caro na saída que o MiMo (US$ 0,30) e mais barato que o 397B (US$ 2,34), então a decisão depende do ganho marginal de capacidade que ele entrega em relação a esses dois — e isso, por enquanto, não dá para medir só olhando a ficha.
O que fazer agora
Antes de trocar, rode o mesmo conjunto de prompts que você usa em produção contra os três modelos da faixa (MiMo-V2-Flash, Qwen3.5 Plus e Qwen3.5 397B A17B) e meça qualidade percebida e latência. Se o Plus ganhar na sua régua, a economia frente ao Sonnet 4.6 é de quase 90% por milhão de tokens de saída — dinheiro que paga outro serviço na fatura. Se perder, o MiMo a US$ 0,30 continua sendo o piso da família. E vale guardar: o catálogo tem 338 modelos listados hoje, vindos de 52 criadores, com 20 lançamentos só nos últimos 30 dias. Opção não falta — o desafio é não trocar toda semana.
Rode um piloto de uma semana com seu workload real antes de migrar; se a qualidade do Qwen3.5 Plus passar no seu critério, a economia frente ao Sonnet 4.6 chega a quase 90% por milhão de tokens de saída.
Perguntas frequentes
Quanto custa o Qwen3.5 Plus?
US$ 0,26 por milhão de tokens de entrada e US$ 1,56 por milhão de tokens de saída. O catálogo não publicou preço para cache de leitura, então quem usa prompt cacheado precisa pedir essa informação ao provedor antes de calcular o custo total.
O Qwen3.5 Plus é melhor que o Claude Sonnet 4.6?
Não há dado público de inteligência ou benchmark para o Qwen3.5 Plus nesta data, então não dá para afirmar superioridade. O Sonnet 4.6 lidera o índice do catálogo com IQ 35,1 e custa quase dez vezes mais na saída — a questão é se a diferença de capacidade justifica a diferença de preço para o seu caso.
Para que serve a janela de um milhão de tokens?
Serve para colocar documentos muito longos — livros inteiros, dumps de código grandes, transcrições longas, bases de conhecimento — numa única chamada sem precisar particionar. É o cenário onde o Qwen3.5 Plus tende a fazer mais diferença na fatura.