FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Qwen coloca visão de 235B no catálogo por US$ 4,40 por milhão de saída

Versão Thinking do Qwen3-VL estreia multimodal raciocinante a metade do preço do o3, mas sem nota de inteligência ainda medida

Redação FalaVIP IA 3 min de leitura
US$ 4,40por milhão de tokens de saída do Qwen3-VL Thinking
131.072tokens de contexto
US$ 8,00por milhão de tokens de saída do OpenAI o3

O que muda na prateleira hoje

A Qwen jogou quatro modelos no catálogo em um único dia, mas o que merece sua atenção é o Qwen3-VL-235B-A22B Thinking: um multimodal de 235 bilhões de parâmetros pensado para raciocinar sobre imagem e vídeo, não só descrevê-los. O preço de saída é US$ 4 por milhão de tokens — exatamente metade do que a OpenAI cobra pelo o3, o modelo que lidera o índice de inteligência hoje.

Preço de saída (US$ por milhão de tokens)
Qwen3 VL 235B A22B Thinking4o38gpt-oss-120b0,17Qwen3 Next 80B A3B Thinking1,2US$/M
Fonte: OpenRouter

A conta fica mais interessante quando você olha o pacote completo. A versão Instruct do mesmo VL 235B sai por US$ 1,90 por milhão de saída, o Qwen3 Max por US$ 3,90 e o Qwen3 Coder Plus por US$ 3,25. É uma família inteira aparecendo de uma vez, com a versão Thinking claramente posicionada como o topo da linha multimodal.

Ficha técnica — Qwen3 VL 235B A22B Thinking
CampoValor
Identificadorqwen/qwen3-vl-235b-a22b-thinking
Criadorqwen
Preço de entradaUS$ 0.400 / M tokens
Preço de saídaUS$ 4.00 / M tokens
Janela de contexto131k
Modalidadetext+image->text

O que "Thinking" quer dizer aqui

Pensa no Thinking como o modo "mostra a conta" do modelo. Em vez de cuspir a resposta, ele gasta tokens extras percorrendo o raciocínio passo a passo antes de chegar no veredito. Em problemas de STEM e matemática isso normalmente paga o preço extra em latência e tokens com respostas mais certeiras — é o mesmo padrão que o o3 e o Qwen3 Next 80B Thinking já seguem.

A diferença é que aqui o Thinking também enxerga. Você manda uma imagem de um diagrama elétrico ou um frame de vídeo e o modelo percorre o caminho lógico sobre o que está vendo. Para quem constrói agentes que precisam olhar um screenshot, ler um gráfico ou inspecionar uma UI, é exatamente esse o caso de uso.

Onde ele se encaixa no tabuleiro

O índice de inteligência atual tem o o3 disparado na frente, com IQ de 31,096, seguido do gpt-oss-120b (24,126) e do próprio Qwen3 Next 80B Thinking (16,867). O Qwen3-VL Thinking ainda não tem nota publicada no índice — então qualquer comparação direta de capacidade cognitiva hoje é chute.

Índice de inteligência (Artificial Analysis)
o331,1gpt-oss-120b24,1Qwen3 Next 80B A3B Thinking16,9índice
Fonte: Artificial Analysis

O que dá para comparar de verdade é o custo. Pelo preço de saída, o multimodal da Qwen fica entre o gpt-oss-120b (US$ 0,17, mas sem visão) e o o3 (US$ 8). É um meio-termo que faz sentido se você precisa de visão e não quer pagar o topo do topo da OpenAI.

Inteligência × preço de saída
o3gpt-oss-120bQwen3 Next 80B A3B ThinkingUS$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Qwen3 VL 235B A22B Thinking (o novo)0.44131k
o331.128200k
gpt-oss-120b24.10.0370.17131k
Qwen3 Next 80B A3B Thinking16.90.151.2262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale — e para quem não muda nada

Vale para você se está montando um pipeline multimodal com raciocínio — análise de screenshots, interpretação de gráficos, agentes que leem UI — e o o3 estava caro demais para o volume que você roda. O contexto de 131 mil tokens comporta documentos visuais inteiros sem malabarismo.

Não muda nada se você já está satisfeito com o gpt-oss-120b em texto puro e não precisa de visão, ou se o seu caso é multimodal simples (legenda de imagem, OCR) onde a versão Instruct a US$ 1,90 já resolve sem o overhead do Thinking.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Qwen3 Coder Plus0.653.251M
Qwen3 Max0.783.9262k
Qwen3 VL 235B A22B Instruct0.211.9262k

A linha completa do dia

A Qwen não soltou só o Thinking. Vieram juntos o Qwen3-VL Instruct (mesmo porte, sem raciocínio, mais barato), o Qwen3 Max (texto puro, 262 mil de contexto) e o Qwen3 Coder Plus (um milhão de contexto, voltado a código). É um pacote "cobre todos os buracos" — visão raciocinante, visão barata, texto geral, código.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 237 modelos disponíveis no catálogo nesta data.

A leitura prática: se você esperava um concorrente direto do o3 em raciocínio puro, ainda não é — falta benchmark. Se você esperava um multimodal que não sangra o orçamento, é exatamente o que chegou.

Em uma frase

Teste o Qwen3-VL Thinking em tarefas de visão com raciocínio onde o o3 pesa no custo; ignore se multimodal sem lógica for suficiente.

Perguntas frequentes

Quanto custa o Qwen3-VL 235B Thinking?

US$ 0,40 por milhão de tokens de entrada e US$ 4,00 por milhão de tokens de saída. Não há preço de cache publicado no catálogo.

O Qwen3-VL Thinking tem nota de inteligência?

Ainda não. O índice atual só traz o Qwen3 Next 80B Thinking (IQ 16,867) da própria Qwen; o VL Thinking foi listado hoje sem medição publicada.

Qual a diferença entre a versão Thinking e a Instruct do Qwen3-VL?

A Thinking gasta tokens extras percorrendo o raciocínio antes de responder e custa US$ 4 por milhão de saída; a Instruct responde direto e sai por US$ 1,90.

Leia também