FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Qwen3 235B ficou 5,5 vezes mais caro em um único ajuste

Preço de saída saltou de US$ 0,10 para US$ 0,55 por milhão de tokens. No dia, foram 4 reajustes para cima e apenas 1 para baixo.

Redação FalaVIP IA 3 min de leitura
US$ 0,55novo preço por milhão de tokens de saída do Qwen3 235B
5,5xvariação no preço de saída do Qwen3 235B
-69%queda no preço de entrada do Qwen2.5 VL 72B

Qwen3 235B ficou 5,5 vezes mais caro em um único ajuste

Se você roda pipeline em cima do Qwen3 235B A22B Instruct 2507, abre o dashboard de custos antes de continuar lendo. O preço de saída do modelo saltou de US$ 0,10 para US$ 0,55 por milhão de tokens entre ontem e hoje — variação de 5,5 vezes, o maior reajuste isolado do dia em um catálogo que passou de 500 modelos ativos.

E o pior detalhe: o preço de entrada não mexeu. Continua em US$ 0,09 por milhão. Isso transforma o Qwen3 235B em um modelo com perfil de custo completamente diferente dependendo do caso de uso. Quem usava para classificação, extração ou tarefas com muito input e pouca resposta mal vai sentir. Mas quem roda geração longa, agentes ou RAG com resposta extensa — esse público vai ver a fatura mudar de figura.

Variação do preço de saída (%)
Qwen3 235B A22B Instruct 250450Qwen2.5 VL 72B Instruct-25Llama 4 Maverick33GLM 5.220GLM 4.61%

O saldo do dia: 4 altas, 1 corte

O reajuste do Qwen3 não veio sozinho. No mesmo dia, três outros modelos subiram e apenas um caiu. O saldo é de quatro altas contra um único corte — um dia claramente desfavorável para quem paga a conta.

A Meta reajustou o Llama 4 Maverick em 33% nos dois lados: entrada de US$ 0,15 para US$ 0,20, saída de US$ 0,60 para US$ 0,80. A Z.ai fez o mesmo com o GLM 5.2, subindo 20% em ambas as pontas — entrada de US$ 0,35 para US$ 0,42; saída de US$ 1,10 para US$ 1,32. O GLM 4.6 teve um aceno simbólico de 0,6% na saída (de US$ 1,74 para US$ 1,75) — quase um arredondamento, mas tecnicamente é uma alta.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
Qwen3 235B A22B Instruct 2500.10.55+450%
Qwen2.5 VL 72B Instruct10.75-25%
Llama 4 Maverick0.60.8+33%
GLM 5.21.11.32+20%
GLM 4.61.741.75+1%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Três das quatro altas vieram de modelos chineses (Qwen e Z.ai), com a Meta completando o grupo. Nenhum modelo top de laboratório americano mexeu hoje. Pode ser ruído, pode ser o início de um movimento de reposicionamento de preço entre fornecedores asiáticos — mas com cinco mudanças num único dia, é cedo para falar em tendência.

A única boa notícia: Qwen2.5 VL 72B

O Qwen2.5 VL 72B Instruct é multimodal — lê imagem e entende vídeo — e ficou mais barato nos dois lados. Entrada caiu de US$ 0,80 para US$ 0,25 (queda de 69%). Saída caiu de US$ 1,00 para US$ 0,75 (25% mais barato). Para quem processa volume de imagem, é o único alívio real do dia.

Onde isso deixa quem escolhe modelo

O topo do mercado em inteligência continua o mesmo. Claude Fable 5 lidera com IQ 62,073 e cobra US$ 50 por milhão de tokens de saída — quase cem vezes mais caro que o Qwen3 235B reajustado. GPT-5.6 Sol vem logo atrás (IQ 60,93) a US$ 10/M. Grok 4.5 e Claude Sonnet 5 fecham o top 5.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GPT-5.6 Sol60.910
GPT-5.6 Terra56.612
Grok 4.555.86
Claude Sonnet 555.310
Entre os 502 modelos disponíveis no catálogo nesta data.

Na ponta barata, quem precisa de IQ acima de 45 sem estourar o orçamento tem três opções estáveis: MiniMax M3 (IQ 45,4, US$ 1,20/M saída), GPT-5.6 Luna (IQ 52,3, US$ 1,20/M) e DeepSeek V4 Pro 0423 (IQ 45,3, US$ 1,74/M). Nenhum dos três mexeu hoje — o que é, por si só, uma informação útil: se você já está nessa faixa, não precisa se preocupar com o reajuste.

O que fazer na segunda-feira

Se você tem o Qwen3 235B em produção, a primeira pergunta é: quanto do seu custo vem de output? Se a resposta for "a maior parte", vale testar o DeepSeek V4 Pro ou o MiniMax M3 como substituto — ambos na mesma faixa de IQ por uma fração do novo preço. Se o uso era majoritariamente input, o reajuste mal aparece na fatura e não há motivo para trocar.

E se você estava de olho no Qwen2.5 VL 72B para um projeto de visão, hoje é um bom dia para começar.

Em uma frase

Calcule quanto do seu custo com Qwen3 235B vem de output — se for a maior parte, migre para DeepSeek V4 Pro ou MiniMax M3 antes do fim do mês; se for majoritariamente input, o reajuste mal aparece na fatura.

Perguntas frequentes

O que aconteceu com o preço do Qwen3 235B hoje?

O preço de saída subiu de US$ 0,10 para US$ 0,55 por milhão de tokens — variação de 5,5 vezes. O preço de entrada ficou parado em US$ 0,09, então o impacto depende do seu mix de input versus output.

Algum modelo ficou mais barato no dia?

Sim, o Qwen2.5 VL 72B Instruct (multimodal) caiu 69% no input (de US$ 0,80 para US$ 0,25) e 25% no output (de US$ 1,00 para US$ 0,75). Foi o único corte entre as cinco mudanças do dia.

Quais modelos não mudaram de preço?

Os cinco do top em inteligência (Claude Fable 5, GPT-5.6 Sol, GPT-5.6 Terra, Grok 4.5, Claude Sonnet 5) e os três mais baratos acima de IQ 45 (MiniMax M3, GPT-5.6 Luna, DeepSeek V4 Pro 0423) ficaram exatamente onde estavam.

Leia também