Qwen3 235B ficou 5,5 vezes mais caro em um único ajuste
Preço de saída saltou de US$ 0,10 para US$ 0,55 por milhão de tokens. No dia, foram 4 reajustes para cima e apenas 1 para baixo.
Qwen3 235B ficou 5,5 vezes mais caro em um único ajuste
Se você roda pipeline em cima do Qwen3 235B A22B Instruct 2507, abre o dashboard de custos antes de continuar lendo. O preço de saída do modelo saltou de US$ 0,10 para US$ 0,55 por milhão de tokens entre ontem e hoje — variação de 5,5 vezes, o maior reajuste isolado do dia em um catálogo que passou de 500 modelos ativos.
E o pior detalhe: o preço de entrada não mexeu. Continua em US$ 0,09 por milhão. Isso transforma o Qwen3 235B em um modelo com perfil de custo completamente diferente dependendo do caso de uso. Quem usava para classificação, extração ou tarefas com muito input e pouca resposta mal vai sentir. Mas quem roda geração longa, agentes ou RAG com resposta extensa — esse público vai ver a fatura mudar de figura.
O saldo do dia: 4 altas, 1 corte
O reajuste do Qwen3 não veio sozinho. No mesmo dia, três outros modelos subiram e apenas um caiu. O saldo é de quatro altas contra um único corte — um dia claramente desfavorável para quem paga a conta.
A Meta reajustou o Llama 4 Maverick em 33% nos dois lados: entrada de US$ 0,15 para US$ 0,20, saída de US$ 0,60 para US$ 0,80. A Z.ai fez o mesmo com o GLM 5.2, subindo 20% em ambas as pontas — entrada de US$ 0,35 para US$ 0,42; saída de US$ 1,10 para US$ 1,32. O GLM 4.6 teve um aceno simbólico de 0,6% na saída (de US$ 1,74 para US$ 1,75) — quase um arredondamento, mas tecnicamente é uma alta.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| Qwen3 235B A22B Instruct 250 | 0.1 | 0.55 | +450% |
| Qwen2.5 VL 72B Instruct | 1 | 0.75 | -25% |
| Llama 4 Maverick | 0.6 | 0.8 | +33% |
| GLM 5.2 | 1.1 | 1.32 | +20% |
| GLM 4.6 | 1.74 | 1.75 | +1% |
Três das quatro altas vieram de modelos chineses (Qwen e Z.ai), com a Meta completando o grupo. Nenhum modelo top de laboratório americano mexeu hoje. Pode ser ruído, pode ser o início de um movimento de reposicionamento de preço entre fornecedores asiáticos — mas com cinco mudanças num único dia, é cedo para falar em tendência.
A única boa notícia: Qwen2.5 VL 72B
O Qwen2.5 VL 72B Instruct é multimodal — lê imagem e entende vídeo — e ficou mais barato nos dois lados. Entrada caiu de US$ 0,80 para US$ 0,25 (queda de 69%). Saída caiu de US$ 1,00 para US$ 0,75 (25% mais barato). Para quem processa volume de imagem, é o único alívio real do dia.
Onde isso deixa quem escolhe modelo
O topo do mercado em inteligência continua o mesmo. Claude Fable 5 lidera com IQ 62,073 e cobra US$ 50 por milhão de tokens de saída — quase cem vezes mais caro que o Qwen3 235B reajustado. GPT-5.6 Sol vem logo atrás (IQ 60,93) a US$ 10/M. Grok 4.5 e Claude Sonnet 5 fecham o top 5.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| GPT-5.6 Terra | 56.6 | 12 |
| Grok 4.5 | 55.8 | 6 |
| Claude Sonnet 5 | 55.3 | 10 |
Na ponta barata, quem precisa de IQ acima de 45 sem estourar o orçamento tem três opções estáveis: MiniMax M3 (IQ 45,4, US$ 1,20/M saída), GPT-5.6 Luna (IQ 52,3, US$ 1,20/M) e DeepSeek V4 Pro 0423 (IQ 45,3, US$ 1,74/M). Nenhum dos três mexeu hoje — o que é, por si só, uma informação útil: se você já está nessa faixa, não precisa se preocupar com o reajuste.
O que fazer na segunda-feira
Se você tem o Qwen3 235B em produção, a primeira pergunta é: quanto do seu custo vem de output? Se a resposta for "a maior parte", vale testar o DeepSeek V4 Pro ou o MiniMax M3 como substituto — ambos na mesma faixa de IQ por uma fração do novo preço. Se o uso era majoritariamente input, o reajuste mal aparece na fatura e não há motivo para trocar.
E se você estava de olho no Qwen2.5 VL 72B para um projeto de visão, hoje é um bom dia para começar.
Calcule quanto do seu custo com Qwen3 235B vem de output — se for a maior parte, migre para DeepSeek V4 Pro ou MiniMax M3 antes do fim do mês; se for majoritariamente input, o reajuste mal aparece na fatura.
Perguntas frequentes
O que aconteceu com o preço do Qwen3 235B hoje?
O preço de saída subiu de US$ 0,10 para US$ 0,55 por milhão de tokens — variação de 5,5 vezes. O preço de entrada ficou parado em US$ 0,09, então o impacto depende do seu mix de input versus output.
Algum modelo ficou mais barato no dia?
Sim, o Qwen2.5 VL 72B Instruct (multimodal) caiu 69% no input (de US$ 0,80 para US$ 0,25) e 25% no output (de US$ 1,00 para US$ 0,75). Foi o único corte entre as cinco mudanças do dia.
Quais modelos não mudaram de preço?
Os cinco do top em inteligência (Claude Fable 5, GPT-5.6 Sol, GPT-5.6 Terra, Grok 4.5, Claude Sonnet 5) e os três mais baratos acima de IQ 45 (MiniMax M3, GPT-5.6 Luna, DeepSeek V4 Pro 0423) ficaram exatamente onde estavam.