FalaVIP IA o que os modelos custam,
medido todo dia
Preços

Qwen sobe 279%, enquanto Meta e DeepSeek cortam 50% no batch

A tabela de preços do OpenRouter mostra aumentos fortes em modelos da Qwen e da IBM, mas também abre espaço para economizar em cargas assíncronas com Meta Muse Glimmer e DeepSeek V4 Pro.

Redação FalaVIP IA 3 min de leitura
279,2%alta do Qwen3 14B
66,7%alta do IBM Granite 4.2 8B
50%corte no preço batch do Meta e do DeepSeek

Se você usa modelos em produção, a mudança mais importante desta rodada não é um lançamento: é a fatura. O Qwen3 14B passou de US$ 0,24 para US$ 0,91 por milhão de tokens de saída no OpenRouter, alta de 279,2%. O IBM Granite 4.2 8B subiu de US$ 0,15 para US$ 0,25, avanço de 66,7%.

Ao mesmo tempo, o modo batch do Meta Muse Glimmer 30B caiu de US$ 1,50 para US$ 0,75 por milhão de tokens de saída. O DeepSeek V4 Pro 0813 em batch recuou de US$ 3,96 para US$ 1,98. Nos dois casos, o corte foi de 50%.

A leitura prática é direta: cargas interativas ficaram mais expostas a aumentos, enquanto tarefas que aceitam processamento assíncrono ganharam uma alternativa mais barata.

Qwen concentra o maior impacto

O aumento do Qwen3 14B é o ponto fora da curva. Um fluxo que consumia US$ 240 por bilhão de tokens de saída, usando o preço anterior como referência, passaria a custar US$ 910 no novo valor. A diferença aparece antes mesmo de considerar infraestrutura, retries ou custos de entrada.

O reajuste também alcançou modelos maiores da família. O Qwen3 235B A22B Instruct 2507 subiu de US$ 0,55 para US$ 0,88 por milhão de tokens de saída, alta de 60%. Já o Qwen3.5 397B A17B passou de US$ 2,34 para US$ 3,50, aumento de 49,6%.

Para quem escolheu Qwen por preço, a premissa precisa ser reavaliada. O aumento do 14B é especialmente relevante em classificação, extração estruturada e geração de respostas curtas em alto volume. Mesmo quando o modelo continua tecnicamente adequado, a margem operacional pode desaparecer.

IBM também encarece, mas em escala menor

O Granite 4.2 8B passou de US$ 0,15 para US$ 0,25 por milhão de tokens de saída. A alta de 66,7% pesa menos em valor absoluto do que a do Qwen3 14B, mas altera o cálculo para aplicações que dependem de um modelo pequeno e barato.

A diferença entre os percentuais importa. A formulação de que IBM e Qwen teriam subido “até 60%” não bate com os preços listados no OpenRouter: o Granite avançou 66,7%, e o Qwen3 14B, 279,2%. Para a conta, o preço final é mais importante do que a faixa anunciada.

A Tencent também elevou o Hy3 de US$ 0,33 para US$ 0,528 por milhão de tokens de saída, alta de 60%. A rodada, portanto, não se limita a uma única família de modelos.

Batch vira a rota de economia

O corte do Meta Muse Glimmer 30B vale para a variante batch. O preço caiu de US$ 1,50 para US$ 0,75 por milhão de tokens de saída. O DeepSeek V4 Pro 0813 batch teve o mesmo percentual de redução, de US$ 3,96 para US$ 1,98.

Isso favorece tarefas sem resposta imediata: processamento de documentos, enriquecimento de bases, avaliações internas e geração de lotes. Se a aplicação consegue acumular solicitações e tolerar espera, a troca para batch pode reduzir o custo diretamente.

Não significa que toda chamada ao DeepSeek ficou mais barata. A mesma listagem registra o DeepSeek V4 Pro 0813 fora do batch passando de US$ 1,98 para US$ 3,148, uma alta de 59%. Também há uma alteração posterior na mesma identificação, com queda de US$ 3,148 para US$ 1,738, registrada como redução de 44,8%.

Essa divergência exige cuidado na migração. Antes de alterar o roteador, confira o identificador exato, a variante e o modo de execução. “DeepSeek V4 Pro” não descreve sozinho uma tarifa única.

Quem ganha e quem não muda nada

A rodada beneficia quem consegue separar tráfego síncrono de cargas pesadas. Para esse perfil, Meta Muse Glimmer 30B batch e DeepSeek V4 Pro 0813 batch oferecem uma oportunidade concreta de reduzir a fatura em tarefas que não exigem retorno imediato.

Também vale para equipes que mantêm filas de processamento e conseguem medir custo por lote. O ganho não vem apenas de trocar o modelo: depende de enviar o trabalho pela variante batch correta.

Para quem usa Qwen3 14B, Granite 4.2 8B, Hy3 ou Qwen3.5 397B A17B em produção, a mudança é negativa e imediata. Já quem não usa esses modelos, não usa DeepSeek V4 Pro 0813 ou não tem cargas compatíveis com batch não deve esperar redução automática.

A decisão de hoje é revisar o roteamento por tipo de tarefa, não apenas escolher o modelo com a menor tarifa nominal. O custo de produção agora depende tanto da variante quanto do momento em que a requisição é processada.

Em uma frase

Se a carga puder esperar, migre tarefas assíncronas para batch; se usar Qwen ou Granite em alto volume, reavalie o orçamento antes da próxima fatura.

Perguntas frequentes

Quanto subiu o preço do Qwen3 14B na API?

O preço passou de US$ 0,24 para US$ 0,91 por milhão de tokens de saída no OpenRouter. Isso representa uma alta de 279,2%.

Quais modelos ficaram 50% mais baratos no batch?

O Meta Muse Glimmer 30B batch caiu de US$ 1,50 para US$ 0,75 por milhão de tokens de saída. O DeepSeek V4 Pro 0813 batch caiu de US$ 3,96 para US$ 1,98.

O DeepSeek V4 Pro ficou mais barato ou mais caro?

Depende da variante e do registro de preço. O V4 Pro 0813 batch caiu 50%, enquanto a versão sem batch aparece com alta de 59% em uma alteração e queda de 44,8% em outra.

Leia também