FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

DeepSeek V3.1 cai 42%, mas Gemini 3.7 Flash batch dobra

Os preços por milhão de tokens mudaram em direções opostas no OpenRouter. Para quem usa esses modelos em produção, a revisão das estimativas de custo não pode esperar.

Redação FalaVIP IA 4 min de leitura
US$ 0,95preço atual do DeepSeek V3.1 por milhão de tokens
100%alta no preço do Gemini 3.7 Flash batch
19mudanças de preço registradas no dia

Se você usa o DeepSeek V3.1 em produção, o preço listado no OpenRouter caiu de US$ 1,65 para US$ 0,95 por milhão de tokens em 2 de setembro de 2026. A redução é de 42,4%. No mesmo dia, o Google Gemini 3.7 Flash (batch) fez o movimento contrário: passou de US$ 0,938 para US$ 1,875, uma alta de 100%.

A diferença muda a conta de aplicações que processam grandes volumes. Não basta mais manter um preço fixo na planilha de custos ou assumir que a modalidade batch será sempre a alternativa mais barata. O catálogo registrou 19 mudanças de preço em um único dia, com reajustes para cima e para baixo.

A queda que favorece o DeepSeek

O DeepSeek V3.1 é o caso mais favorável para quem já tem uma integração funcionando. O preço caiu US$ 0,70 por milhão de tokens, de US$ 1,65 para US$ 0,95. Em termos relativos, a redução informada pelo OpenRouter é de 42,4%.

Na prática, a mudança reduz o custo variável de fluxos que já dependem desse modelo. Isso vale para classificação, geração de respostas, automações internas e outras tarefas em que o volume de tokens pesa mais do que a troca de modelo. A queda não prova, sozinha, que o V3.1 passou a ser a melhor opção técnica para qualquer carga. Ela apenas altera o ponto de equilíbrio financeiro.

Se o orçamento foi calculado com o valor anterior, a projeção ficou conservadora. Ainda assim, é importante atualizar a tarifa usada pelo serviço, os alertas de gasto e qualquer lógica que escolha modelos com base no preço.

O batch do Gemini ficou duas vezes mais caro

No Gemini 3.7 Flash (batch), a tarifa foi de US$ 0,938 para US$ 1,875 por milhão de tokens. O OpenRouter registra uma variação de 100%, o que significa que o preço final dobrou.

A modalidade batch costuma entrar em pipelines assíncronos, processamento de lotes e tarefas que não exigem resposta imediata. Se você escolheu essa opção esperando uma economia estrutural, o novo preço exige uma reavaliação. O ganho operacional do batch pode continuar existindo, mas a vantagem financeira diminuiu ou pode desaparecer, dependendo do desenho da aplicação.

Há uma distinção importante no catálogo: o reajuste é do Gemini 3.7 Flash (batch), enquanto o lançamento do dia é o Google Gemini 3.8 Flash e sua variante batch. O Gemini 3.8 Flash (batch) aparece com preço de US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. Portanto, não se deve substituir automaticamente o preço antigo do 3.7 pelo preço do novo 3.8 como se fossem o mesmo identificador.

O que mudou — e o que não mudou

Mudou o preço de modelos específicos. Não mudou automaticamente o contrato de custo de todo o catálogo, nem a tarifa de todas as variantes de DeepSeek ou Gemini. O próprio conjunto de alterações mostra essa dispersão: o DeepSeek V4 Pro 0813 aparece tanto com alta de 69%, de US$ 1,98 para US$ 3,346, quanto com queda de 40,8%, de US$ 3,346 para US$ 1,98, em registros distintos.

Esse tipo de registro é um alerta para quem usa nomes genéricos, aliases ou roteadores automáticos. O identificador da rota importa. Uma aplicação que aponta para uma versão nomeada não deve ser tratada como equivalente a outra versão, mesmo quando ambas aparecem sob a marca DeepSeek.

O dia também trouxe quatro lançamentos ao catálogo. O Meta Muse Spark 1.3 custa US$ 1,25 por milhão de tokens de entrada e US$ 4,25 de saída, com janela de contexto de 1.048.576 tokens. O Google Gemini 3.8 Flash custa US$ 0,75 na entrada e US$ 3,75 na saída, com a mesma janela. As variantes Contributor do Muse Spark e batch do Gemini 3.8 têm preços próprios.

Quem precisa revisar a planilha agora

A prioridade é de equipes que têm tráfego recorrente, processamento em lote ou seleção automática de modelos por custo. Para elas, uma diferença de dezenas de pontos percentuais altera o orçamento, os limites de uso e a margem por usuário.

Quem usa o DeepSeek V3.1 deve recalcular a projeção com US$ 0,95 por milhão de tokens. Quem usa o Gemini 3.7 Flash batch deve fazer o mesmo com US$ 1,875. Também vale conferir se a aplicação está usando o identificador esperado e se a medição separa tokens de entrada e de saída quando essa informação estiver disponível.

Para quem não usa esses modelos, o impacto direto é menor. A existência de 19 reajustes, porém, muda a rotina de governança: preços precisam ser tratados como configuração revisável, não como constante. Os valores do OpenRouter mostram a fatura; os índices do Artificial Analysis acrescentam a dimensão de desempenho para comparar custo e capacidade. Nesta data, o catálogo soma 571 modelos de 70 criadores.

A implicação prática é objetiva: congele o identificador do modelo, atualize as tarifas no estimador e reavalie rotas batch antes que o próximo ciclo de cobrança transforme uma mudança de catálogo em surpresa na fatura.

Em uma frase

Atualize hoje as tarifas e os identificadores das rotas: o DeepSeek V3.1 barateou, enquanto o Gemini 3.7 Flash batch dobrou de preço.

Perguntas frequentes

Quanto caiu o preço do DeepSeek V3.1?

O preço listado no OpenRouter caiu de US$ 1,65 para US$ 0,95 por milhão de tokens. A variação registrada é de -42,4%.

O Gemini 3.7 Flash batch realmente dobrou de preço?

Sim. O valor passou de US$ 0,938 para US$ 1,875 por milhão de tokens, uma alta de 100% no OpenRouter.

Gemini 3.7 Flash batch e Gemini 3.8 Flash batch são o mesmo modelo?

Não. O reajuste citado é do Gemini 3.7 Flash (batch), enquanto o Gemini 3.8 Flash (batch) aparece como um lançamento separado, com preço próprio no catálogo.

Leia também