Gemini 3.7 Flash e DeepSeek V4 Flash dobram de preço
No OpenRouter, o Gemini 3.7 Flash passou de US$ 1,875 para US$ 3,75 por milhão de tokens. A alta do DeepSeek vale para a versão 0731, enquanto outra versão do V4 Flash ficou mais barata.
Se você usa o Gemini 3.7 Flash em produção, a tarifa por milhão de tokens dobrou no OpenRouter: saiu de US$ 1,875 para US$ 3,75 em 29 de agosto. O DeepSeek V4 Flash 0731 repetiu a alta em 30 de agosto, passando de US$ 0,09 para US$ 0,18.
A mudança atinge diretamente aplicações que pagam por volume de chamadas. Chatbots, pipelines de extração, classificadores e agentes que executam muitas etapas passam a consumir mais orçamento mesmo sem qualquer alteração no código.
A conta dobrou, mas os modelos não são iguais
O número mais importante para o Gemini é US$ 3,75 por milhão de tokens. Antes, a mesma tarifa estava em US$ 1,875. Para o DeepSeek V4 Flash 0731, a nova referência é US$ 0,18, contra US$ 0,09 anteriormente.
Os preços listados no OpenRouter mostram altas de 100% nos dois casos. Isso não significa que o gasto total de toda aplicação vá dobrar automaticamente: a fatura também depende do volume de tokens e do uso efetivo de cada modelo. Mas, mantendo o mesmo tráfego e o mesmo padrão de geração, a tarifa unitária deixa de ser a mesma.
A diferença pesa de formas distintas. O Gemini já parte de um preço por milhão muito superior ao do DeepSeek. O DeepSeek continua nominalmente mais barato após a alta, mas a alteração reduz a margem de segurança de quem escolheu o modelo justamente para manter custos baixos em produção.
“DeepSeek V4 Flash dobrou” precisa de uma ressalva
O nome da família esconde uma divergência importante. A alta de 100% registrada em 30 de agosto é do DeepSeek V4 Flash 0731, com identificador próprio. Já o DeepSeek V4 Flash 0423, listado separadamente, teve reduções recentes: passou de US$ 0,166 para US$ 0,161 em 30 de agosto e de US$ 0,17 para US$ 0,166 em 29 de agosto.
Portanto, não dá para tratar todo DeepSeek V4 Flash como se tivesse dobrado de preço. Se a sua aplicação chama o identificador 0423, a mudança observada é de queda, não de alta. Se chama o 0731, a revisão é exatamente o oposto.
Essa distinção importa em integrações via API. O nome exibido no painel ou em uma documentação interna pode não ser suficiente para identificar a tarifa. O identificador completo do modelo é o que deve ser comparado com a configuração usada pela aplicação.
Outras alterações mostram um mercado instável
As duas maiores altas não foram isoladas. O Tencent Hy3 subiu 60%, de US$ 0,33 para US$ 0,528 por milhão de tokens. O Qwen3 VL 30B A3B Instruct avançou 15,4%, de US$ 0,52 para US$ 0,60.
Também houve reduções relevantes. O DeepSeek V4 Pro 0423 aparece em várias revisões e caiu de US$ 1,382 para US$ 1,139 em 29 de agosto. Em 30 de agosto, novas alterações levaram a tarifa de US$ 0,976 para US$ 0,835 e de US$ 1,139 para US$ 0,976, conforme os registros separados.
O padrão é de atualização frequente, não de uma tabela estática. Ao todo, foram registradas 20 mudanças de preço no período de dois dias, em um catálogo com 563 modelos de 70 criadores. Para quem opera com margem apertada, acompanhar apenas o lançamento do modelo não basta: a tarifa pode mudar depois que a integração já está em produção.
Há alternativas, mas preço não é equivalência
O Artificial Analysis coloca entre as opções de melhor custo-benefício o Qwen3.8-Flash-Next, com nota de inteligência de 55,8 e preço de US$ 0,23 por milhão de tokens. O GLM-5.3-Flash aparece com nota 57,5 e tarifa de US$ 0,238. Também entram na lista variantes do GPT-5.6 Luna, a US$ 0,45, e o DeepSeek V4 Flash Vision em configuração de raciocínio, a US$ 0,66.
Esses números ajudam a montar uma shortlist, mas não autorizam uma troca automática. Nota de inteligência não substitui teste com os seus prompts, formato de resposta, latência e ferramentas. Para uma aplicação simples, migrar pode fazer sentido. Para um agente com comportamento já validado, a economia pode ser anulada pelo custo de regressão e monitoramento.
A decisão prática é conferir agora o identificador chamado pela aplicação, registrar a tarifa atual no OpenRouter e colocar um alerta para novas revisões. Se o modelo for o Gemini 3.7 Flash ou o DeepSeek V4 Flash 0731, o orçamento precisa ser recalculado antes da próxima fatura.
Confira o identificador exato usado pela API e refaça o orçamento: para Gemini 3.7 Flash e DeepSeek V4 Flash 0731, a tarifa por milhão de tokens dobrou.
Perguntas frequentes
Quanto custa o Gemini 3.7 Flash no OpenRouter?
O Gemini 3.7 Flash passou a custar US$ 3,75 por milhão de tokens, contra US$ 1,875 antes da alteração registrada em 29 de agosto. A variação foi de 100%.
O DeepSeek V4 Flash dobrou de preço?
A alta de 100% vale para o DeepSeek V4 Flash 0731, que passou de US$ 0,09 para US$ 0,18 por milhão de tokens. A versão 0423 teve reduções recentes, portanto é necessário conferir o identificador completo.
Quais modelos aparecem como alternativas de custo-benefício?
O Artificial Analysis lista o Qwen3.8-Flash-Next, a US$ 0,23 por milhão de tokens, e o GLM-5.3-Flash, a US$ 0,238. Também aparecem variantes do GPT-5.6 Luna a US$ 0,45.