Gemini Flash dobra para US$ 3,75 e lidera alta nas APIs
O Gemini 3.7 Flash e o Gemini Flash Latest tiveram aumento de 100% no preço de saída. DeepSeek, Meta e NVIDIA reduziram tarifas, mas o alívio não compensa o impacto para aplicações de alta volumetria.
Se você usa o Gemini 3.7 Flash ou o Gemini Flash Latest em produção, o custo de saída dobrou hoje. Os dois modelos passaram de US$ 1,875 para US$ 3,75 por milhão de tokens no OpenRouter, uma alta de 100% que encabeça a lista de reajustes do catálogo em 29 de agosto de 2026.
A mudança pesa principalmente em produtos que geram muitas respostas: atendimento automatizado, sumarização de documentos, classificação em lote e aplicações com agentes. A cada milhão de tokens produzidos, a tarifa adicional é de US$ 1,875 em relação ao preço anterior. Em escala, a alteração chega diretamente à fatura da API.
O que mudou — e o que não mudou
O reajuste vale para duas entradas diferentes: Google Gemini Flash Latest, identificada como uma versão dinâmica, e Google: Gemini 3.7 Flash. Ambas chegaram ao mesmo preço de saída, US$ 3,75 por milhão de tokens.
Isso não significa que toda a família Gemini tenha ficado mais cara. A ficha do Google Gemini 2.5 Flash, por exemplo, continua listada com US$ 2,50 por milhão de tokens de saída, US$ 0,30 de entrada e contexto de 1.048.576 tokens. O Gemini 2.5 Flash Lite aparece com US$ 0,40 de saída e US$ 0,10 de entrada. Esses modelos são alternativas distintas e não aparecem entre as mudanças de preço do dia.
Também é importante separar preço de desempenho. O Artificial Analysis coloca entre os maiores índices de inteligência Claude Opus 5 com Adaptive Reasoning, Max Effort, com índice de 63,1 e preço de US$ 10 por milhão de tokens. O reajuste do Gemini não o transforma automaticamente em líder de qualidade ou de custo-benefício: os dados disponíveis não trazem uma nota de inteligência para o Gemini 3.7 Flash.
Descontos aparecem, mas em outras faixas
O mesmo catálogo registra reduções relevantes em modelos concorrentes. O DeepSeek V4 Flash 0731 caiu de US$ 0,12 para US$ 0,09 por milhão de tokens de saída, redução de 25%. O DeepSeek V4 Pro 0423 também aparece com cortes, de US$ 1,382 para US$ 1,139 em um dos registros e de US$ 1,524 para US$ 1,382 em outro.
Meta Muse Glimmer 30B caiu de US$ 1,50 para US$ 1,20, enquanto o NVIDIA Nemotron 3.5 Lightning passou de US$ 0,25 para US$ 0,20. São reduções de 20% em ambos os casos.
A lista ainda tem movimentos instáveis. O Tencent Hy3 aparece primeiro subindo de US$ 0,33 para US$ 0,528 e depois retornando a US$ 0,33. O DeepSeek V3.2 também aparece com uma alta de 5,3%, de US$ 0,38 para US$ 0,40, seguida por uma queda de 5%, de US$ 0,40 para US$ 0,38. Por isso, os 17 registros do dia não equivalem necessariamente a 17 modelos com mudanças independentes.
Para quem a conta muda
O impacto é direto para quem mantém o Gemini Flash em rotas de alto volume e depende de geração extensa. Se a aplicação produz muitos tokens de saída, o mesmo tráfego que custava US$ 1,875 por milhão agora custa US$ 3,75. O efeito é menor para workloads pequenos, testes, protótipos ou sistemas que usam o modelo sobretudo para interpretar entradas e geram respostas curtas.
Para esses casos, a tarifa de entrada também precisa entrar na comparação, mas o reajuste informado neste dia é o da saída. Trocar de modelo pode reduzir a fatura, porém exige validar qualidade, latência, limites e comportamento na aplicação. O desconto do DeepSeek V4 Flash 0731, por exemplo, coloca a saída em US$ 0,09 por milhão, mas os dados de preço não provam equivalência técnica com o Gemini 3.7 Flash.
O catálogo abre espaço para substituição
O OpenRouter lista 563 modelos de 70 criadores. No Artificial Analysis, Qwen3.8-Flash-Next aparece com índice de inteligência de 55,8 por US$ 0,23 por milhão de tokens, e GLM-5.3-Flash marca 57,5 por US$ 0,238. Esses números ajudam a localizar alternativas de custo-benefício, mas não eliminam a necessidade de testar o caso de uso.
Para uma operação que escolhe modelo apenas pelo preço, o corte do DeepSeek é a notícia positiva do dia. Para quem já depende do Gemini Flash, porém, a decisão é mais urgente: revisar o consumo de saída, recalcular a margem por requisição e comparar rotas antes que o próximo ciclo de cobrança transforme o aumento em custo fixo.
Se o Gemini Flash está em uma rota de alta volumetria, trate o reajuste de 100% como gatilho para testar alternativas e recalcular a margem imediatamente.
Perguntas frequentes
Quanto custa o Gemini 3.7 Flash no OpenRouter?
O Gemini 3.7 Flash custa US$ 3,75 por milhão de tokens de saída. O preço anterior era US$ 1,875, portanto o reajuste foi de 100%.
Qual modelo ficou mais barato entre os principais reajustes?
O DeepSeek V4 Flash 0731 caiu para US$ 0,09 por milhão de tokens de saída, ante US$ 0,12. Meta Muse Glimmer 30B e NVIDIA Nemotron 3.5 Lightning também tiveram reduções de 20%.
O aumento vale para todos os modelos Gemini?
Não. O reajuste informado vale para o Gemini 3.7 Flash e o Gemini Flash Latest. O Gemini 2.5 Flash aparece listado separadamente, com US$ 2,50 por milhão de tokens de saída.