Gemini 3.7 Flash chega a US$ 0,375, mas não lidera custo-benefício
O novo modelo do Google combina contexto de 1 milhão de tokens com preço agressivo, enquanto versões anteriores do Gemini Flash ficam mais baratas. Para quem paga API, a conta depende mais da saída e do volume do que do anúncio de hardware.
Se você usa um modelo Flash em produção, o número que muda a decisão é US$ 0,375 por milhão de tokens de entrada. Esse é o preço do Gemini 3.7 Flash no OpenRouter. A saída custa US$ 1,875 por milhão de tokens, e a janela de contexto chega a 1.048.576 tokens.
A novidade é competitiva no preço de entrada, mas não aparece como a opção de melhor custo-benefício no índice do Artificial Analysis. Para decidir uma migração, portanto, não basta olhar o nome novo nem o tamanho do contexto: é preciso comparar o custo da saída, o desempenho da tarefa e o volume real de tokens da aplicação.
O que o Gemini 3.7 Flash entrega
O Google Gemini 3.7 Flash foi lançado em 13 de agosto de 2026. A versão padrão custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. A opção batch reduz esses valores para US$ 0,188 e US$ 0,938, respectivamente, mantendo a janela de 1.048.576 tokens.
Isso favorece aplicações que processam grandes documentos, históricos extensos ou entradas longas sem dividir tudo em várias chamadas. O benefício, porém, depende de como a aplicação gera respostas. Como a saída é cinco vezes mais cara que a entrada na versão padrão, prompts baratos não compensam respostas excessivamente longas.
O Artificial Analysis atribui ao modelo nota de 76,121 em código e 45,105 em tarefas agênticas. Não há nota de inteligência geral registrada para o Gemini 3.7 Flash nos dados disponíveis. Também não há indicação de pesos abertos: para você, isso significa dependência de uma oferta hospedada, e não uma opção para executar o modelo por conta própria.
O corte de preço é maior nos modelos antigos
O lançamento veio acompanhado de reduções em outras versões do Google. O Gemini 3.6 Flash caiu de US$ 7,50 para US$ 3,75 por milhão de tokens de saída, uma redução de 50%. A versão batch passou de US$ 3,75 para US$ 1,875.
O Google Gemini Flash Latest teve queda ainda mais forte: de US$ 7,50 para US$ 1,875, ou 75%. Esse é o ponto que pode alterar uma fatura imediatamente. Se você já usa uma variante anterior compatível com a sua integração, trocar apenas a rota de preço pode produzir economia sem exigir uma migração completa para o Gemini 3.7 Flash.
Os preços listados no OpenRouter também mostram mudanças em modelos de outros fornecedores, mas há registros conflitantes no mesmo dia. O GLM 5.2 aparece tanto subindo de US$ 1,54 para US$ 3,15 quanto caindo de US$ 3,15 para US$ 1,54. O Kimi K2.6 aparece em movimentos de US$ 2,44 para US$ 4 e de US$ 4 para US$ 2,36. O Qwen3.5 397B A17B também aparece subindo de US$ 3 para US$ 3,60 e depois caindo para US$ 3.
Essa divergência impede tratar cada registro como uma trajetória única de preço. Antes de trocar um modelo por outro, confira o valor vigente na rota específica usada pela aplicação.
O novo Flash não é o campeão de valor
No ranking de melhor custo-benefício do Artificial Analysis, o DeepSeek V4 Flash 0731 aparece com nota de inteligência de 51,8 e preço de US$ 0,175 por milhão de tokens. O DeepSeek V4 Pro 0813 aparece com nota 53 e preço de US$ 0,544. O GPT-5.6 Luna, em uma configuração, registra nota 52,3 por US$ 0,45.
Essas comparações não provam que o Gemini 3.7 Flash seja pior para toda tarefa. Elas mostram que o preço de entrada do Google não basta para colocá-lo no topo. O modelo pode fazer mais sentido quando a janela de contexto é decisiva, quando a compatibilidade com o ecossistema Google reduz trabalho ou quando os resultados em código atendem ao caso de uso.
A liderança de inteligência continua com o Claude Opus 5, que registra nota 63,1 por US$ 10 por milhão de tokens no Artificial Analysis. O Grok 4.6 aparece com nota 60,9 por US$ 3. A diferença de preço mostra por que comparar apenas o modelo mais barato pode ser um erro: o custo de corrigir respostas ruins também entra na conta, ainda que não apareça na tabela da API.
E a expansão para celulares?
A pauta sobre a expansão móvel do Google, originada pelo vídeo de Paula Bernardes (“Google Just Turned Your Phone Into an AI That Lives With You”), associa o lançamento à linha Pixel 11 e a uma base de 1 bilhão de usuários ativos. Esses dois pontos não são confirmados pelos dados de preços e benchmarks disponíveis aqui.
O que é verificável para quem desenvolve é a expansão do catálogo de modelos: o índice registra 547 modelos de 67 criadores. O hardware pode aumentar a distribuição do Gemini, mas não altera automaticamente o preço da API, a nota de código ou o custo por chamada.
Se você usa Gemini em produção, a ação prática é testar o 3.7 Flash contra o modelo atual com o seu tráfego real e comparar separadamente entrada, saída e batch; a troca só vale a pena se a economia sobreviver ao custo das respostas e à qualidade exigida pela aplicação.
Para reduzir a fatura, compare o Gemini 3.7 Flash com as versões antigas já integradas e escolha pelo custo total de entrada e saída, não pelo contexto de 1 milhão de tokens.
Perguntas frequentes
Quanto custa o Gemini 3.7 Flash na API?
No OpenRouter, o Gemini 3.7 Flash custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. A versão batch custa US$ 0,188 e US$ 0,938, respectivamente.
Qual é o tamanho do contexto do Gemini 3.7 Flash?
A janela de contexto tem 1.048.576 tokens, ou cerca de 1 milhão de tokens. A mesma capacidade aparece na versão batch.
O Gemini 3.7 Flash é o modelo com melhor custo-benefício?
Não segundo o ranking do Artificial Analysis disponível em 13 de agosto de 2026. O DeepSeek V4 Flash 0731 aparece com nota de inteligência de 51,8 e preço de US$ 0,175 por milhão de tokens, enquanto o Gemini 3.7 Flash não tem nota de inteligência registrada.
Fontes
- Google Just Turned Your Phone Into an AI That Lives With You Paula Bernardes · vídeo