FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Gemini 3.7 Flash chega a US$ 0,375, mas não lidera custo-benefício

O novo modelo do Google combina contexto de 1 milhão de tokens com preço agressivo, enquanto versões anteriores do Gemini Flash ficam mais baratas. Para quem paga API, a conta depende mais da saída e do volume do que do anúncio de hardware.

Redação FalaVIP IA 4 min de leitura
US$ 0,375por milhão de tokens de entrada
US$ 1,875por milhão de tokens de saída
1.048.576tokens na janela de contexto

Se você usa um modelo Flash em produção, o número que muda a decisão é US$ 0,375 por milhão de tokens de entrada. Esse é o preço do Gemini 3.7 Flash no OpenRouter. A saída custa US$ 1,875 por milhão de tokens, e a janela de contexto chega a 1.048.576 tokens.

A novidade é competitiva no preço de entrada, mas não aparece como a opção de melhor custo-benefício no índice do Artificial Analysis. Para decidir uma migração, portanto, não basta olhar o nome novo nem o tamanho do contexto: é preciso comparar o custo da saída, o desempenho da tarefa e o volume real de tokens da aplicação.

O que o Gemini 3.7 Flash entrega

O Google Gemini 3.7 Flash foi lançado em 13 de agosto de 2026. A versão padrão custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. A opção batch reduz esses valores para US$ 0,188 e US$ 0,938, respectivamente, mantendo a janela de 1.048.576 tokens.

Isso favorece aplicações que processam grandes documentos, históricos extensos ou entradas longas sem dividir tudo em várias chamadas. O benefício, porém, depende de como a aplicação gera respostas. Como a saída é cinco vezes mais cara que a entrada na versão padrão, prompts baratos não compensam respostas excessivamente longas.

O Artificial Analysis atribui ao modelo nota de 76,121 em código e 45,105 em tarefas agênticas. Não há nota de inteligência geral registrada para o Gemini 3.7 Flash nos dados disponíveis. Também não há indicação de pesos abertos: para você, isso significa dependência de uma oferta hospedada, e não uma opção para executar o modelo por conta própria.

O corte de preço é maior nos modelos antigos

O lançamento veio acompanhado de reduções em outras versões do Google. O Gemini 3.6 Flash caiu de US$ 7,50 para US$ 3,75 por milhão de tokens de saída, uma redução de 50%. A versão batch passou de US$ 3,75 para US$ 1,875.

O Google Gemini Flash Latest teve queda ainda mais forte: de US$ 7,50 para US$ 1,875, ou 75%. Esse é o ponto que pode alterar uma fatura imediatamente. Se você já usa uma variante anterior compatível com a sua integração, trocar apenas a rota de preço pode produzir economia sem exigir uma migração completa para o Gemini 3.7 Flash.

Os preços listados no OpenRouter também mostram mudanças em modelos de outros fornecedores, mas há registros conflitantes no mesmo dia. O GLM 5.2 aparece tanto subindo de US$ 1,54 para US$ 3,15 quanto caindo de US$ 3,15 para US$ 1,54. O Kimi K2.6 aparece em movimentos de US$ 2,44 para US$ 4 e de US$ 4 para US$ 2,36. O Qwen3.5 397B A17B também aparece subindo de US$ 3 para US$ 3,60 e depois caindo para US$ 3.

Essa divergência impede tratar cada registro como uma trajetória única de preço. Antes de trocar um modelo por outro, confira o valor vigente na rota específica usada pela aplicação.

O novo Flash não é o campeão de valor

No ranking de melhor custo-benefício do Artificial Analysis, o DeepSeek V4 Flash 0731 aparece com nota de inteligência de 51,8 e preço de US$ 0,175 por milhão de tokens. O DeepSeek V4 Pro 0813 aparece com nota 53 e preço de US$ 0,544. O GPT-5.6 Luna, em uma configuração, registra nota 52,3 por US$ 0,45.

Essas comparações não provam que o Gemini 3.7 Flash seja pior para toda tarefa. Elas mostram que o preço de entrada do Google não basta para colocá-lo no topo. O modelo pode fazer mais sentido quando a janela de contexto é decisiva, quando a compatibilidade com o ecossistema Google reduz trabalho ou quando os resultados em código atendem ao caso de uso.

A liderança de inteligência continua com o Claude Opus 5, que registra nota 63,1 por US$ 10 por milhão de tokens no Artificial Analysis. O Grok 4.6 aparece com nota 60,9 por US$ 3. A diferença de preço mostra por que comparar apenas o modelo mais barato pode ser um erro: o custo de corrigir respostas ruins também entra na conta, ainda que não apareça na tabela da API.

E a expansão para celulares?

A pauta sobre a expansão móvel do Google, originada pelo vídeo de Paula Bernardes (“Google Just Turned Your Phone Into an AI That Lives With You”), associa o lançamento à linha Pixel 11 e a uma base de 1 bilhão de usuários ativos. Esses dois pontos não são confirmados pelos dados de preços e benchmarks disponíveis aqui.

O que é verificável para quem desenvolve é a expansão do catálogo de modelos: o índice registra 547 modelos de 67 criadores. O hardware pode aumentar a distribuição do Gemini, mas não altera automaticamente o preço da API, a nota de código ou o custo por chamada.

Se você usa Gemini em produção, a ação prática é testar o 3.7 Flash contra o modelo atual com o seu tráfego real e comparar separadamente entrada, saída e batch; a troca só vale a pena se a economia sobreviver ao custo das respostas e à qualidade exigida pela aplicação.

Em uma frase

Para reduzir a fatura, compare o Gemini 3.7 Flash com as versões antigas já integradas e escolha pelo custo total de entrada e saída, não pelo contexto de 1 milhão de tokens.

Perguntas frequentes

Quanto custa o Gemini 3.7 Flash na API?

No OpenRouter, o Gemini 3.7 Flash custa US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. A versão batch custa US$ 0,188 e US$ 0,938, respectivamente.

Qual é o tamanho do contexto do Gemini 3.7 Flash?

A janela de contexto tem 1.048.576 tokens, ou cerca de 1 milhão de tokens. A mesma capacidade aparece na versão batch.

O Gemini 3.7 Flash é o modelo com melhor custo-benefício?

Não segundo o ranking do Artificial Analysis disponível em 13 de agosto de 2026. O DeepSeek V4 Flash 0731 aparece com nota de inteligência de 51,8 e preço de US$ 0,175 por milhão de tokens, enquanto o Gemini 3.7 Flash não tem nota de inteligência registrada.

Fontes

Leia também