FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Gemini 3.7 Flash chega a US$ 1,50 com três níveis de raciocínio

As versões low, medium e high estreiam com o mesmo preço no OpenRouter, mas entregam notas diferentes no índice do Artificial Analysis. A opção high marca 56 pontos de inteligência, abaixo dos líderes mais caros.

Redação FalaVIP IA 3 min de leitura
US$ 1,50por milhão de tokens nas versões low, medium e high
56nota de inteligência do Gemini 3.7 Flash high no Artificial Analysis
US$ 0,175por milhão de tokens do DeepSeek V4 Flash 0731 no ranking de custo-benefício

O Gemini 3.7 Flash estreia no catálogo do Artificial Analysis com uma escolha incomum para quem paga API: as versões low, medium e high custam o mesmo, US$ 1,50 por milhão de tokens, mas aparecem com notas de inteligência diferentes. Para uma aplicação em produção, isso muda a forma de testar o modelo: a decisão deixa de ser apenas qual modelo usar e passa a incluir quanta intensidade de raciocínio cada chamada precisa.

Os preços listados no OpenRouter mostram US$ 1,50 por milhão de tokens para as três configurações. Já as notas do Artificial Analysis são 50,9 para a versão low, 53,4 para a medium e 56 para a high.

O que realmente mudou

A estreia adiciona três entradas ao radar de benchmarks, não três faixas de preço. O valor cobrado permanece fixo entre low, medium e high, enquanto a intensidade de raciocínio funciona como a principal diferença observável nos dados disponíveis.

Isso cria espaço para separar tarefas dentro do mesmo produto. Uma rota de atendimento, classificação ou extração pode ser testada com a configuração low. Fluxos que exigem mais análise podem subir para medium ou high sem trocar o preço listado por milhão de tokens.

A ressalva é importante: uma nota maior no Artificial Analysis não informa, sozinha, a latência, a taxa de erro ou o custo total de uma aplicação. O gasto real também depende do volume de tokens e da proporção entre entradas e saídas. Portanto, o preço fixo facilita a comparação, mas não substitui um teste com as cargas da sua empresa.

High melhora a nota, mas não lidera o ranking

Com 56 pontos, o Gemini 3.7 Flash high fica acima da versão medium, com 53,4, e da low, com 50,9. Ainda assim, não aparece no topo de inteligência do Artificial Analysis. O Claude Opus 5 com raciocínio adaptativo e esforço máximo marca 63,1 e custa US$ 10 por milhão de tokens. O GPT-5.6 Sol, em sua configuração max, registra 60,9 a US$ 11,25, enquanto o Grok 4.6 high também alcança 60,9 por US$ 3.

A comparação mais próxima em preço e capacidade é menos óbvia. O Qwen3.8 2.4T A95B estreia com nota 57,7, acima do Gemini high, mas custa US$ 3 por milhão de tokens no índice. O Gemini, portanto, não vence em nota absoluta. A proposta está na combinação de uma nota competitiva com três níveis de raciocínio pelo mesmo preço.

Custo-benefício não significa preço mínimo

O Gemini 3.7 Flash medium aparece entre as opções de melhor custo-benefício do Artificial Analysis, com nota 53,4 e preço de US$ 1,50. A versão high também entra nessa lista, com 56 pontos pelo mesmo valor.

Mas o ranking tem alternativas muito mais baratas. O DeepSeek V4 Flash 0731 com raciocínio e esforço máximo aparece com nota 51,8 por US$ 0,175 por milhão de tokens. O GPT-5.6 Luna max marca 52,3 por US$ 0,45. Se a prioridade for reduzir a fatura, o Gemini não é a primeira opção apresentada pelos dados.

O que ele oferece é outra relação entre custo e controle. Você pode escolher low, medium ou high sem que o preço listado mude. Para equipes que preferem padronizar o orçamento e ajustar a qualidade por configuração, essa previsibilidade pode valer mais do que buscar a menor tarifa disponível.

Para quem vale a troca

Se você usa o modelo em produção e precisa de respostas com diferentes níveis de análise, o Gemini 3.7 Flash merece um teste A/B entre as três configurações. A versão low pode servir como referência de custo dentro da família; medium e high permitem medir se a melhora de nota aparece nas tarefas que realmente afetam o produto.

A novidade pesa menos para quem já opera com modelos abaixo de US$ 0,45 por milhão de tokens ou precisa do líder absoluto em inteligência. Também não há, nos dados, uma informação de janela de contexto ou de latência específica para o Gemini 3.7 Flash que permita justificar uma migração por esses critérios.

Na prática, a estreia faz mais sentido como uma camada de roteamento: reserve high para casos difíceis, use medium quando a qualidade adicional pagar a conta e mantenha low em tarefas simples. O preço é igual, mas a escolha de configuração ainda pode decidir se o orçamento compra qualidade útil ou raciocínio excedente.

Em uma frase

O Gemini 3.7 Flash vale testar como uma família de três intensidades pelo mesmo preço, mas não como substituto automático das opções mais baratas ou dos líderes de inteligência.

Perguntas frequentes

Quanto custa o Gemini 3.7 Flash na API?

As versões low, medium e high aparecem no OpenRouter por US$ 1,50 por milhão de tokens. O preço listado é o mesmo para os três níveis.

Qual versão do Gemini 3.7 Flash tem a maior nota?

A versão high marca 56 pontos de inteligência no Artificial Analysis. A medium registra 53,4 e a low, 50,9.

O Gemini 3.7 Flash é o modelo mais barato?

Não. O ranking de custo-benefício do Artificial Analysis inclui o DeepSeek V4 Flash 0731 por US$ 0,175 por milhão de tokens e o GPT-5.6 Luna max por US$ 0,45.

Leia também