FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Gemini 3.1 Flash Lite cobra US$ 0,25/milhão sem nota de inteligência

Google anuncia versão GA do multimodal de alta eficiência, mas o catálogo ainda não mediu a inteligência do modelo — Xiaomi e DeepSeek saem mais barato com nota publicada.

Redação FalaVIP IA 3 min de leitura
US$ 0,25por milhão de tokens de entrada
US$ 1,50por milhão de tokens de saída
87,5%mais barato que o Pro Preview na saída

US$ 0,25 por milhão de tokens de entrada. É o que o Google está cobrando pelo Gemini 3.1 Flash Lite, anunciado hoje como o multimodal mais barato da casa. Só que o catálogo ainda não publicou nota de inteligência para esse modelo — e sem esse número, comparar com Xiaomi e DeepSeek vira chute.

A conta da eficiência

O Flash Lite não é gratuito. Custa US$ 0,25 por milhão de tokens de entrada, US$ 1,50 por milhão na saída, e US$ 0,025 para leitura de cache. A janela de contexto é de 1.048.576 tokens — 1 milhão — e a modalidade aceita texto, imagem, arquivo, áudio e vídeo como entrada, devolvendo só texto.

Ficha técnica — Gemini 3.1 Flash Lite
CampoValor
Identificadorgoogle/gemini-3.1-flash-lite
Criadorgoogle
Preço de entradaUS$ 0.250 / M tokens
Preço de saídaUS$ 1.50 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file+audio+video->text
Leitura de cacheUS$ 0.025 / M (90% de desconto)

Em relação ao irmão maior, o Gemini 3.1 Pro Preview, a saída cai de US$ 12 para US$ 1,50 por milhão — uma redução de 87,5%. É o posicionamento clássico de "lite" do Google: abrir mão de capacidade cognitiva em troca de preço e latência.

Sem nota de inteligência, preço é promessa

Aqui mora a armadilha. O Gemini 3.1 Flash Lite chega ao catálogo sem índice de inteligência, sem score de coding, sem agentic, sem blended. Os campos estão vazios. Isso não quer dizer que o modelo é ruim — quer dizer que o catálogo ainda não mediu.

E essa ausência muda a leitura do preço. Em maio de 2026, com mais de 439 modelos no catálogo e 60 criadores, o topo de inteligência publicada é o Gemini 3.1 Pro Preview (IQ 47,738) e o GPT-5.3-Codex da OpenAI (IQ 45,512), ambos na faixa de US$ 12 a US$ 14 por milhão de saída. O Flash Lite entra entre eles em preço, mas sem nota para provar que rende.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 439 modelos disponíveis no catálogo nesta data.

Onde o "barato" do Google se posiciona

O US$ 1,50 por milhão de saída não é o chão do mercado. O Xiaomi MiMo-V2.5 cobra US$ 0,28 por milhão de saída com IQ 38,043. O MiMo-V2.5-Pro sai por US$ 0,87 com IQ 42,88. A DeepSeek V4 Pro 0423 cobra US$ 1,74 e marca IQ 45,268.

Inteligência × preço de saída
Gemini 3.1 Pro PreviewGPT-5.3-CodexDeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência

Para uma mesma faixa de preço, a chinesa DeepSeek entrega nota de inteligência mais alta que o Flash Lite pode aspirar, e a Xiaomi cobra metade do preço com nota próxima. Se o Flash Lite não render acima de IQ 42, o argumento de "eficiência" do Google cai por terra.

A versão batch é a outra metade do lançamento

Junto com o modelo padrão, o Google soltou o Gemini 3.1 Flash Lite em modo batch. Os preços caem pela metade: US$ 0,125 de entrada e US$ 0,75 de saída por milhão. Mesma janela de 1 milhão de tokens, mesma multimodalidade.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Gemini 3.1 Flash Lite (batch0.1250.751.05M

Para workloads assíncronos — processamento de filas, classificação em massa, indexação de documentos longos — o batch muda a conta. Quem roda Flash Lite padrão em alto volume consegue trocar pelo batch e cortar a fatura pela metade, desde que aceite a latência maior típica desse modo.

Para quem vale e o que fazer

Vale para quem já roda a família Gemini em produção e quer baixar custo sem trocar de fornecedor, mantendo 1 milhão de contexto e suporte total a multimodal. Também vale para workloads onde o Google cumpre requisitos contratuais ou de região que outros não cumprem.

Não muda nada para quem precisa de nota de inteligência comprovada antes de adotar — e esse é o principal comprador corporativo. Tampouco muda para quem busca o menor preço absoluto: Xiaomi e DeepSeek seguem mais baratos com benchmarks publicados.

A ação concreta: se você já roda Flash Lite ou Pro em produção, teste o novo modelo com seu próprio conjunto de avaliação antes de migrar de fornecedor. Se roda em volume assíncrono, o batch a US$ 0,75 por milhão de saída é a peça que vale prototipar primeiro. E peça ao Google a nota de inteligência — o catálogo ainda não tem.

Em uma frase

Flash Lite entra barato no multimodal do Google, mas sem IQ publicado: teste com sua própria avaliação antes de migrar e considere o batch a US$ 0,75/M para volume assíncrono.

Perguntas frequentes

O Gemini 3.1 Flash Lite é gratuito?

Não. É o modelo 'lite' pago do Google, a US$ 0,25 por milhão de tokens de entrada e US$ 1,50 por milhão de saída. O Google costuma oferecer tiers gratuitos separados, mas não é o caso deste lançamento.

Como o Flash Lite se compara com a DeepSeek V4 Pro em preço?

O Flash Lite cobra US$ 1,50 por milhão de saída; a DeepSeek V4 Pro cobra US$ 1,74. O Flash Lite é um pouco mais barato, mas a DeepSeek já tem nota de inteligência publicada (IQ 45,268) e o Flash Lite ainda não foi medido pelo catálogo.

Vale a pena esperar os benchmarks do Flash Lite?

Se a nota de inteligência é critério de compra na sua empresa, sim. O catálogo ainda não mediu o modelo, e rivais como Xiaomi MiMo e DeepSeek V4 Pro já têm notas publicadas cobrando menos.

Leia também