Gemini 3.1 Flash Lite cobra US$ 0,25/milhão sem nota de inteligência
Google anuncia versão GA do multimodal de alta eficiência, mas o catálogo ainda não mediu a inteligência do modelo — Xiaomi e DeepSeek saem mais barato com nota publicada.
US$ 0,25 por milhão de tokens de entrada. É o que o Google está cobrando pelo Gemini 3.1 Flash Lite, anunciado hoje como o multimodal mais barato da casa. Só que o catálogo ainda não publicou nota de inteligência para esse modelo — e sem esse número, comparar com Xiaomi e DeepSeek vira chute.
A conta da eficiência
O Flash Lite não é gratuito. Custa US$ 0,25 por milhão de tokens de entrada, US$ 1,50 por milhão na saída, e US$ 0,025 para leitura de cache. A janela de contexto é de 1.048.576 tokens — 1 milhão — e a modalidade aceita texto, imagem, arquivo, áudio e vídeo como entrada, devolvendo só texto.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-flash-lite |
| Criador | |
| Preço de entrada | US$ 0.250 / M tokens |
| Preço de saída | US$ 1.50 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.025 / M (90% de desconto) |
Em relação ao irmão maior, o Gemini 3.1 Pro Preview, a saída cai de US$ 12 para US$ 1,50 por milhão — uma redução de 87,5%. É o posicionamento clássico de "lite" do Google: abrir mão de capacidade cognitiva em troca de preço e latência.
Sem nota de inteligência, preço é promessa
Aqui mora a armadilha. O Gemini 3.1 Flash Lite chega ao catálogo sem índice de inteligência, sem score de coding, sem agentic, sem blended. Os campos estão vazios. Isso não quer dizer que o modelo é ruim — quer dizer que o catálogo ainda não mediu.
E essa ausência muda a leitura do preço. Em maio de 2026, com mais de 439 modelos no catálogo e 60 criadores, o topo de inteligência publicada é o Gemini 3.1 Pro Preview (IQ 47,738) e o GPT-5.3-Codex da OpenAI (IQ 45,512), ambos na faixa de US$ 12 a US$ 14 por milhão de saída. O Flash Lite entra entre eles em preço, mas sem nota para provar que rende.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Onde o "barato" do Google se posiciona
O US$ 1,50 por milhão de saída não é o chão do mercado. O Xiaomi MiMo-V2.5 cobra US$ 0,28 por milhão de saída com IQ 38,043. O MiMo-V2.5-Pro sai por US$ 0,87 com IQ 42,88. A DeepSeek V4 Pro 0423 cobra US$ 1,74 e marca IQ 45,268.
Para uma mesma faixa de preço, a chinesa DeepSeek entrega nota de inteligência mais alta que o Flash Lite pode aspirar, e a Xiaomi cobra metade do preço com nota próxima. Se o Flash Lite não render acima de IQ 42, o argumento de "eficiência" do Google cai por terra.
A versão batch é a outra metade do lançamento
Junto com o modelo padrão, o Google soltou o Gemini 3.1 Flash Lite em modo batch. Os preços caem pela metade: US$ 0,125 de entrada e US$ 0,75 de saída por milhão. Mesma janela de 1 milhão de tokens, mesma multimodalidade.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Gemini 3.1 Flash Lite (batch | 0.125 | 0.75 | 1.05M |
Para workloads assíncronos — processamento de filas, classificação em massa, indexação de documentos longos — o batch muda a conta. Quem roda Flash Lite padrão em alto volume consegue trocar pelo batch e cortar a fatura pela metade, desde que aceite a latência maior típica desse modo.
Para quem vale e o que fazer
Vale para quem já roda a família Gemini em produção e quer baixar custo sem trocar de fornecedor, mantendo 1 milhão de contexto e suporte total a multimodal. Também vale para workloads onde o Google cumpre requisitos contratuais ou de região que outros não cumprem.
Não muda nada para quem precisa de nota de inteligência comprovada antes de adotar — e esse é o principal comprador corporativo. Tampouco muda para quem busca o menor preço absoluto: Xiaomi e DeepSeek seguem mais baratos com benchmarks publicados.
A ação concreta: se você já roda Flash Lite ou Pro em produção, teste o novo modelo com seu próprio conjunto de avaliação antes de migrar de fornecedor. Se roda em volume assíncrono, o batch a US$ 0,75 por milhão de saída é a peça que vale prototipar primeiro. E peça ao Google a nota de inteligência — o catálogo ainda não tem.
Flash Lite entra barato no multimodal do Google, mas sem IQ publicado: teste com sua própria avaliação antes de migrar e considere o batch a US$ 0,75/M para volume assíncrono.
Perguntas frequentes
O Gemini 3.1 Flash Lite é gratuito?
Não. É o modelo 'lite' pago do Google, a US$ 0,25 por milhão de tokens de entrada e US$ 1,50 por milhão de saída. O Google costuma oferecer tiers gratuitos separados, mas não é o caso deste lançamento.
Como o Flash Lite se compara com a DeepSeek V4 Pro em preço?
O Flash Lite cobra US$ 1,50 por milhão de saída; a DeepSeek V4 Pro cobra US$ 1,74. O Flash Lite é um pouco mais barato, mas a DeepSeek já tem nota de inteligência publicada (IQ 45,268) e o Flash Lite ainda não foi medido pelo catálogo.
Vale a pena esperar os benchmarks do Flash Lite?
Se a nota de inteligência é critério de compra na sua empresa, sim. O catálogo ainda não mediu o modelo, e rivais como Xiaomi MiMo e DeepSeek V4 Pro já têm notas publicadas cobrando menos.