Gemini 3.1 Flash Lite Preview cobra US$ 1,50 por milhão — mas não tem QI
Versão econômica do Gemini 3.1 Pro custa oito vezes menos na saída, mas o índice de inteligência ainda está em branco no catálogo.
O Gemini 3.1 Pro Preview lidera o ranking de inteligência do catálogo nesta segunda-feira, custando US$ 12 por milhão de tokens de saída. Seis dias atrás, a Google lançou a versão "Lite" do mesmo modelo, cobrando US$ 1,50 pelo mesmo milhão. Oito vezes menos. Só que essa conta de multiplicar não basta — porque o Flash Lite Preview ainda não tem nota de QI publicada no catálogo. Em 9 de março, é essa a dúvida que vale o seu tempo: vale pagar oito vezes menos no que ainda não foi medido?
O preço: 8x abaixo do Pro, mas não é o mais barato
A diferença entre Pro e Lite segue o padrão que a Google repete desde a era 2.5: você paga caro pela inteligência máxima, ou paga barato para processar volume. No 3.1, a conta de saída é US$ 1,50 por milhão contra US$ 12 do Pro. O cache de leitura — que existe justamente para quem repete o mesmo contexto várias vezes — sai a US$ 0,025 por milhão, 1,66% do preço de saída. Em alto volume, isso muda a conta no fim do mês.
Só que, no catálogo, esse preço não é o mais barato. O catálogo reúne mais de 357 modelos ativos nesta data, 27 deles lançados nos últimos 30 dias. Entre os baratos com QI medido, o Xiaomi MiMo-V2-Flash cobra US$ 0,30 por milhão de saída, um quinto do Flash Lite. O Qwen 3.5 397B A17B sai a US$ 2,34 e tem QI 34,262. Então a pergunta que fica é: por que pagar US$ 1,50 se a alternativa chinesa custa menos e já tem nota?
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
O QI que ficou em branco
A ficha do Flash Lite Preview está com a coluna de QI em branco. Não é falha de dados — é ausência de medição. Isso significa que, hoje, não dá para dizer se ele bate o Xiaomi MiMo (QI 34,024 a US$ 0,30/M) ou se fica abaixo do Qwen 3.5 (QI 34,262 a US$ 2,34/M). A descrição do release afirma que o modelo "supera o Gemini 2.5 Flash Lite" e "se aproxima do Gemini 2.5 Flash em performance" — referência a geração anterior, sem comparativo com os pares atuais do mercado.
Para quem decide modelo olhando o índice, isso é uma aposta. Você está comprando preço, multimodalidade e janela de contexto sem ver a nota.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-flash-lite-preview |
| Criador | |
| Preço de entrada | US$ 0.250 / M tokens |
| Preço de saída | US$ 1.50 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.025 / M (90% de desconto) |
Para quem esse modelo faz sentido
Três perfis vão olhar para o Flash Lite Preview sem pestanejar.
Primeiro: quem precisa de multimodalidade barata em um pipeline só. O modelo aceita texto, imagem, arquivo, áudio e vídeo na entrada e devolve só texto. Poucos concorrentes na faixa dos US$ 1,50 de saída oferecem tudo isso — a maioria dos "lite" é só texto.
Segundo: quem precisa de janela de contexto grande. Um milhão de tokens é o mesmo do Pro, suficiente para resumir documentos longos, transcrever reuniões em vídeo ou alimentar agentes que leem repositórios inteiros.
Terceiro: quem já roda Gemini em produção e quer empurrar chamadas de baixo valor para uma versão mais barata sem trocar de provedor. US$ 0,025 por milhão de cache é difícil de ignorar quando a chamada se repete mil vezes por dia.
Para quem ele não muda nada
Se você precisa do topo absoluto de inteligência, o caminho continua sendo o Gemini 3.1 Pro Preview (QI 47,738) ou o GPT-5.3-Codex (QI 45,512). O Flash Lite não concorre com eles — concorre com o seu orçamento.
Se o que você quer é o multimodal mais barato possível, o MiMo a US$ 0,30/M continua cinco vezes mais barato e com QI medido. Em projetos de altíssimo volume, é essa diferença de cinco para um que separa "vale a pena" de "nem cogito".
E se você é o tipo de comprador que só fecha com o modelo depois de ver a nota de QI, o Flash Lite Preview ainda não entrou na régua. Vale rodar uma amostra de 50 a 100 chamadas do seu caso real, comparar com o que você paga hoje, e só depois migrar. Se o Flash Lite aguentar a qualidade e você roda mais de cem milhões de tokens de saída por mês, a economia contra o Pro justifica repensar o pipeline.
Rode uma amostra do seu caso real antes de migrar: a economia de 8x sobre o Pro só se sustenta se a qualidade do Flash Lite Preview aguentar o seu volume mensal.
Perguntas frequentes
O Gemini 3.1 Flash Lite Preview é gratuito?
Não. Custa US$ 0,25 por milhão de tokens de entrada e US$ 1,50 por milhão de tokens de saída. O cache de leitura sai a US$ 0,025 por milhão. Não há tier gratuito no catálogo para esse modelo.
Qual a diferença entre Gemini 3.1 Flash Lite Preview e o Pro?
O Pro Preview lidera o ranking de QI (47,738) e custa US$ 12 por milhão de tokens de saída. O Flash Lite custa oito vezes menos, mas ainda não tem QI medido. Ambos compartilham a janela de 1 milhão de tokens e a multimodalidade.
Existe modelo multimodal mais barato que o Flash Lite Preview?
Sim. O Xiaomi MiMo-V2-Flash aceita múltiplas modalidades e cobra US$ 0,30 por milhão de tokens de saída, cinco vezes menos que o Flash Lite. A diferença de preço pode decidir entre adotar o modelo da Google ou ficar no chinês em projetos de altíssimo volume.