FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Semana quieta termina com Gemini 3 Flash Preview em duas versões

Sete dias sem corte de preço e só dois lançamentos, ambos do Google — e a conta continua subindo no mesmo ritmo.

Redação FalaVIP IA 3 min de leitura
US$ 3por milhão de tokens de saída na versão padrão
US$ 1,50por milhão de tokens de saída na versão batch
30modelos lançados nos últimos 30 dias

O silêncio que não é barato

Sete dias, zero corte de preço, dois lançamentos — e os dois são do Google. A semana que fecha neste domingo, 21 de dezembro, foi uma das mais mansas do calendário recente de modelos, mas mansidão aqui não significa conta mais leve. Pelo contrário: o catálogo segue inchando (já passa de 309 modelos listados hoje, vindos de 47 criadores), os preços de saída continuam onde estavam e a única novidade relevante veio em dose dupla da mesma casa.

Se você está esperando uma boa notícia para a fatura de dezembro, pode parar de rolar a timeline.

A dobradinha do Google

No dia 17 de dezembro a Google publicou o Gemini 3 Flash Preview em duas variantes. A diferença entre elas não está no cérebro — é na fila de processamento.

Lançamentos entre 2025-12-15 e 2025-12-21
DataModeloCriadorInteligênciaSaída US$/M
2025-12-17Gemini 3 Flash Preview (batcgoogle1.5
2025-12-17Gemini 3 Flash Previewgoogle3

A versão padrão cobra US$ 3 por milhão de tokens de saída. A versão :batch, que aceita latência maior em troca de prioridade menor na fila, sai por US$ 1,50 — metade do preço. É o mesmo movimento que outras laboratórias já fizeram (a OpenAI tem a família o3 no catálogo com saída a US$ 8 por milhão, por exemplo), mas é a primeira vez que a Google publica um Flash nesse formato de lote exposto como produto separado.

Nenhum dos dois traz índice de inteligência publicado no catálogo até agora. Ou seja: você está comprando pela marca e pelo preço, não por um número de benchmark que confirme a posição do modelo no tabuleiro.

E o resto do tabuleiro?

Enquanto isso, o topo do mercado continua o mesmo de semanas atrás. O Xiaomi MiMo-V2-Flash lidera o índice de inteligência com 34,024, seguido pelo OpenAI o3 (31,096) e pelo Anthropic Claude Haiku 4.5 (29,892). Mais abaixo, o OpenAI gpt-oss-120b aparece com 24,126 e o Mistral Devstral 2 2512 fecha o top 5 com 19,242 — este último com preço de saída de US$ 2 por milhão, o mais barato entre os cinco primeiros.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 309 modelos disponíveis no catálogo nesta data.

Repare no que não mudou: o Google Gemini 3 Flash Preview não entra nessa lista porque o índice ainda não foi medido no catálogo. Quem precisa comparar antes de comprar vai ter de esperar — ou rodar benchmark próprio.

Para quem essa semana importa

Se você está rodando um agente ou um pipeline assíncrono — resumo de logs, classificação em massa, enriquecimento de base — a versão :batch do Gemini 3 Flash Preview é a notícia relevante. US$ 1,50 por milhão de tokens de saída é competitivo frente ao o3 (US$ 8) e ao Claude Haiku 4.5 (US$ 5), e o desconto existe justamente porque você topa esperar.

Se você está chamando modelo em tempo real, em chat com latência baixa, a versão padrão a US$ 3 entra na briga com o Claude Haiku 4.5 (US$ 5) e o Devstral 2 (US$ 2). A escolha depende mais do seu stack e do seu fornecedor de preferência do que de preço puro.

Se você está esperando corte de preço em modelo já consolidado para enxugar a fatura de fim de ano: não aconteceu nesta semana. O catálogo não registrou corte algum entre 15 e 21 de dezembro.

O que fazer com isso

A implicação prática é direta: se você ainda não testou a versão batch do Gemini 3 Flash Preview, este é o momento de colocar uma tarefa não-crítica em fila e medir custo real versus o modelo que está pagando hoje. A economia potencial é de 50% só no token de saída, e é o tipo de teste que cabe num fim de semana.

Se o resultado não convencer, você volta para o que já tem rodando — porque o resto do tabuleiro não se mexeu.

Em uma frase

Teste a versão batch do Gemini 3 Flash Preview numa tarefa assíncrona esta semana: a economia de 50% no token de saída é o único corte de preço efetivo que apareceu no calendário.

Perguntas frequentes

Qual a diferença entre Gemini 3 Flash Preview e Gemini 3 Flash Preview batch?

É o mesmo modelo exposto em duas filas diferentes. A versão padrão cobra US$ 3 por milhão de tokens de saída e roda com latência normal. A versão `:batch` cobra US$ 1,50 pela mesma unidade, mas aceita esperar mais na fila — serve para processamento em lote, não para chat em tempo real.

Houve corte de preço em algum modelo nesta semana?

Não. Entre 15 e 21 de dezembro de 2025 o catálogo não registrou corte nem aumento de preço em nenhum dos mais de 309 modelos listados. A única mudança de custo veio de produto novo (o Gemini 3 Flash Preview e sua variante batch), não de reajuste.

O Gemini 3 Flash Preview aparece no topo do ranking de inteligência?

Ainda não. O índice de inteligência do catálogo só é publicado para modelos já avaliados, e o Gemini 3 Flash Preview foi lançado em 17 de dezembro sem nota atribuída até este domingo. O topo segue com Xiaomi MiMo-V2-Flash (34,024), OpenAI o3 (31,096) e Anthropic Claude Haiku 4.5 (29,892).

Leia também