Semana quieta termina com Gemini 3 Flash Preview em duas versões
Sete dias sem corte de preço e só dois lançamentos, ambos do Google — e a conta continua subindo no mesmo ritmo.
O silêncio que não é barato
Sete dias, zero corte de preço, dois lançamentos — e os dois são do Google. A semana que fecha neste domingo, 21 de dezembro, foi uma das mais mansas do calendário recente de modelos, mas mansidão aqui não significa conta mais leve. Pelo contrário: o catálogo segue inchando (já passa de 309 modelos listados hoje, vindos de 47 criadores), os preços de saída continuam onde estavam e a única novidade relevante veio em dose dupla da mesma casa.
Se você está esperando uma boa notícia para a fatura de dezembro, pode parar de rolar a timeline.
A dobradinha do Google
No dia 17 de dezembro a Google publicou o Gemini 3 Flash Preview em duas variantes. A diferença entre elas não está no cérebro — é na fila de processamento.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2025-12-17 | Gemini 3 Flash Preview (batc | — | 1.5 | |
| 2025-12-17 | Gemini 3 Flash Preview | — | 3 |
A versão padrão cobra US$ 3 por milhão de tokens de saída. A versão :batch, que aceita latência maior em troca de prioridade menor na fila, sai por US$ 1,50 — metade do preço. É o mesmo movimento que outras laboratórias já fizeram (a OpenAI tem a família o3 no catálogo com saída a US$ 8 por milhão, por exemplo), mas é a primeira vez que a Google publica um Flash nesse formato de lote exposto como produto separado.
Nenhum dos dois traz índice de inteligência publicado no catálogo até agora. Ou seja: você está comprando pela marca e pelo preço, não por um número de benchmark que confirme a posição do modelo no tabuleiro.
E o resto do tabuleiro?
Enquanto isso, o topo do mercado continua o mesmo de semanas atrás. O Xiaomi MiMo-V2-Flash lidera o índice de inteligência com 34,024, seguido pelo OpenAI o3 (31,096) e pelo Anthropic Claude Haiku 4.5 (29,892). Mais abaixo, o OpenAI gpt-oss-120b aparece com 24,126 e o Mistral Devstral 2 2512 fecha o top 5 com 19,242 — este último com preço de saída de US$ 2 por milhão, o mais barato entre os cinco primeiros.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Repare no que não mudou: o Google Gemini 3 Flash Preview não entra nessa lista porque o índice ainda não foi medido no catálogo. Quem precisa comparar antes de comprar vai ter de esperar — ou rodar benchmark próprio.
Para quem essa semana importa
Se você está rodando um agente ou um pipeline assíncrono — resumo de logs, classificação em massa, enriquecimento de base — a versão :batch do Gemini 3 Flash Preview é a notícia relevante. US$ 1,50 por milhão de tokens de saída é competitivo frente ao o3 (US$ 8) e ao Claude Haiku 4.5 (US$ 5), e o desconto existe justamente porque você topa esperar.
Se você está chamando modelo em tempo real, em chat com latência baixa, a versão padrão a US$ 3 entra na briga com o Claude Haiku 4.5 (US$ 5) e o Devstral 2 (US$ 2). A escolha depende mais do seu stack e do seu fornecedor de preferência do que de preço puro.
Se você está esperando corte de preço em modelo já consolidado para enxugar a fatura de fim de ano: não aconteceu nesta semana. O catálogo não registrou corte algum entre 15 e 21 de dezembro.
O que fazer com isso
A implicação prática é direta: se você ainda não testou a versão batch do Gemini 3 Flash Preview, este é o momento de colocar uma tarefa não-crítica em fila e medir custo real versus o modelo que está pagando hoje. A economia potencial é de 50% só no token de saída, e é o tipo de teste que cabe num fim de semana.
Se o resultado não convencer, você volta para o que já tem rodando — porque o resto do tabuleiro não se mexeu.
Teste a versão batch do Gemini 3 Flash Preview numa tarefa assíncrona esta semana: a economia de 50% no token de saída é o único corte de preço efetivo que apareceu no calendário.
Perguntas frequentes
Qual a diferença entre Gemini 3 Flash Preview e Gemini 3 Flash Preview batch?
É o mesmo modelo exposto em duas filas diferentes. A versão padrão cobra US$ 3 por milhão de tokens de saída e roda com latência normal. A versão `:batch` cobra US$ 1,50 pela mesma unidade, mas aceita esperar mais na fila — serve para processamento em lote, não para chat em tempo real.
Houve corte de preço em algum modelo nesta semana?
Não. Entre 15 e 21 de dezembro de 2025 o catálogo não registrou corte nem aumento de preço em nenhum dos mais de 309 modelos listados. A única mudança de custo veio de produto novo (o Gemini 3 Flash Preview e sua variante batch), não de reajuste.
O Gemini 3 Flash Preview aparece no topo do ranking de inteligência?
Ainda não. O índice de inteligência do catálogo só é publicado para modelos já avaliados, e o Gemini 3 Flash Preview foi lançado em 17 de dezembro sem nota atribuída até este domingo. O topo segue com Xiaomi MiMo-V2-Flash (34,024), OpenAI o3 (31,096) e Anthropic Claude Haiku 4.5 (29,892).