FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Gemini Flash caiu 75% em um dia e Z.ai subiu 105%

Treze modelos mexeram no preço em 24 horas: a maioria ficou mais barata, mas quem usava GLM 5.2 vai pagar quase o dobro.

Redação FalaVIP IA 3 min de leitura
US$ 0,375por milhão de tokens de entrada do Gemini Flash Latest
US$ 3,15por milhão de tokens de saída do GLM 5.2
US$ 0,5605por milhão de tokens de entrada do Kimi K2.6

Ontem o Gemini Flash Latest custava US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. Hoje, está em US$ 0,375 e US$ 1,875. É um corte de 75% em ambas as direções, aplicado de uma vez, sem aviso na manchete do lançamento. Quem rodava esse modelo em produção e não conferiu a tabela hoje vai descobrir no próximo extrato — e a surpresa vai ser boa.

Não foi o único corte. Em 13 de agosto de 2026, o catálogo registrou 13 alterações de preço, com 8 cortes e 4 aumentos. A maioria das quedas veio da Google e da MoonshotAI, e o movimento mais agressivo foi justamente o do Gemini Flash. Para quem usa Gemini como modelo de baixo custo para classificação, extração ou geração curta, a conta de agosto vai cair de forma perceptível.

Variação do preço de saída (%)
Google Gemini Flash Latest-75GLM 5.2105GLM 5.2-51Gemini 3.6 Flash-50Gemini 3.6 Flash (batch)-50Kimi K2.6-41Kimi K2.664GLM 5.1-32%

O corte que todo mundo viu

O Gemini Flash Latest é a versão "sempre a mais barata" da linha Flash da Google — o que normalmente aparece como default em aplicações que priorizam custo. A redução de US$ 7,50 para US$ 1,875 por milhão de tokens de saída é o tipo de mudança que reposiciona o modelo na prateleira: ele deixa de competir com modelos intermediários e entra na faixa dos Flash de baixo custo.

O Gemini 3.6 Flash também foi mexido: caiu de US$ 1,50 para US$ 0,75 na entrada e de US$ 7,50 para US$ 3,75 na saída — uma redução de 50%. A versão batch, usada para processamento assíncrono em grande volume, foi na mesma proporção: de US$ 0,75 para US$ 0,375 na entrada. Para quem dispara jobs noturnos de sumarização ou classificação, o batch agora é o mais barato entre os Flash da Google.

O aumento que ninguém pediu

Nem tudo foi corte. O Z.ai GLM 5.2 apareceu duas vezes no mesmo dia com movimentos opostos — primeiro subiu, depois voltou quase ao ponto original. O efeito líquido é um aumento: a saída saltou de US$ 1,54 para US$ 3,15 por milhão de tokens, uma alta de 105%. A entrada subiu marginalmente, de US$ 0,49 para US$ 0,50.

Esse é o tipo de mudança que pega quem automatizou o fallback. Se o seu sistema tinha GLM 5.2 como modelo de baixo custo para quando o principal estoura orçamento, vale conferir o preço antes do próximo ciclo de cobrança. O GLM 5.1, da mesma Z.ai, também mudou — e para melhor: caiu de US$ 1,40 para US$ 0,952 na entrada e de US$ 4,40 para US$ 2,992 na saída. Para quem usa Z.ai, a saída mais barata hoje é migrar do 5.2 para o 5.1.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
Google Gemini Flash Latest7.51.875-75%
GLM 5.21.543.15+105%
GLM 5.23.151.54-51%
Gemini 3.6 Flash7.53.75-50%
Gemini 3.6 Flash (batch)3.751.875-50%
Kimi K2.642.36-41%
Kimi K2.62.444+64%
GLM 5.14.42.992-32%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Kimi também ficou mais barato

A MoonshotAI ajustou o Kimi K2.6 duas vezes no dia, com efeito final de corte: a entrada foi de US$ 0,95 para US$ 0,5605 (queda de 41%) e a saída de US$ 4,00 para US$ 2,36 (queda de 41%). É o mesmo percentual nas duas direções, o que sugere um reposicionamento de tabela e não uma promoção temporária. O Kimi K3, que lidera a lista de modelos chineses por índice de inteligência (IQ 59,7), segue com US$ 15 por milhão de tokens de saída — não mudou.

Para quem isso muda alguma coisa

Se você roda Gemini Flash ou Gemini 3.6 Flash em volume, vale a pena rodar um cálculo rápido: a mesma carga que custava X em julho vai custar cerca de 50% a menos com o Flash Latest. Para aplicações de classificação, extração e geração curta, é o momento de revisar o orçamento.

Se você usa GLM 5.2, a decisão é trocar para o GLM 5.1 antes do próximo ciclo — a economia na saída é de cerca de 5%. Não é dramática, mas é dinheiro que volta sem mudar a qualidade do que você entrega.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 547 modelos disponíveis no catálogo nesta data.

Se você usa Kimi K2.6, o corte de 41% é boa notícia para qualquer fluxo que dependa desse modelo. Se você usa qualquer outro modelo do catálogo, hoje não é o seu dia — e tá tudo bem.

Em uma frase

Revise o preço do Gemini Flash e do GLM 5.2 antes do próximo ciclo: o Flash caiu 75% e o GLM 5.2 subiu 105% em um único dia.

Perguntas frequentes

O Gemini Flash ficou mais barato em agosto de 2026?

Sim. Em 13 de agosto de 2026, o Gemini Flash Latest caiu de US$ 1,50 para US$ 0,375 por milhão de tokens de entrada e de US$ 7,50 para US$ 1,875 por milhão de tokens de saída — uma redução de 75% nas duas direções.

Qual modelo subiu de preço em agosto de 2026?

O Z.ai GLM 5.2 teve a saída aumentada de US$ 1,54 para US$ 3,15 por milhão de tokens em 13 de agosto de 2026, uma alta de 105%. A entrada subiu marginalmente, de US$ 0,49 para US$ 0,50.

Vale trocar do GLM 5.2 para o GLM 5.1?

Vale se você usa GLM 5.2 pelo preço. O GLM 5.1 está em US$ 0,952 de entrada e US$ 2,992 de saída por milhão de tokens, contra US$ 0,50 e US$ 3,15 do 5.2. Para fluxos com muita saída, o 5.1 é mais barato.

Leia também