Gemini Flash caiu 75% em um dia e Z.ai subiu 105%
Treze modelos mexeram no preço em 24 horas: a maioria ficou mais barata, mas quem usava GLM 5.2 vai pagar quase o dobro.
Ontem o Gemini Flash Latest custava US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. Hoje, está em US$ 0,375 e US$ 1,875. É um corte de 75% em ambas as direções, aplicado de uma vez, sem aviso na manchete do lançamento. Quem rodava esse modelo em produção e não conferiu a tabela hoje vai descobrir no próximo extrato — e a surpresa vai ser boa.
Não foi o único corte. Em 13 de agosto de 2026, o catálogo registrou 13 alterações de preço, com 8 cortes e 4 aumentos. A maioria das quedas veio da Google e da MoonshotAI, e o movimento mais agressivo foi justamente o do Gemini Flash. Para quem usa Gemini como modelo de baixo custo para classificação, extração ou geração curta, a conta de agosto vai cair de forma perceptível.
O corte que todo mundo viu
O Gemini Flash Latest é a versão "sempre a mais barata" da linha Flash da Google — o que normalmente aparece como default em aplicações que priorizam custo. A redução de US$ 7,50 para US$ 1,875 por milhão de tokens de saída é o tipo de mudança que reposiciona o modelo na prateleira: ele deixa de competir com modelos intermediários e entra na faixa dos Flash de baixo custo.
O Gemini 3.6 Flash também foi mexido: caiu de US$ 1,50 para US$ 0,75 na entrada e de US$ 7,50 para US$ 3,75 na saída — uma redução de 50%. A versão batch, usada para processamento assíncrono em grande volume, foi na mesma proporção: de US$ 0,75 para US$ 0,375 na entrada. Para quem dispara jobs noturnos de sumarização ou classificação, o batch agora é o mais barato entre os Flash da Google.
O aumento que ninguém pediu
Nem tudo foi corte. O Z.ai GLM 5.2 apareceu duas vezes no mesmo dia com movimentos opostos — primeiro subiu, depois voltou quase ao ponto original. O efeito líquido é um aumento: a saída saltou de US$ 1,54 para US$ 3,15 por milhão de tokens, uma alta de 105%. A entrada subiu marginalmente, de US$ 0,49 para US$ 0,50.
Esse é o tipo de mudança que pega quem automatizou o fallback. Se o seu sistema tinha GLM 5.2 como modelo de baixo custo para quando o principal estoura orçamento, vale conferir o preço antes do próximo ciclo de cobrança. O GLM 5.1, da mesma Z.ai, também mudou — e para melhor: caiu de US$ 1,40 para US$ 0,952 na entrada e de US$ 4,40 para US$ 2,992 na saída. Para quem usa Z.ai, a saída mais barata hoje é migrar do 5.2 para o 5.1.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| Google Gemini Flash Latest | 7.5 | 1.875 | -75% |
| GLM 5.2 | 1.54 | 3.15 | +105% |
| GLM 5.2 | 3.15 | 1.54 | -51% |
| Gemini 3.6 Flash | 7.5 | 3.75 | -50% |
| Gemini 3.6 Flash (batch) | 3.75 | 1.875 | -50% |
| Kimi K2.6 | 4 | 2.36 | -41% |
| Kimi K2.6 | 2.44 | 4 | +64% |
| GLM 5.1 | 4.4 | 2.992 | -32% |
Kimi também ficou mais barato
A MoonshotAI ajustou o Kimi K2.6 duas vezes no dia, com efeito final de corte: a entrada foi de US$ 0,95 para US$ 0,5605 (queda de 41%) e a saída de US$ 4,00 para US$ 2,36 (queda de 41%). É o mesmo percentual nas duas direções, o que sugere um reposicionamento de tabela e não uma promoção temporária. O Kimi K3, que lidera a lista de modelos chineses por índice de inteligência (IQ 59,7), segue com US$ 15 por milhão de tokens de saída — não mudou.
Para quem isso muda alguma coisa
Se você roda Gemini Flash ou Gemini 3.6 Flash em volume, vale a pena rodar um cálculo rápido: a mesma carga que custava X em julho vai custar cerca de 50% a menos com o Flash Latest. Para aplicações de classificação, extração e geração curta, é o momento de revisar o orçamento.
Se você usa GLM 5.2, a decisão é trocar para o GLM 5.1 antes do próximo ciclo — a economia na saída é de cerca de 5%. Não é dramática, mas é dinheiro que volta sem mudar a qualidade do que você entrega.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
Se você usa Kimi K2.6, o corte de 41% é boa notícia para qualquer fluxo que dependa desse modelo. Se você usa qualquer outro modelo do catálogo, hoje não é o seu dia — e tá tudo bem.
Revise o preço do Gemini Flash e do GLM 5.2 antes do próximo ciclo: o Flash caiu 75% e o GLM 5.2 subiu 105% em um único dia.
Perguntas frequentes
O Gemini Flash ficou mais barato em agosto de 2026?
Sim. Em 13 de agosto de 2026, o Gemini Flash Latest caiu de US$ 1,50 para US$ 0,375 por milhão de tokens de entrada e de US$ 7,50 para US$ 1,875 por milhão de tokens de saída — uma redução de 75% nas duas direções.
Qual modelo subiu de preço em agosto de 2026?
O Z.ai GLM 5.2 teve a saída aumentada de US$ 1,54 para US$ 3,15 por milhão de tokens em 13 de agosto de 2026, uma alta de 105%. A entrada subiu marginalmente, de US$ 0,49 para US$ 0,50.
Vale trocar do GLM 5.2 para o GLM 5.1?
Vale se você usa GLM 5.2 pelo preço. O GLM 5.1 está em US$ 0,952 de entrada e US$ 2,992 de saída por milhão de tokens, contra US$ 0,50 e US$ 3,15 do 5.2. Para fluxos com muita saída, o 5.1 é mais barato.