FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

DeepSeek V4 Flash sobe 49% em um dia e arrasta a conta

Oito modelos mexeram de preço nas últimas 24 horas, três para cima e três para baixo — e o Flash chinês é o que mais pesa no boleto de quem busca IA barata.

Redação FalaVIP IA 3 min de leitura
+49%no preço de saída do DeepSeek V4 Flash
US$ 0,28novo preço de saída por milhão de tokens do Flash
US$ 0,14novo preço de entrada por milhão de tokens do Flash

O Flash que virou minidesastre

Você acordou, rodou o relatório de custos da API e viu uma linha saltada. Não foi bug: o DeepSeek V4 Flash 0423 subiu de US$ 0,1876 para US$ 0,28 por milhão de tokens de saída — um reajuste de 49% em um único dia. A entrada também mexeu: saiu de US$ 0,0938 e foi para US$ 0,14, mesma proporção. Em valores absolutos, são centavos. Mas centavos multiplicados por milhões de tokens viram a diferença entre um mês de experimento e uma reclamação no Slack do financeiro.

Variação do preço de saída (%)
DeepSeek V4 Flash 042349Qwen3.6 27B-17gpt-oss-20b8GLM 5.2-6Qwen3 30B A3B-4GLM 5.21Kimi K2.7 Code0Kimi K2.7 Code0%

O Flash era exatamente o tipo de modelo que fazia sentido em fluxos de alto volume: tarefas de classificação, resumo curto, pré-processamento. Barato, razoavelmente capaz, e com a confiança de vir de uma das casas chinesas mais agressivas em preço. Ontem ele custava menos de US$ 0,20 para gerar um milhão de tokens. Hoje custa US$ 0,28. A fatura de quem processa, digamos, 500 milhões de tokens por mês nesse modelo subiu cerca de US$ 46 — só nesse item.

O resto do dia: três para cima, três para baixo

Nem tudo ficou mais caro. Das oito mudanças registradas em 26 de julho, três foram alta e três foram corte — além de duas alterações marginais em modelos que mexeram duas vezes no mesmo dia (o GLM 5.2 e o Kimi K2.7 Code aparecem duas vezes na lista, com ajustes sequenciais).

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
DeepSeek V4 Flash 04230.18760.28+49%
Qwen3.6 27B2.42-17%
gpt-oss-20b0.130.14+8%
GLM 5.22.23082.1032-6%
Qwen3 30B A3B0.520.5-4%
GLM 5.22.21762.2308+1%
Kimi K2.7 Code3.53.50%
Kimi K2.7 Code3.53.50%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

A queda mais relevante é a do Qwen3.6 27B, que reduziu o preço de saída de US$ 2,40 para US$ 2,00 por milhão de tokens — um corte de 17%. Para quem usa o modelo em tarefas de geração maior, é uma boa notícia direta. O Qwen3 30B A3B também ficou um pouco mais barato (entrada de US$ 0,13 para US$ 0,12, saída de US$ 0,52 para US$ 0,50), e o Z.ai GLM 5.2 cedeu cerca de 6% no preço de saída no ajuste mais recente do dia.

Do lado das altas, além do Flash, o gpt-oss-20b da OpenAI subiu de US$ 0,13 para US$ 0,14 na saída — 8% — enquanto a entrada ficou em US$ 0,03. É pouco, mas é o tipo de movimento que aparece quando você soma tudo no fim do mês.

Para quem isso muda algo

Se você roda o DeepSeek V4 Flash em produção para tarefas de alto volume, a conta de julho vai chegar diferente da de junho. Vale rerodar os números hoje, não na próxima sprint. Se o Flash era seu modelo padrão para classificação ou extração, três alternativas continuam baratas e não mexeram: o DeepSeek V4 Pro 0423 segue em US$ 1,74 por milhão de tokens de saída, o GPT-5.6 Luna em US$ 1,20, e o MiniMax M3 em US$ 1,20 também — todos acima do piso de IQ 45 do catálogo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 521 modelos disponíveis no catálogo nesta data.

Se você usa o Qwen3.6 27B para geração mais densa, o corte de 17% na saída é dinheiro que volta. Se você está no topo da pirâmide e roda Claude Opus 5 ou Claude Fable 5, nada muda — esses não estão na lista de hoje, e o topo do mercado segue o mesmo: Anthropic na frente, OpenAI logo atrás, MoonshotAI com o Kimi K3 fechando o bloco dos cinco mais inteligentes.

O tabuleiro

O reajuste do Flash não é exceção aleatória: ele acontece no mesmo dia em que a Qwen cortou preço em dois modelos e a Z.ai afrouxou o seu. É movimento de mercado, não decisão isolada. Casas chinesas continuam sendo o lugar onde o preço cai — e, vez ou outra, onde sobe de surpresa. O catálogo tem 521 modelos listados, 66 criadores diferentes, e 44 lançamentos nos últimos 30 dias. Em um mercado assim, preço de modelo é cotação: muda, e muda sem aviso. A única defesa é rerodar o comparativo antes de cada ciclo de cobrança.

A implicação prática é direta: se o Flash estava no seu pipeline, abra o dashboard de custos hoje e veja o quanto a linha dele cresceu. Se for pouco, ignore. Se for muito, o V4 Pro 0423 da mesma DeepSeek ou o GPT-5.6 Luna da OpenAI entregam capacidade parecida por preço próximo ao que o Flash cobrava ontem.

Em uma frase

Rerode o comparativo de preços hoje: o Flash chinês subiu 49% em 24 horas, e quem tinha ele no pipeline precisa recalcular a fatura antes do próximo ciclo.

Perguntas frequentes

Quanto ficou mais caro o DeepSeek V4 Flash?

O preço de saída subiu de US$ 0,1876 para US$ 0,28 por milhão de tokens — um aumento de 49% em um único dia. A entrada subiu na mesma proporção, de US$ 0,0938 para US$ 0,14.

Algum modelo ficou mais barato hoje?

Sim. O Qwen3.6 27B cortou 17% no preço de saída (de US$ 2,40 para US$ 2,00 por milhão de tokens), o Qwen3 30B A3B ficou ligeiramente mais barato, e o Z.ai GLM 5.2 cedeu cerca de 6% no ajuste mais recente do dia.

Vale trocar de modelo por causa do reajuste do Flash?

Depende do volume. Para alto volume em tarefas leves, o DeepSeek V4 Pro 0423 (US$ 1,74) e o GPT-5.6 Luna (US$ 1,20) são alternativas próximas ao preço antigo do Flash. Recalcule o custo mensal antes de migrar.

Leia também