DeepSeek V4 Flash sobe 49% em um dia e arrasta a conta
Oito modelos mexeram de preço nas últimas 24 horas, três para cima e três para baixo — e o Flash chinês é o que mais pesa no boleto de quem busca IA barata.
O Flash que virou minidesastre
Você acordou, rodou o relatório de custos da API e viu uma linha saltada. Não foi bug: o DeepSeek V4 Flash 0423 subiu de US$ 0,1876 para US$ 0,28 por milhão de tokens de saída — um reajuste de 49% em um único dia. A entrada também mexeu: saiu de US$ 0,0938 e foi para US$ 0,14, mesma proporção. Em valores absolutos, são centavos. Mas centavos multiplicados por milhões de tokens viram a diferença entre um mês de experimento e uma reclamação no Slack do financeiro.
O Flash era exatamente o tipo de modelo que fazia sentido em fluxos de alto volume: tarefas de classificação, resumo curto, pré-processamento. Barato, razoavelmente capaz, e com a confiança de vir de uma das casas chinesas mais agressivas em preço. Ontem ele custava menos de US$ 0,20 para gerar um milhão de tokens. Hoje custa US$ 0,28. A fatura de quem processa, digamos, 500 milhões de tokens por mês nesse modelo subiu cerca de US$ 46 — só nesse item.
O resto do dia: três para cima, três para baixo
Nem tudo ficou mais caro. Das oito mudanças registradas em 26 de julho, três foram alta e três foram corte — além de duas alterações marginais em modelos que mexeram duas vezes no mesmo dia (o GLM 5.2 e o Kimi K2.7 Code aparecem duas vezes na lista, com ajustes sequenciais).
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| DeepSeek V4 Flash 0423 | 0.1876 | 0.28 | +49% |
| Qwen3.6 27B | 2.4 | 2 | -17% |
| gpt-oss-20b | 0.13 | 0.14 | +8% |
| GLM 5.2 | 2.2308 | 2.1032 | -6% |
| Qwen3 30B A3B | 0.52 | 0.5 | -4% |
| GLM 5.2 | 2.2176 | 2.2308 | +1% |
| Kimi K2.7 Code | 3.5 | 3.5 | 0% |
| Kimi K2.7 Code | 3.5 | 3.5 | 0% |
A queda mais relevante é a do Qwen3.6 27B, que reduziu o preço de saída de US$ 2,40 para US$ 2,00 por milhão de tokens — um corte de 17%. Para quem usa o modelo em tarefas de geração maior, é uma boa notícia direta. O Qwen3 30B A3B também ficou um pouco mais barato (entrada de US$ 0,13 para US$ 0,12, saída de US$ 0,52 para US$ 0,50), e o Z.ai GLM 5.2 cedeu cerca de 6% no preço de saída no ajuste mais recente do dia.
Do lado das altas, além do Flash, o gpt-oss-20b da OpenAI subiu de US$ 0,13 para US$ 0,14 na saída — 8% — enquanto a entrada ficou em US$ 0,03. É pouco, mas é o tipo de movimento que aparece quando você soma tudo no fim do mês.
Para quem isso muda algo
Se você roda o DeepSeek V4 Flash em produção para tarefas de alto volume, a conta de julho vai chegar diferente da de junho. Vale rerodar os números hoje, não na próxima sprint. Se o Flash era seu modelo padrão para classificação ou extração, três alternativas continuam baratas e não mexeram: o DeepSeek V4 Pro 0423 segue em US$ 1,74 por milhão de tokens de saída, o GPT-5.6 Luna em US$ 1,20, e o MiniMax M3 em US$ 1,20 também — todos acima do piso de IQ 45 do catálogo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
Se você usa o Qwen3.6 27B para geração mais densa, o corte de 17% na saída é dinheiro que volta. Se você está no topo da pirâmide e roda Claude Opus 5 ou Claude Fable 5, nada muda — esses não estão na lista de hoje, e o topo do mercado segue o mesmo: Anthropic na frente, OpenAI logo atrás, MoonshotAI com o Kimi K3 fechando o bloco dos cinco mais inteligentes.
O tabuleiro
O reajuste do Flash não é exceção aleatória: ele acontece no mesmo dia em que a Qwen cortou preço em dois modelos e a Z.ai afrouxou o seu. É movimento de mercado, não decisão isolada. Casas chinesas continuam sendo o lugar onde o preço cai — e, vez ou outra, onde sobe de surpresa. O catálogo tem 521 modelos listados, 66 criadores diferentes, e 44 lançamentos nos últimos 30 dias. Em um mercado assim, preço de modelo é cotação: muda, e muda sem aviso. A única defesa é rerodar o comparativo antes de cada ciclo de cobrança.
A implicação prática é direta: se o Flash estava no seu pipeline, abra o dashboard de custos hoje e veja o quanto a linha dele cresceu. Se for pouco, ignore. Se for muito, o V4 Pro 0423 da mesma DeepSeek ou o GPT-5.6 Luna da OpenAI entregam capacidade parecida por preço próximo ao que o Flash cobrava ontem.
Rerode o comparativo de preços hoje: o Flash chinês subiu 49% em 24 horas, e quem tinha ele no pipeline precisa recalcular a fatura antes do próximo ciclo.
Perguntas frequentes
Quanto ficou mais caro o DeepSeek V4 Flash?
O preço de saída subiu de US$ 0,1876 para US$ 0,28 por milhão de tokens — um aumento de 49% em um único dia. A entrada subiu na mesma proporção, de US$ 0,0938 para US$ 0,14.
Algum modelo ficou mais barato hoje?
Sim. O Qwen3.6 27B cortou 17% no preço de saída (de US$ 2,40 para US$ 2,00 por milhão de tokens), o Qwen3 30B A3B ficou ligeiramente mais barato, e o Z.ai GLM 5.2 cedeu cerca de 6% no ajuste mais recente do dia.
Vale trocar de modelo por causa do reajuste do Flash?
Depende do volume. Para alto volume em tarefas leves, o DeepSeek V4 Pro 0423 (US$ 1,74) e o GPT-5.6 Luna (US$ 1,20) são alternativas próximas ao preço antigo do Flash. Recalcule o custo mensal antes de migrar.