DeepSeek V4 Flash corta até 38,5% e aperta guerra de preços
O preço listado do Flash Latest caiu de US$ 0,18 para US$ 0,08 por milhão de tokens em reduções sucessivas. As versões Pro também ficaram mais baratas, mas a queda não muda automaticamente a qualidade do modelo.
Se você usa modelos em produção, a mudança que chega primeiro à fatura é direta: o DeepSeek V4 Flash Latest passou de US$ 0,13 para US$ 0,08 por milhão de tokens no OpenRouter, uma redução de 38,5%. Antes disso, o mesmo modelo já havia caído de US$ 0,18 para US$ 0,13, com corte de 27,8%.
A sequência torna o Flash uma ameaça maior em chamadas de alto volume. Mas há uma tensão importante no anúncio: os 38,5% valem para a segunda redução, não para todo o caminho desde US$ 0,18. A trajetória completa foi formada por dois cortes sucessivos.
O Flash ficou mais barato em duas frentes
O identificador deepseek-v4-flash-latest não foi o único a cair. O DeepSeek V4 Flash 0423 também teve duas reduções no preço listado: de US$ 0,12 para US$ 0,106, queda de 11,7%, e depois de US$ 0,106 para US$ 0,098, recuo de 7,9%.
Na prática, isso cria opções mais baratas tanto para quem acompanha a versão mais recente quanto para quem mantém uma versão datada por estabilidade. A diferença entre US$ 0,08 e US$ 0,098 por milhão parece pequena em uma chamada isolada. Em operações com milhões ou bilhões de tokens, ela passa a disputar espaço diretamente no orçamento de inferência.
O OpenRouter registrou 12 mudanças de preço no dia. Nem todas foram cortes: o Kimi K2.6 apareceu em uma sequência de alta de US$ 2,28 para US$ 4 e retorno para US$ 2,28. O Qwen3 30B A3B também teve movimentos nos dois sentidos, de US$ 0,50 para US$ 0,52 e depois de volta a US$ 0,50.
As versões Pro também recuaram
A pressão não ficou restrita ao modelo de entrada. O DeepSeek V4 Pro 0813 caiu de US$ 3,564 para US$ 3,366 por milhão de tokens, redução de 5,6%. O DeepSeek V4 Pro 0423 passou de US$ 0,828 para US$ 0,794, queda de 4,1%.
Os cortes são menores que os do Flash, mas atingem modelos posicionados para tarefas mais exigentes. Para uma aplicação que alterna entre um modelo econômico e outro mais capaz, a redução do Pro diminui o custo das chamadas de escalonamento — aquelas em que o sistema abandona o modelo barato e envia o caso para uma opção mais robusta.
Isso vale especialmente para agentes, automações com várias etapas e fluxos de programação. Ainda assim, o preço menor não informa latência, taxa de erro, disponibilidade ou desempenho na tarefa específica da sua aplicação. A economia só existe se o modelo continuar entregando uma resposta utilizável.
Preço baixo não significa liderança em inteligência
As notas de inteligência, código e desempenho agêntico do Artificial Analysis ajudam a separar custo de capacidade. O ranking de melhor custo-benefício traz o DeepSeek V4 Flash 0731 em terceiro lugar, com nota de inteligência de 51,8 e preço listado de US$ 0,66 por milhão de tokens.
Esse número não deve ser confundido com o preço do Flash Latest, de US$ 0,08, nem com uma prova de que as duas versões têm a mesma avaliação. São entradas diferentes no catálogo. O dado mostra apenas que preço e desempenho precisam ser comparados no mesmo modelo, na mesma configuração e com a mesma métrica.
No topo de inteligência do Artificial Analysis, o Claude Opus 5 com raciocínio adaptativo e esforço máximo aparece com nota 63,1 e preço de US$ 10 por milhão de tokens. O Grok 4.6, com esforço alto, tem nota 60,9 e preço de US$ 3. A comparação deixa claro o trade-off: o DeepSeek mira o custo operacional, enquanto os modelos no topo cobram mais por uma faixa maior de capacidade medida.
Quem ganha e quem não precisa trocar
A redução beneficia quem roda classificação, extração, atendimento, geração estruturada e outras tarefas repetitivas em grande escala. Também interessa a equipes que já validaram o DeepSeek e precisam reduzir a fatura sem redesenhar o produto.
Para quem usa o modelo apenas em testes ocasionais, a diferença tende a ser pequena na conta. E, para quem depende de qualidade superior, contexto específico, ferramentas ou comportamento agêntico, trocar apenas pelo preço pode aumentar retrabalho e custo indireto.
A decisão prática é testar o Flash com tráfego representativo e comparar a taxa de respostas aceitas, não apenas o preço por token. Se a qualidade se mantiver, o corte de US$ 0,13 para US$ 0,08 deve ser refletido imediatamente no modelo de custos; se não se mantiver, a economia na API pode reaparecer como gasto de revisão, chamadas extras e falhas em produção.
Se o DeepSeek V4 Flash passar no seu teste de qualidade, o preço de US$ 0,08 por milhão de tokens é motivo suficiente para recalcular a rota principal da API.
Perguntas frequentes
Quanto custa o DeepSeek V4 Flash Latest no OpenRouter?
O preço listado caiu para US$ 0,08 por milhão de tokens. A redução mais recente foi de 38,5%, depois de uma queda anterior de US$ 0,18 para US$ 0,13.
O DeepSeek V4 Pro também ficou mais barato?
Sim. O DeepSeek V4 Pro 0813 caiu para US$ 3,366 por milhão de tokens, enquanto o V4 Pro 0423 recuou para US$ 0,794. As reduções foram de 5,6% e 4,1%, respectivamente, segundo os preços listados no OpenRouter.
O preço menor prova que o DeepSeek V4 Flash é o melhor modelo?
Não. O Artificial Analysis mede inteligência e outras capacidades separadamente, e a entrada do Flash 0731 aparece com nota de inteligência de 51,8 e preço de US$ 0,66. O preço do Flash Latest e a avaliação do Flash 0731 são dados de versões diferentes.