DeepSeek V4 Pro mais que dobra preço de saída em 24 horas
O Pro da DeepSeek subiu 128% no output em um dia; no mesmo movimento, a Qwen 27B cortou 44% e a Z.ai 33%. Para quem escolhe modelo por preço, é hora de refazer a conta.
O Pro da DeepSeek ficou 2,28 vezes mais caro de um dia para o outro
Se sua esteira passa pelo DeepSeek V4 Pro, olha a fatura antes de dormir. Em 24 horas, o preço de saída do modelo saltou de US$ 0,87 para US$ 1,98 por milhão de tokens — uma alta de 128%. O input também subiu: de US$ 0,435 para US$ 0,66 por milhão (51,7% a mais). É o maior reajuste da rodada de hoje, e ele vem justamente do modelo que muita gente tinha colocado como "custo benefício alto" na pilha.
A mudança aparece no catálogo entre as alterações de preço do dia — no agregado, 3 altas e 8 cortes. É um dia em que, no saldo, a direção foi de barateamento, mas o Pro da DeepSeek foi na contramão.
Quem mais subiu
Dois outros modelos subiram, em proporções bem menores:
- Kimi K2.6 (MoonshotAI): passou de US$ 0,5415 para US$ 0,65 de input e de US$ 2,28 para US$ 3,41 de output em uma primeira mudança — alta de 50% no output. Não chega perto do Pro da DeepSeek, mas chamou atenção.
- Qwen3 30B A3B: reajuste discreto, de US$ 0,50 para US$ 0,52 de output (4%).
A Kimi K2.6, aliás, aparece duas vezes na lista do dia: depois da alta, voltou para US$ 0,5415 de input e US$ 2,28 de output em um corte novo. É como se a Moonshot tivesse testado o ponto, recuado e ajustado de novo dentro do mesmo dia. O número final do modelo está em US$ 0,5415 / US$ 2,28 — voltou ao nível de ontem, mas a oscilação mostra que o preço está sendo calibrado em tempo real.
Quem cortou — e essa é a boa notícia
A maioria das alterações do dia foi para baixo. O destaque é a Qwen3.6 27B: o output caiu de US$ 3,60 para US$ 2,00 por milhão de tokens (quase 44% de desconto), e o input foi de US$ 0,60 para US$ 0,30 — metade do que custava ontem. Para workloads que cabem num 27B, é a melhor notícia da semana.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| DeepSeek V4 Pro 0813 | 0.87 | 1.98 | +128% |
| Qwen3.6 27B | 3.6 | 2 | -44% |
| Kimi K2.6 | 2.28 | 3.41 | +50% |
| GLM 5.2 | 1.452 | 0.968 | -33% |
| Kimi K2.6 | 3.41 | 2.28 | -33% |
| Nemotron 3.5 Lightning | 0.25 | 0.2 | -20% |
| DeepSeek V4 Flash Latest | 0.1341 | 0.1206 | -10% |
| Qwen3 30B A3B | 0.5 | 0.52 | +4% |
A Z.ai GLM 5.2 também cortou: output de US$ 1,452 para US$ 0,968 (−33%), input de US$ 0,462 para US$ 0,308. A NVIDIA Nemotron 3.5 Lightning ficou um pouco mais barata (output de US$ 0,25 para US$ 0,20). E o DeepSeek V4 Flash Latest — atenção aqui — caiu de US$ 0,1341 para US$ 0,1206 no output. Puro centavo, mas a direção interessa: enquanto o Pro encareceu, o Flash ficou mais barato.
Onde isso te coloca no tabuleiro
Pense na DeepSeek como uma marca com dois andares. O Flash é a classe econômica: barato, rápido, serve para a maior parte do que se faz com LLM em produção. O Pro é a executiva: mais capacidade, paga-se caro. Acontece que a executiva acabou de ficar 2,28 vezes mais cara. Quem estava no Pro por causa do "custo benefício" precisa fazer a conta de novo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
Para situar: o topo do mercado hoje em inteligência medida continua sendo o Claude Opus 5, da Anthropic, com IQ 63,053 e output a US$ 25 por milhão. O GPT-5.6 Sol vem logo abaixo (IQ 60,93, US$ 10/M). O Pro da DeepSeek, em qualquer cenário, está bem abaixo do preço desses modelos — e em IQ também, segundo o snapshot de hoje do catálogo. Se o que você quer é o teto de capacidade, a conversa é outra. Se é preço por capacidade entregue, aí esse reajuste muda o cálculo.
Para comparar dentro do catálogo de hoje: o DeepSeek V4 Flash 0731, que lidera a lista de modelos baratos acima de IQ 45, sai a US$ 0,18 por milhão de output. Você consegue rodar mais de dez vezes mais tokens pelo mesmo dinheiro trocando do Pro para o Flash — se a sua tarefa couber no Flash.
O que fazer com a fatura amanhã
Três movimentos práticos, sem trocar de fornecedor:
- Se o Pro está num pipeline que cabe no Flash: rode o Flash V4 Latest em paralelo por uma semana, meça qualidade nas suas tarefas reais, e troque se a diferença for aceitável. A economia é de cerca de 94% no output (de US$ 1,98 para US$ 0,1206 por milhão).
- Se você precisa de capacidade de 27B ou maior: a Qwen3.6 27B agora está em US$ 2,00 de output — 44% mais barato do que ontem. Vale uma janela de teste como substituta do Pro.
- Se a Kimi K2.6 é o seu modelo principal: o preço final do dia voltou ao de ontem, mas em US$ 2,28 de output, vale comparar com a Qwen 27B, que hoje está mais barata no papel.
A regra geral do dia: o Pro da DeepSeek saiu da prateleira "barato" e entrou na "tem que justificar". Quem paga a conta de API precisa justificar.
Se o DeepSeek V4 Pro estava na sua pilha por preço, refaça a conta hoje: o output saltou de US$ 0,87 para US$ 1,98 por milhão. A alternativa barata dentro da mesma marca é o Flash, a US$ 0,12 por milhão.
Perguntas frequentes
DeepSeek V4 Pro subiu de preço hoje?
Sim. Em 16 de agosto de 2026, o preço de saída do DeepSeek V4 Pro saltou de US$ 0,87 para US$ 1,98 por milhão de tokens (alta de 128%), e o input passou de US$ 0,435 para US$ 0,66.
Qual modelo ficou mais barato hoje?
A Qwen3.6 27B lidera os cortes, com queda de 44% no preço de saída (de US$ 3,60 para US$ 2,00 por milhão). A Z.ai GLM 5.2 também caiu 33%, e o DeepSeek V4 Flash Latest ficou ligeiramente mais barato (de US$ 0,1341 para US$ 0,1206).
Vale trocar do Pro para o Flash da DeepSeek?
Depende da tarefa. O Flash V4 Latest custa US$ 0,1206 por milhão de output, contra US$ 1,98 do Pro — uma diferença de mais de 16x. Se a qualidade for aceitável nas suas tarefas, a economia é imediata e o caminho é óbvio.