Cinco modelos ficaram até 80% mais caros em um único dia
Os cortes foram poucos e concentrados em variantes Flash; quem usava Kimi K2.6 ou DeepSeek V4 Pro viu a fatura mudar sem aviso.
Você abre o painel de cobrança, confere o gasto do dia anterior e percebe que está 80% mais alto sem ter mudado uma linha de código. Foi exatamente isso que aconteceu com quem rodava DeepSeek V4 Pro 0813, Qwen3.6 27B ou Kimi K2.6 até ontem: em 20 de agosto de 2026, esses três modelos tiveram reajuste de preço simultâneo, e na mesma direção — para cima.
O dia em que cinco modelos subiram e cinco desceram
Foram dez mudanças de preço registradas em um único dia, divididas no meio: cinco aumentos e cinco cortes. Os cortes, porém, não chegam a compensar os repiques. O maior deles foi no Kimi K2.6 em uma de suas variantes, que caiu de US$ 0,9405 para US$ 0,5605 por milhão de tokens de entrada — uma redução de 40%. Os outros quatro cortes mexeram em centavos de variantes Flash da DeepSeek, todas com variações entre 6% e 9%. Nada que redesenhe a fatura.
Já os aumentos mexem com quem realmente paga conta pesada no fim do mês. O DeepSeek V4 Pro 0813 saltou de US$ 1,98 para US$ 3,564 por milhão de tokens de saída — multiplicador de 1,8x. O Qwen3.6 27B acompanhou o ritmo, indo de US$ 2 para US$ 3,60. O Kimi K2.6, em outra variante, subiu de US$ 2,36 para US$ 4 por milhão de tokens de saída, o maior valor absoluto entre as mudanças do dia.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| DeepSeek V4 Pro 0813 | 1.98 | 3.564 | +80% |
| Qwen3.6 27B | 2 | 3.6 | +80% |
| Kimi K2.6 | 2.36 | 4 | +69% |
| Kimi K2.6 | 3.96 | 2.36 | -40% |
| DeepSeek V4 Pro 0423 | 2.88 | 3.2 | +11% |
| DeepSeek V4 Flash Latest | 0.153 | 0.14 | -8% |
| DeepSeek V4 Flash 0423 | 0.1652 | 0.1772 | +7% |
| DeepSeek V4 Flash 0423 | 0.1736 | 0.1624 | -6% |
Quem aperta e quem alivia
Repare no padrão: todas as variações positivas aconteceram em modelos de capacidade alta, aqueles que aparecem quando você precisa de resposta mais sólida em código, raciocínio longo ou análise. As quedas se concentraram em variantes Flash — modelos pensados para latência baixa e custo baixo, normalmente usados em classificar texto, resumir, fazer pré-filtragem.
É a mesma lógica de uma operadora de telefonia: sobe o plano pós-pago completo, dá um desconto marginal no pré-pago com franquia. O cliente corporativo paga a conta maior para compensar o desconto no varejo.
Onde isso te pega de verdade
Se você roda DeepSeek V4 Pro 0813 em produção para gerar conteúdo longo, análise de documentos ou agente com tool calling pesado, a próxima fatura vai chegar com um susto. Para ter ordem de grandeza: uma chamada que custava US$ 1,98 por milhão de tokens de saída agora custa US$ 3,564. Em volume, é a diferença entre caber no orçamento e precisar renegociar com o time financeiro.
Se sua operação depende do Kimi K2.6 com saída a US$ 2,36, prepare-se para US$ 4 — quase 70% a mais. Qwen3.6 27B, mesma toada. Os três são modelos chineses, e o movimento conjunto sugere mais coordenação de tabela do que decisão isolada de cada laboratório.
E quem se dá bem hoje
Olhando para o restante do catálogo, a faixa de baixo custo segue intacta. O DeepSeek V4 Flash 0731 continua na frente entre modelos com IQ acima de 45, cobrando US$ 0,18 por milhão de tokens de saída. O catálogo soma mais de 555 modelos ativos hoje, vindos de 70 criadores diferentes, com 39 lançamentos só nos últimos 30 dias — a competição não desapareceu, só apertou nas pontas.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
O que fazer antes do fim do dia
Primeiro: confira qual modelo está atrás de cada endpoint na sua fatura. Se algum dos três reajustados está ali, calcule o novo custo mensal com o tráfego real de julho e agosto — não com a média do trimestre, porque o multiplicador distorce em volume. Segundo: teste substituto na mesma faixa de capacidade. DeepSeek V4 Pro 0423, por exemplo, subiu só 11% (de US$ 2,88 para US$ 3,20 por milhão de saída), e ainda entrega a família V4 Pro com qualidade próxima. Terceiro: se a fatura apertar, vale mover workloads menos críticos para as variantes Flash — que, aliás, ficaram mais baratas hoje.
A regra prática para hoje: reajuste de preço em capacidade alta pede renegociação interna; corte em variante Flash pede redistribuição de carga.
Quem usa os modelos chineses Pro/K2/Qwen3.6 precisa recalcular a fatura ainda hoje e testar substituto na família V4 antes de fechar agosto.
Perguntas frequentes
Quais modelos ficaram mais caros em 20 de agosto de 2026?
DeepSeek V4 Pro 0813, Qwen3.6 27B e Kimi K2.6 (em duas variantes diferentes). Os três tiveram reajuste próximo de 1,7x a 1,8x no preço de saída por milhão de tokens, com o Kimi K2.6 chegando a US$ 4.
Algum modelo ficou mais barato no mesmo dia?
Sim, cinco modelos tiveram corte — quatro deles variantes Flash da DeepSeek com variações entre 6% e 9%, e o Kimi K2.6 em uma das variantes, que caiu de US$ 0,9405 para US$ 0,5605 por milhão de tokens de entrada.
Vale trocar de modelo depois desse reajuste?
Depende do workload. Para tarefas sensíveis a custo, as variantes Flash da DeepSeek continuam na faixa mais barata do mercado com IQ acima de 45. Para capacidade alta, vale testar o DeepSeek V4 Pro 0423, que subiu apenas 11% e fica abaixo dos US$ 3,20 por milhão de tokens de saída.