FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Cinco modelos ficaram até 80% mais caros em um único dia

Os cortes foram poucos e concentrados em variantes Flash; quem usava Kimi K2.6 ou DeepSeek V4 Pro viu a fatura mudar sem aviso.

Redação FalaVIP IA 3 min de leitura
US$ 3,564preço de saída por milhão de tokens do DeepSeek V4 Pro 0813 (era US$ 1,98)
1,8xmultiplicador do reajuste em DeepSeek V4 Pro 0813 e Qwen3.6 27B
5 cortesfrente a 5 aumentos nas 10 mudanças do dia

Você abre o painel de cobrança, confere o gasto do dia anterior e percebe que está 80% mais alto sem ter mudado uma linha de código. Foi exatamente isso que aconteceu com quem rodava DeepSeek V4 Pro 0813, Qwen3.6 27B ou Kimi K2.6 até ontem: em 20 de agosto de 2026, esses três modelos tiveram reajuste de preço simultâneo, e na mesma direção — para cima.

O dia em que cinco modelos subiram e cinco desceram

Foram dez mudanças de preço registradas em um único dia, divididas no meio: cinco aumentos e cinco cortes. Os cortes, porém, não chegam a compensar os repiques. O maior deles foi no Kimi K2.6 em uma de suas variantes, que caiu de US$ 0,9405 para US$ 0,5605 por milhão de tokens de entrada — uma redução de 40%. Os outros quatro cortes mexeram em centavos de variantes Flash da DeepSeek, todas com variações entre 6% e 9%. Nada que redesenhe a fatura.

Variação do preço de saída (%)
DeepSeek V4 Pro 081380Qwen3.6 27B80Kimi K2.669Kimi K2.6-40DeepSeek V4 Pro 042311DeepSeek V4 Flash Latest-8DeepSeek V4 Flash 04237DeepSeek V4 Flash 0423-6%

Já os aumentos mexem com quem realmente paga conta pesada no fim do mês. O DeepSeek V4 Pro 0813 saltou de US$ 1,98 para US$ 3,564 por milhão de tokens de saída — multiplicador de 1,8x. O Qwen3.6 27B acompanhou o ritmo, indo de US$ 2 para US$ 3,60. O Kimi K2.6, em outra variante, subiu de US$ 2,36 para US$ 4 por milhão de tokens de saída, o maior valor absoluto entre as mudanças do dia.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
DeepSeek V4 Pro 08131.983.564+80%
Qwen3.6 27B23.6+80%
Kimi K2.62.364+69%
Kimi K2.63.962.36-40%
DeepSeek V4 Pro 04232.883.2+11%
DeepSeek V4 Flash Latest0.1530.14-8%
DeepSeek V4 Flash 04230.16520.1772+7%
DeepSeek V4 Flash 04230.17360.1624-6%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Quem aperta e quem alivia

Repare no padrão: todas as variações positivas aconteceram em modelos de capacidade alta, aqueles que aparecem quando você precisa de resposta mais sólida em código, raciocínio longo ou análise. As quedas se concentraram em variantes Flash — modelos pensados para latência baixa e custo baixo, normalmente usados em classificar texto, resumir, fazer pré-filtragem.

É a mesma lógica de uma operadora de telefonia: sobe o plano pós-pago completo, dá um desconto marginal no pré-pago com franquia. O cliente corporativo paga a conta maior para compensar o desconto no varejo.

Onde isso te pega de verdade

Se você roda DeepSeek V4 Pro 0813 em produção para gerar conteúdo longo, análise de documentos ou agente com tool calling pesado, a próxima fatura vai chegar com um susto. Para ter ordem de grandeza: uma chamada que custava US$ 1,98 por milhão de tokens de saída agora custa US$ 3,564. Em volume, é a diferença entre caber no orçamento e precisar renegociar com o time financeiro.

Se sua operação depende do Kimi K2.6 com saída a US$ 2,36, prepare-se para US$ 4 — quase 70% a mais. Qwen3.6 27B, mesma toada. Os três são modelos chineses, e o movimento conjunto sugere mais coordenação de tabela do que decisão isolada de cada laboratório.

E quem se dá bem hoje

Olhando para o restante do catálogo, a faixa de baixo custo segue intacta. O DeepSeek V4 Flash 0731 continua na frente entre modelos com IQ acima de 45, cobrando US$ 0,18 por milhão de tokens de saída. O catálogo soma mais de 555 modelos ativos hoje, vindos de 70 criadores diferentes, com 39 lançamentos só nos últimos 30 dias — a competição não desapareceu, só apertou nas pontas.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 555 modelos disponíveis no catálogo nesta data.

O que fazer antes do fim do dia

Primeiro: confira qual modelo está atrás de cada endpoint na sua fatura. Se algum dos três reajustados está ali, calcule o novo custo mensal com o tráfego real de julho e agosto — não com a média do trimestre, porque o multiplicador distorce em volume. Segundo: teste substituto na mesma faixa de capacidade. DeepSeek V4 Pro 0423, por exemplo, subiu só 11% (de US$ 2,88 para US$ 3,20 por milhão de saída), e ainda entrega a família V4 Pro com qualidade próxima. Terceiro: se a fatura apertar, vale mover workloads menos críticos para as variantes Flash — que, aliás, ficaram mais baratas hoje.

A regra prática para hoje: reajuste de preço em capacidade alta pede renegociação interna; corte em variante Flash pede redistribuição de carga.

Em uma frase

Quem usa os modelos chineses Pro/K2/Qwen3.6 precisa recalcular a fatura ainda hoje e testar substituto na família V4 antes de fechar agosto.

Perguntas frequentes

Quais modelos ficaram mais caros em 20 de agosto de 2026?

DeepSeek V4 Pro 0813, Qwen3.6 27B e Kimi K2.6 (em duas variantes diferentes). Os três tiveram reajuste próximo de 1,7x a 1,8x no preço de saída por milhão de tokens, com o Kimi K2.6 chegando a US$ 4.

Algum modelo ficou mais barato no mesmo dia?

Sim, cinco modelos tiveram corte — quatro deles variantes Flash da DeepSeek com variações entre 6% e 9%, e o Kimi K2.6 em uma das variantes, que caiu de US$ 0,9405 para US$ 0,5605 por milhão de tokens de entrada.

Vale trocar de modelo depois desse reajuste?

Depende do workload. Para tarefas sensíveis a custo, as variantes Flash da DeepSeek continuam na faixa mais barata do mercado com IQ acima de 45. Para capacidade alta, vale testar o DeepSeek V4 Pro 0423, que subiu apenas 11% e fica abaixo dos US$ 3,20 por milhão de tokens de saída.

Leia também