Kimi K2.6 ficou 38% mais caro num dia em que o resto do mercado cortou preço
Das oito mudanças de tabela em 1º de agosto de 2026, seis foram cortes. A única alta relevante veio da MoonshotAI, e destoa do movimento geral.
Seis quedas, dois reajustes, e a única alta relevante veio da MoonshotAI. O Kimi K2.6 viu o preço de saída saltar de US$ 2,48 para US$ 3,41 por milhão de tokens — alta de 38% — justamente no dia em que Z.ai, DeepSeek e Qwen mexeram a tabela para baixo. É o tipo de movimento que merece lupa, porque ele sozinho quebra a média do dia.
O que mexeu hoje
Em 1º de agosto de 2026, oito modelos tiveram preço alterado no catálogo. Seis cortaram, dois subiram. Não é uma semana comum: a média do dia é de queda. O detalhe é que uma das duas altas pesa mais do que todas as outras juntas — em valor absoluto de saída, é a maior da lista.
A DeepSeek foi quem mais agressivamente puxou o preço para baixo em proporção entre os modelos relevantes: o DeepSeek V4 Flash 0731 foi de US$ 0,14 para US$ 0,09 por milhão de tokens de entrada, e a saída caiu de US$ 0,28 para US$ 0,18. Em tokens de saída, a redução foi de 36%.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| GLM 5.2 | 2.2528 | 1.32 | -41% |
| DeepSeek V4 Flash 0731 | 0.28 | 0.18 | -36% |
| GLM 5.2 | 3.52 | 2.3888 | -32% |
| Kimi K2.6 | 2.48 | 3.41 | +38% |
| Inkling Small | 1.44 | 1.2 | -17% |
| gpt-oss-20b | 0.14 | 0.13 | -7% |
| GLM 5.2 | 2.3888 | 2.2528 | -6% |
| Qwen3 Coder 30B A3B Instruct | 0.27 | 0.28 | +4% |
Z.ai cortou o GLM 5.2 três vezes
O GLM 5.2 apareceu três vezes na lista de mudanças. Não é bug: são tiers diferentes do mesmo modelo, e todos caíram. O mais agressivo foi o tier de entrada — input foi de US$ 0,7168 para US$ 0,42 por milhão, queda de 41%. A saída do mesmo tier foi de US$ 2,25 para US$ 1,32.
Para quem já usa Z.ai, o efeito composto é grande: o tier mais barato agora custa menos da metade do que custava no começo do mês. Para quem não usa, o sinal é que Z.ai está brigando agressivamente por volume — provavelmente porque os índices de inteligência do GLM 5.2 não estão entre os primeiros do catálogo, então a tática padrão é preço.
DeepSeek segue como o chão da tabela
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
O V4 Flash 0731 permanece como o modelo mais barato acima de IQ 45 no catálogo: US$ 0,18 por milhão de tokens de saída, com IQ 51,767. Para você que roda prompt em escala — agente, classificação, geração curta — e não precisa de raciocínio pesado, é a referência. O segundo mais barato acima desse limiar é o GPT-5.6 Luna, da OpenAI, a US$ 1,20 — quase sete vezes mais.
A analogia é a do hotel econômico bem localizado: o V4 Flash é o hostel com nota 7,5 em localização 9. Você não vai levar a sogra pra lá, mas se a viagem é de trabalho, é onde você fica.
A exceção que destoa: Kimi K2.6
O Kimi K2.6 é da mesma família do Kimi K3, que aparece no topo da tabela de inteligência (IQ 59,699). Mas o K2.6 é geração anterior e provavelmente estava sendo descontinuado com desconto. O reajuste de hoje tira esse desconto: input subiu de US$ 0,589 para US$ 0,60 (simbólico), mas a saída saltou de US$ 2,48 para US$ 3,41.
É movimento clássico de quem reorganiza portfólio. Se o K3 é a vitrine a US$ 15 por milhão de saída, o K2.6 não faz sentido como "irmão barato" — então deixa de ser barato. Para quem estava usando K2.6 só porque era a versão acessível da MoonshotAI, a recomendação é migrar: ou para o K3 (mais caro, mais capaz), ou para DeepSeek V4 Flash (mais barato, IQ parecido).
Para quem essa tabela muda alguma coisa
- Roda volume com modelo chinês de baixo custo? Migrar do GLM 5.2 para o tier mais barato do mesmo modelo agora é mais barato do que nunca. Aproveitar.
- Tinha Kimi K2.6 no pipeline? Hora de reavaliar. O custo de saída subiu 38%, e o "poupança" da geração anterior evaporou.
- Toca agente ou função barata? DeepSeek V4 Flash segue sendo o piso de referência. Ele ficou ainda mais barato hoje.
O que não muda: o topo da tabela de inteligência segue dominado por Claude Opus 5 (IQ 63,053, US$ 25 de saída) e pela linha GPT-5.6. Nenhum modelo premium foi tocado hoje.
O que fazer na segunda-feira
Olhe sua fatura de API de julho e separe: quanto você gastou com Kimi K2.6, GLM 5.2 e DeepSeek V4 Flash somados? Se essa fatura existe, ela ficou defasada em um único dia. Re-rodar a calculadora de custo com os preços de hoje leva menos de cinco minutos e pode cortar uma fração real do boleto do mês — ou, no caso do K2.6, evitar uma surpresa em agosto.
Revise hoje mesmo o custo de Kimi K2.6 (que subiu 38% na saída), capture os novos tiers do GLM 5.2 (até 41% mais barato) e migre cargas de baixo raciocínio para o DeepSeek V4 Flash, que segue a US$ 0,18 por milhão de saída.
Perguntas frequentes
Por que o Kimi K2.6 ficou mais caro?
Padrão típico de fim de geração: o K3 é a vitrine da MoonshotAI a US$ 15 por milhão de saída, então manter o K2.6 barato deixaria de fazer sentido estratégico. O ajuste de hoje tira o desconto da geração anterior e reposiciona o K2.6 acima da referência da casa.
Vale migrar para o DeepSeek V4 Flash?
Depende do caso. Para prompts de baixo raciocínio — classificação, agente simples, geração curta — o V4 Flash é a referência de piso no catálogo, agora ainda mais barato a US$ 0,18 por milhão de saída. Para tarefas que exigem raciocínio forte, o IQ 51,767 não substitui Claude Opus 5 ou GPT-5.6 Sol.
O GLM 5.2 apareceu três vezes na lista — o que aconteceu?
São três tiers do mesmo modelo, todos cortados no mesmo dia. O tier mais barato caiu 41% no input e 41% no output. O efeito prático é que o GLM 5.2 ficou significativamente mais competitivo dentro da própria linha da Z.ai, possivelmente como reação à pressão de preço da DeepSeek.