Kimi K2.6 ficou 6% mais barato e ninguém mexeu no resto
Dois cortes e dois ajustes cosméticos no catálogo desta segunda-feira — o que muda de verdade na conta de quem já roda Kimi em produção.
Você acordou, abriu o painel da API e o Kimi K2.6 está 6% mais barato. Não foi barulho de release, não foi keynote — foi um ajuste silencioso de tabela que só aparece quando alguém compara o preço de ontem com o de hoje. E é exatamente esse tipo de mexida que mexe no boleto do fim do mês, mesmo quando ninguém faz post sobre isso.
O que mudou de verdade
Foram quatro alterações no catálogo nesta segunda-feira (29 de junho de 2026). Dois cortes reais e dois ajustes que, na prática, não mudam a fatura.
O corte que importa é o do Kimi K2.6, da MoonshotAI, e do seu irmão "Kimi Latest" — os dois andam com a mesma tabela de preço. O token de entrada caiu de US$ 0,66 para US$ 0,55 por milhão, e o de saída foi de US$ 3,41 para US$ 3,20. A razão entre novo e antigo é 0,94, ou seja, 6% mais barato em ambas as pontas.
O outro corte nominal é da StepFun com o Step 3.5 Flash: o token de entrada subiu um centavo de dólar, de US$ 0,09 para US$ 0,10 por milhão. Em proporção é um salto de 11%, mas em valor absoluto é um centavo — relevante só para quem roda volume muito grande. O preço de saída ficou parado em US$ 0,30.
A Z.ai mexeu no GLM 5.2: entrada de US$ 0,95 para US$ 0,94 por milhão, saída inalterada em US$ 3,00. É o tipo de ajuste que só aparece se você olhar com lupa.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| Kimi K2.6 | 3.41 | 3.2 | -6% |
| MoonshotAI Kimi Latest | 3.41 | 3.2 | -6% |
| Step 3.5 Flash | 0.3 | 0.3 | 0% |
| GLM 5.2 | 3 | 3 | 0% |
Para quem isso vale a pena
Se você já roda Kimi K2.6 em produção — chat longo, sumarização, agente — a conta de junho vai render menos do que a de julho, mesmo consumindo o mesmo volume. Em um cenário de 100 milhões de tokens de saída por mês, a diferença é de US$ 21. Pequeno? É. Mas é o tipo de economia que não exige migração, não exige refazer prompt e não troca fornecedor.
Para quem estava avaliando Kimi para um projeto novo, o argumento ficou um pouco melhor: a razão de preço entre entrada e saída continua em 5,8 vezes — Kimi cobra caro para falar, barato para ler — então continua valendo para workloads com muita leitura e pouca geração.
Para quem não muda nada
Se você usa Claude, Gemini, GPT ou qualquer modelo fora da MoonshotAI, hoje não é seu dia. O catálogo tem 477 modelos listados, 62 criadores, e só quatro mexeram de preço. Não há corte de fronteira, não há corte em modelo top de linha.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| GLM 5.2 | 52.6 | 3.036 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
O topo do mercado continua o mesmo: Claude Fable 5 (Anthropic) lidera o ranking de inteligência com IQ 62,073 a US$ 50 por milhão de saída; GLM 5.2 (Z.ai) é o segundo colocado em IQ (52,641) e o terceiro mais barato entre os modelos acima de IQ 45 — a US$ 3,036 por milhão de saída. Gemini 3.1 Pro Preview, Gemini 3.5 Flash e GPT-5.3-Codex completam o topo, todos sem mexer no preço.
O detalhe que ninguém comenta
Repare: o Kimi K2.6 e o Kimi Latest são listados como modelos diferentes no catálogo, mas andam com tabela idêntica. Isso é pista de que a MoonshotAI trata um como ponteiro do outro — quando você chama "Latest", está chamando o K2.6. Vale conferir no seu código antes de assumir que tem dois fornecedores diferentes na fila.
O outro detalhe é o Step 3.5 Flash. Um centavo de aumento em entrada parece irrelevante, mas é a primeira vez que esse modelo sobe de preço — e em proporção é o maior movimento do dia. Quem usa Step para pré-processamento massivo precisa fazer a continha.
O que fazer agora
Se Kimi já está no seu stack: recalcule a projeção de julho com os preços novos e veja se algum workload que estava no limite de orçamento agora cabe. Se você roda Step 3.5 Flash em alto volume, meça o impacto do centavo antes da próxima fatura. Se você está avaliando modelo novo, GLM 5.2 segue sendo o melhor custo-benefício acima de IQ 45 — e hoje está um centavo mais barato na entrada.
Recalcule a projeção de julho: Kimi K2.6 ficou 6% mais barato e isso cai direto na fatura de quem já o usa, sem exigir migração.
Perguntas frequentes
Quanto ficou o Kimi K2.6 hoje?
O token de entrada passou de US$ 0,66 para US$ 0,55 por milhão, e o de saída de US$ 3,41 para US$ 3,20 por milhão. É o mesmo preço aplicado ao Kimi Latest, que aparece como modelo separado no catálogo.
Algum modelo top de linha mudou de preço?
Não. Os cinco modelos mais bem posicionados em inteligência (Claude Fable 5, GLM 5.2, Gemini 3.1 Pro Preview, Gemini 3.5 Flash e GPT-5.3-Codex) mantiveram os preços de ontem. Os ajustes do dia foram em modelos de mid-tier e Flash.
Step 3.5 Flash subiu ou desceu de preço?
O token de entrada subiu de US$ 0,09 para US$ 0,10 por milhão (alta de 11% em proporção, mas um centavo em valor absoluto). O token de saída ficou em US$ 0,30 por milhão.