FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Kimi K3 cobra US$ 15 por milhão de tokens — um terço do Claude Fable 5

Modelo aberto de 2,8T de parâmetros da MoonshotAI entra com IQ 59,7 e abre a briga com o GPT-5.6 Sol pela faixa de IQ 60.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de saída no Kimi K3
IQ 59,7terceiro lugar no índice geral de hoje
2,8Tparâmetros totais no modelo open-weight

Pensa na seguinte conta: você roda um agente que cospe 1 milhão de tokens por dia e está decidindo entre Claude Fable 5 e Kimi K3. Com a Anthropic, paga US$ 50/dia só de saída. Com a MoonshotAI, US$ 15. Em 30 dias, a diferença é US$ 1.050 — quase uma assinatura de SaaS a menos, ou a mais, dependendo do que o K3 deixa na mesa.

US$ 15 por milhão: o preço que entra na briga dos US$ 10–12

O Kimi K3, lançado hoje pela MoonshotAI, cobra US$ 15 por milhão de tokens de saída, US$ 3 por milhão de entrada e US$ 0,30 por milhão em cache. É um posicionamento curioso: ele chega US$ 5 mais caro por milhão que o GPT-5.6 Sol (US$ 10), mas US$ 35 mais barato que o Claude Fable 5 (US$ 50), que lidera o índice geral de inteligência com IQ 62,073.

Preço de saída (US$ por milhão de tokens)
Kimi K315Claude Fable 550GPT-5.6 Sol10GPT-5.6 Terra12MiniMax M31,2GPT-5.6 Luna1,2US$/M
Fonte: OpenRouter

Em IQ, o K3 marca 59,699 — terceiro lugar no índice de hoje, a 0,62 ponto do Sol (60,93) e 3,12 pontos do Terra (56,576). É uma faixa apertada, em que benchmark sozinho não decide compra.

A força em coding que justifica o preço

O recorte de coding é onde o K3 aparece forte: 76,239. Não é o maior já visto, mas coloca o modelo num patamar que poucos rivais diretos encostam. O GPT-5.6 Sol não publica esse recorte no catálogo de hoje, então a comparação direta fica difícil — quem roda geração de código em volume vai querer testar antes de decidir.

Inteligência × preço de saída
Kimi K3Claude Fable 5GPT-5.6 SolGPT-5.6 TerraMiniMax M3GPT-5.6 LunaUS$ por milhão (saída, escala log)índice de inteligência

E tem um detalhe que o release da MoonshotAI não esconde: é open-weight, com 2,8 trilhões de parâmetros totais e 104 bilhões ativos. Pense num restaurante com 2.800 chefs no quadro, mas só 104 trabalhando em cada pedido — o resto fica de reserva para quando o prato exige. É a arquitetura MoE pesada, e a maior parte do custo de inferência vem dos especialistas ativos. Para quem tem GPU própria, o "preço por milhão" do catálogo é só um valor de referência: o custo real pode cair bastante em self-hosting.

Para quem o K3 vale — e para quem sobra

Vai trocar Claude Fable 5 pelo K3? Provavelmente não, se você precisa daqueles 2,4 pontos extras de IQ em tarefas de raciocínio longas. Mas se o seu gargalo é coding ou workflow agentic, e você já estava pagando Anthropic só pelo índice geral, vale testar — a fatura de saída cai 70% e a perda de raciocínio pode ser tolerável no seu caso.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Kimi K3 (o novo)59.73151.05M
Claude Fable 562.110501M
GPT-5.6 Sol60.92101.05M
GPT-5.6 Terra56.62121.05M
MiniMax M345.40.31.21.05M
GPT-5.6 Luna52.30.21.21.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Do outro lado: se a busca é o menor preço possível sem abrir mão de um mínimo de IQ, nada aqui muda. O GPT-5.6 Luna (IQ 52,3, US$ 1,20/milhão) e o DeepSeek V4 Pro (IQ 45,3, US$ 1,74/milhão) continuam custando uma fração. O K3 concorre na faixa dos US$ 10–15, não na dos US$ 1,20.

O lote do dia: a versão batch

A MoonshotAI também soltou hoje o Kimi K3 (batch) — mesmo preço de entrada e saída, mesmo contexto de 1.048.576 tokens. Para cargas assíncronas que toleram latência maior, é o mesmo modelo pelo mesmo valor, só muda o SLA de processamento.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Kimi K3 (batch)3151.05M

O que fazer amanhã

Se você já roda OpenAI ou Anthropic como padrão e o orçamento apertou, esse é o ponto de entrada para testar um modelo chinês de fronteira sem vender nada: custa menos que Claude, é mais capaz que Luna, e vem com pesos abertos. O teste mínimo é rodar seu benchmark interno de coding — é onde o K3 tem a melhor chance de pagar a própria conta antes do fim do mês.

Em uma frase

Se você paga Claude só pelo índice geral, vale rodar seu benchmark interno de coding no K3 antes de renovar — pode cortar 70% da fatura sem perder o trabalho que importa.

Perguntas frequentes

Kimi K3 é melhor que Claude Fable 5?

Não no índice geral: o Claude Fable 5 lidera com IQ 62,073 e o K3 marca 59,699. Em coding, o K3 chega a 76,239; o Claude não publica esse recorte no catálogo de hoje, então a comparação direta fica em aberto. A diferença de IQ é pequena e depende do workload — e o K3 custa US$ 15/milhão de saída contra US$ 50 do Claude.

Quanto custa o Kimi K3 por milhão de tokens?

US$ 3 por milhão de tokens de entrada, US$ 15 por milhão de saída e US$ 0,30 por milhão em cache. O contexto é 1.048.576 tokens. A MoonshotAI também lançou hoje a versão batch, com o mesmo preço, voltada a cargas assíncronas que toleram latência maior.

Kimi K3 é open source?

O catálogo marca open_weights como verdadeiro: os pesos podem ser baixados e há 2,8 trilhões de parâmetros totais com 104 bilhões ativos. Isso habilita self-hosting em GPU própria, mas não é sinônimo de licença permissiva de código aberto — vale conferir a licença exata antes de redistribuir.

Leia também