Kimi K2 0905 entra sem benchmark no catálogo, a US$ 2,50 por milhão
A revisão de setembro da MoonshotAI entrega 1 trilhão de parâmetros e 262 mil tokens de contexto, mas deixa em branco as notas que permitiriam comparar.
Você abriu o catálogo procurando modelo novo e encontrou um lançamento com 1 trilhão de parâmetros totais, 262 mil tokens de contexto e nenhum benchmark publicado. Foi o que aconteceu nesta semana com o Kimi K2 0905, a atualização de setembro da MoonshotAI que está no ar há cinco dias.
O 0905 não é um modelo novo: é a revisão de setembro do Kimi K2 0711, lançado em julho. Mesma família, mesmo esqueleto. MoE, 1 trilhão de parâmetros totais, fração ativa de 32 bilhões por inferência, e conhecimento de mundo cortado em 31 de dezembro de 2024. O que muda entre as duas versões é ajuste fino — o release não diz exatamente o quê.
A conta: nem barata, nem absurda
O Kimi K2 0905 custa US$ 0,60 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída. O catálogo não publicou preço de cache, então qualquer plano que dependa de prompt cacheado vira chute.
Para situar: o OpenAI o3, hoje o topo de inteligência do catálogo, sai por US$ 8,00 por milhão de tokens de saída. O Kimi é cerca de 69% mais barato que o o3 na saída. Mas o gpt-oss-120b, da própria OpenAI, sai por US$ 0,17 — e o Llama 4 Maverick, da Meta, por US$ 0,696. Em outras palavras, o "barato contra o topo" não significa "barato contra o resto do mercado". É um posicionamento intermediário, não um estouro de preço.
O buraco dos benchmarks
Aqui mora o problema real deste lançamento. O Kimi K2 0905 chegou ao catálogo sem nota de inteligência, sem nota de código, sem nota agentic, sem blended. Tudo zerado. Você consegue ler o preço, consegue ler a janela de contexto, mas não consegue compará-lo a mais nada de forma direta.
Com 16 modelos lançados nos últimos 30 dias, isso é mais grave do que parece. Você não está escolhendo entre dois — está escolhendo entre dezenas. E o catálogo te obriga a ir atrás de benchmark externo para tomar uma decisão que poderia estar a dois cliques.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
| Llama 4 Scout | 10.3 | 0.3 |
Onde o 0905 tenta se diferenciar
A janela de contexto. São 262.144 tokens, suficiente para enfiar um repositório inteiro de código, um livro grande ou uma base de documentação inteira num único prompt. É, junto com o preço de saída mais baixo que o do o3, o único argumento de venda que o catálogo entrega sem ambiguidade.
| Campo | Valor |
|---|---|
| Identificador | moonshotai/kimi-k2-0905 |
| Criador | moonshotai |
| Preço de entrada | US$ 0.600 / M tokens |
| Preço de saída | US$ 2.50 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text->text |
Se o seu caso de uso é exatamente esse — processar documentos enormes, manter coerência em conversas longas, analisar bases de código extensas — o 0905 entra na lista. Não no topo (a nota de inteligência do o3 está em 31 contra nada no Kimi), mas como alternativa de menor custo para uma classe específica de tarefas.
Para quem vale, para quem não vale
Vale se você precisa de janela muito grande, está disposto a pagar US$ 2,50 por milhão de tokens de saída e aceita não ter benchmark de catálogo publicado. Não vale se você está otimizando custo em tarefas padrão: há opções com inteligência medida e preço de saída abaixo de US$ 1,00 por milhão. Não vale se você precisa do topo absoluto de raciocínio — nesse caso, o o3 (ou o que estiver acima dele) continua sendo a referência com nota no catálogo. E não vale, por ora, se a sua governança exige números auditáveis: sem benchmark publicado, não tem como defender a escolha em comitê.
A implicação prática é simples: antes de migrar qualquer fluxo para o 0905, rode um teste seu, com seu caso, e meça. O catálogo não vai te dar essa resposta.
Antes de migrar qualquer fluxo para o Kimi K2 0905, rode um teste com seu próprio caso — o catálogo não entrega benchmark, então a conta de API e a qualidade são conta sua.
Perguntas frequentes
Quanto custa o Kimi K2 0905 na API?
US$ 0,60 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída, segundo o catálogo. O preço de cache não foi publicado, então qualquer economia com prompt cacheado precisa ser confirmada direto com o provedor.
O Kimi K2 0905 tem benchmark publicado no catálogo?
Não. O modelo entrou sem nota de inteligência, código ou agentic. Para comparar com o restante do mercado, é preciso buscar benchmark externo ou rodar o próprio teste antes de colocar em produção.
Quando o Kimi K2 0905 faz sentido?
Em tarefas que dependem de janela muito grande — repositórios inteiros, livros ou bases longas de documentação. Para fluxos padrão sensíveis a custo, há alternativas mais baratas e com nota de inteligência medida no catálogo.