Kimi K2.5 da MoonshotAI cobra US$ 2,25 por milhão de tokens de saída
Lançado há dois dias, o modelo multimodal de 262K de contexto não tem score de IQ publicado no catálogo — então a conta é o único número firme para decidir.
A MoonshotAI soltou o release do Kimi K2.5 com duas frases de efeito: "state-of-the-art visual coding capability" e "paradigma de enxame de agentes auto-dirigidos". Bonito, mas se você abrir a ficha do catálogo hoje, dois dias depois do lançamento, vai encontrar uma ausência reveladora: não tem IQ publicado, não tem nota de coding, não tem nota agentic. Só preço.
E preço é o que te deixa decidir alguma coisa agora.
O que está (e o que não está) na ficha
| Campo | Valor |
|---|---|
| Identificador | moonshotai/kimi-k2.5 |
| Criador | moonshotai |
| Preço de entrada | US$ 0.450 / M tokens |
| Preço de saída | US$ 2.25 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.070 / M (84% de desconto) |
Kimi K2.5 cobra US$ 0,45 por milhão de tokens de entrada, US$ 2,25 por milhão de tokens de saída e US$ 0,07 para leitura em cache. Aceita texto e imagem, devolve só texto. Contexto de 262.144 tokens. Não é gratuito. O catálogo também não informa país de origem, número de parâmetros, se tem pesos abertos nem data de corte de conhecimento — então qualquer promessa de "SOTA" baseada nessas lacunas é marketing olhando para o seu lado, não benchmark olhando para o modelo.
Onde ele cai no tabuleiro de preços
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
A US$ 2,25 por milhão de tokens de saída, o K2.5 entra no meio do pacote. É menos da metade do Claude Haiku 4.5 (US$ 5,00) e quase quatro vezes mais barato que o o3 (US$ 8,00), mas custa sete vezes mais que o Xiaomi MiMo-V2-Flash (US$ 0,30) e treze vezes mais que o gpt-oss-120b (US$ 0,17). E aqui vai o detalhe que o release não destaca: os dois mais baratos não são multimodais. A conta do K2.5 só faz sentido se você for usar a parte de visão — caso contrário, o catálogo tem opções mais baratas para texto puro.
O que tem dentro — e o que esperar
A descrição fala em aproximadamente 15T de tokens de pré-treinamento continuado sobre a base Kimi K2, e o tal enxame de agentes é a peça mais diferenciada: em vez de você encadear chamadas de ferramenta, o modelo distribui tarefas entre sub-agentes por conta própria. É a mesma direção que OpenAI e Anthropic estão empurrando, mas chegando por outro caminho. Pense num coordenador de equipe que escala o time sozinho — o press release quer que você imagine isso, mas sem score de agentic publicado, é exatamente isso que você não consegue medir ainda.
O catálogo lista mais de 326 modelos hoje — e esse número é um piso, só conta quem ainda está ativo. Desses, 13 foram lançados nos últimos 30 dias. Entrar no catálogo sem score num volume desses é chamar atenção para o que falta, não para o que tem.
Para quem vale — e para quem não
Vale para quem precisa de entrada multimodal com contexto longo. 262 mil tokens é folga para despejar um PDF técnico inteiro, um repositório de código ou uma base de screenshots de UI. Se a sua pipeline hoje está em cima do Haiku 4.5 ou do o3 só porque você precisa entender imagem, o K2.5 entra como substituto plausível a US$ 2,25 por milhão de tokens de saída.
Não muda nada para quem roda carga de produção puramente textual, para quem já mira o topo do índice de IQ — o catálogo aponta o MiMo-V2-Flash com 34,024 e o o3 com 31,096 como líderes atuais — ou para quem precisa de pesos abertos, já que o catálogo não informa se o K2.5 é aberto.
Para protótipo multimodal com contexto longo, o preço convida ao teste agora; para mover carga de produção, espere IQ e agentic aparecerem na ficha antes de trocar o que já está rodando.
Perguntas frequentes
Quanto custa o Kimi K2.5?
O catálogo lista US$ 0,45 por milhão de tokens de entrada, US$ 2,25 por milhão de tokens de saída e US$ 0,07 para leitura em cache. Não há camada gratuita publicada.
O Kimi K2.5 é multimodal?
Sim, no formato texto+imagem→texto, com 262.144 tokens de contexto. O catálogo não informa separadamente preço para tokens de imagem.
Kimi K2.5 serve para coding?
O release cita "state-of-the-art visual coding capability", mas o catálogo ainda não publicou nota de coding nem de IQ para o modelo — então, por enquanto, é promessa de release, não benchmark medido.