Kimi K2.6 chega cobrando US$ 4 por milhão de saída — e abre família gratuita
MoonshotAI lança o K2.6 multimodal focado em coding longo e multi-agente, com variante gratuita no mesmo dia. O preço de saída cabe entre o MiMo da Xiaomi e o Gemini Pro da Google.
O que o release diz vs. o que a conta mostra
A MoonshotAI soltou hoje o Kimi K2.6 e a pergunta que importa pra você não é "ele é bom?", é "ele cabe no meu orçamento?". A resposta curta: depende do que você compara.
O K2.6 cobra US$ 0,95 por milhão de tokens de entrada e US$ 4 por milhão de tokens de saída. Tem cache a US$ 0,16 — útil se você reusa prompts grandes. O contexto é de 262.144 tokens, multimodal (texto+imagem → texto), e a descrição oficial fala em coding de longa duração, geração de UI/UX dirigida por código e orquestração multi-agente em Python, Rust e Go.
Traduzindo o marketing: o K2.6 não está brigando pelo topo de inteligência do catálogo. Está brigando pelo meio do pelotão, onde a maioria dos apps de produção realmente roda.
Onde ele se encaixa no tabuleiro
Olha o topo de hoje. O Gemini 3.1 Pro Preview da Google lidera o índice de inteligência com 47,7 e cobra US$ 12 de saída. O GPT-5.3-Codex da OpenAI vem logo atrás com 45,5 e sai a US$ 14. O MiMo-V2-Omni da Xiaomi aparece com 35,8 e cobra US$ 2.
O K2.6 entra entre o MiMo e o Gemini Pro no preço — US$ 4 de saída é o dobro do chinês e um terço do americano. É a faixa onde a MoonshotAI já vinha competindo e onde a conta da API começa a doer menos.
Para quem vale — e para quem não muda nada
Vale pra você se:
- Roda agente de coding que consome muito token de saída e precisa de contexto longo (262k é mais que suficiente pra boa parte dos repositórios reais).
- Quer multimodal barato pra ler prints, diagramas e PDFs sem pagar tarifa Pro.
- Já está no ecossistema MoonshotAI e quer manter o stack.
Não muda nada se:
- Você precisa do melhor raciocínio absoluto do mercado — Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem na frente.
- Sua carga é dominada por entrada (RAG, embeddings, classificação) e pouco saída — a diferença de US$ 0,95 vs. US$ 0,60 some no fim do mês.
- Você precisa de benchmark público pra justificar a escolha internamente: o K2.6 entrou hoje sem índice de inteligência publicado.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Qianfan-OCR-Fast (o novo) | — | 0.68 | 2.81 | 66k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
A família completa do dia
A MoonshotAI não soltou só o modelo pago. No mesmo pacote veio o Kimi K2.6 (free), com a mesma janela de 262k tokens e preço zerado de entrada e saída. É a versão que você testa antes de assinar.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Qianfan-OCR-Fast (free) | 0 | 0 | 66k |
| Campo | Valor |
|---|---|
| Identificador | baidu/qianfan-ocr-fast |
| Criador | baidu |
| Preço de entrada | US$ 0.680 / M tokens |
| Preço de saída | US$ 2.81 / M tokens |
| Janela de contexto | 66k |
| Modalidade | text+image->text |
O custo-benefício de verdade
Pega o preço de saída e joga contra o índice de inteligência. Os dois modelos acima de IQ 45 no catálogo hoje são exatamente os dois mais caros: Gemini Pro Preview a US$ 12 e GPT-5.3-Codex a US$ 14. O K2.6, sem IQ publicado, entra por US$ 4 — o que sugere que a MoonshotAI está vendendo preço, não topo de ranking.
Se o índice dele ficar perto dos 35-37 quando aparecer, o K2.6 vira uma das melhores razões por dólar no catálogo. Se ficar abaixo de 30, é só mais um modelo intermediário com marketing agressivo. Hoje, sem número, é promessa — e promessa não paga fatura.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O que fazer com isso amanhã
Se você está rodando agente de coding em produção, testa o K2.6 free hoje e mede duas coisas: qualidade do código gerado e tokens de saída por tarefa. Se a qualidade segurar e o gasto cair pela metade frente ao Gemini Pro, migra os workloads não-críticos. Se a qualidade oscilar, mantém o Pro como padrão e usa o K2.6 como fallback pra tarefas de baixo risco. A versão free existe exatamente pra você fazer essa conta sem risco.
Teste o Kimi K2.6 free hoje em workloads de coding não-críticos: se a qualidade segurar, ele corta pela metade o custo de saída frente a Gemini Pro e GPT-5.3-Codex.
Perguntas frequentes
Quanto custa o Kimi K2.6?
US$ 0,95 por milhão de tokens de entrada e US$ 4 por milhão de tokens de saída, com cache a US$ 0,16. Existe também a variante free com a mesma janela de 262k tokens, preço zerado.
O Kimi K2.6 é melhor que o Gemini 3.1 Pro Preview?
Não há como afirmar isso hoje: o K2.6 foi lançado sem índice de inteligência publicado. O Gemini 3.1 Pro Preview lidera o catálogo com IQ 47,7, mas cobra três vezes mais na saída (US$ 12 vs. US$ 4).
O que o Kimi K2.6 faz de diferente?
É multimodal (texto+imagem → texto), tem 262k de contexto e foi descrito pela MoonshotAI como focado em coding de longa duração, geração de UI/UX por código e orquestração multi-agente em Python, Rust e Go.