FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Kimi K2.6 chega cobrando US$ 4 por milhão de saída — e abre família gratuita

MoonshotAI lança o K2.6 multimodal focado em coding longo e multi-agente, com variante gratuita no mesmo dia. O preço de saída cabe entre o MiMo da Xiaomi e o Gemini Pro da Google.

Redação FalaVIP IA 3 min de leitura
US$ 4por milhão de tokens de saída
US$ 0,95por milhão de tokens de entrada
US$ 0,16por milhão de tokens em cache

O que o release diz vs. o que a conta mostra

A MoonshotAI soltou hoje o Kimi K2.6 e a pergunta que importa pra você não é "ele é bom?", é "ele cabe no meu orçamento?". A resposta curta: depende do que você compara.

O K2.6 cobra US$ 0,95 por milhão de tokens de entrada e US$ 4 por milhão de tokens de saída. Tem cache a US$ 0,16 — útil se você reusa prompts grandes. O contexto é de 262.144 tokens, multimodal (texto+imagem → texto), e a descrição oficial fala em coding de longa duração, geração de UI/UX dirigida por código e orquestração multi-agente em Python, Rust e Go.

Traduzindo o marketing: o K2.6 não está brigando pelo topo de inteligência do catálogo. Está brigando pelo meio do pelotão, onde a maioria dos apps de produção realmente roda.

Preço de saída (US$ por milhão de tokens)
Qianfan-OCR-Fast2,81Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

Onde ele se encaixa no tabuleiro

Olha o topo de hoje. O Gemini 3.1 Pro Preview da Google lidera o índice de inteligência com 47,7 e cobra US$ 12 de saída. O GPT-5.3-Codex da OpenAI vem logo atrás com 45,5 e sai a US$ 14. O MiMo-V2-Omni da Xiaomi aparece com 35,8 e cobra US$ 2.

O K2.6 entra entre o MiMo e o Gemini Pro no preço — US$ 4 de saída é o dobro do chinês e um terço do americano. É a faixa onde a MoonshotAI já vinha competindo e onde a conta da API começa a doer menos.

Índice de inteligência (Artificial Analysis)
Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

Para quem vale — e para quem não muda nada

Vale pra você se:

  • Roda agente de coding que consome muito token de saída e precisa de contexto longo (262k é mais que suficiente pra boa parte dos repositórios reais).
  • Quer multimodal barato pra ler prints, diagramas e PDFs sem pagar tarifa Pro.
  • Já está no ecossistema MoonshotAI e quer manter o stack.

Não muda nada se:

  • Você precisa do melhor raciocínio absoluto do mercado — Gemini 3.1 Pro Preview e GPT-5.3-Codex seguem na frente.
  • Sua carga é dominada por entrada (RAG, embeddings, classificação) e pouco saída — a diferença de US$ 0,95 vs. US$ 0,60 some no fim do mês.
  • Você precisa de benchmark público pra justificar a escolha internamente: o K2.6 entrou hoje sem índice de inteligência publicado.
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Qianfan-OCR-Fast (o novo)0.682.8166k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A família completa do dia

A MoonshotAI não soltou só o modelo pago. No mesmo pacote veio o Kimi K2.6 (free), com a mesma janela de 262k tokens e preço zerado de entrada e saída. É a versão que você testa antes de assinar.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Qianfan-OCR-Fast (free)0066k
Ficha técnica — Qianfan-OCR-Fast
CampoValor
Identificadorbaidu/qianfan-ocr-fast
Criadorbaidu
Preço de entradaUS$ 0.680 / M tokens
Preço de saídaUS$ 2.81 / M tokens
Janela de contexto66k
Modalidadetext+image->text

O custo-benefício de verdade

Pega o preço de saída e joga contra o índice de inteligência. Os dois modelos acima de IQ 45 no catálogo hoje são exatamente os dois mais caros: Gemini Pro Preview a US$ 12 e GPT-5.3-Codex a US$ 14. O K2.6, sem IQ publicado, entra por US$ 4 — o que sugere que a MoonshotAI está vendendo preço, não topo de ranking.

Inteligência × preço de saída
Gemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência

Se o índice dele ficar perto dos 35-37 quando aparecer, o K2.6 vira uma das melhores razões por dólar no catálogo. Se ficar abaixo de 30, é só mais um modelo intermediário com marketing agressivo. Hoje, sem número, é promessa — e promessa não paga fatura.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 396 modelos disponíveis no catálogo nesta data.

O que fazer com isso amanhã

Se você está rodando agente de coding em produção, testa o K2.6 free hoje e mede duas coisas: qualidade do código gerado e tokens de saída por tarefa. Se a qualidade segurar e o gasto cair pela metade frente ao Gemini Pro, migra os workloads não-críticos. Se a qualidade oscilar, mantém o Pro como padrão e usa o K2.6 como fallback pra tarefas de baixo risco. A versão free existe exatamente pra você fazer essa conta sem risco.

Em uma frase

Teste o Kimi K2.6 free hoje em workloads de coding não-críticos: se a qualidade segurar, ele corta pela metade o custo de saída frente a Gemini Pro e GPT-5.3-Codex.

Perguntas frequentes

Quanto custa o Kimi K2.6?

US$ 0,95 por milhão de tokens de entrada e US$ 4 por milhão de tokens de saída, com cache a US$ 0,16. Existe também a variante free com a mesma janela de 262k tokens, preço zerado.

O Kimi K2.6 é melhor que o Gemini 3.1 Pro Preview?

Não há como afirmar isso hoje: o K2.6 foi lançado sem índice de inteligência publicado. O Gemini 3.1 Pro Preview lidera o catálogo com IQ 47,7, mas cobra três vezes mais na saída (US$ 12 vs. US$ 4).

O que o Kimi K2.6 faz de diferente?

É multimodal (texto+imagem → texto), tem 262k de contexto e foi descrito pela MoonshotAI como focado em coding de longa duração, geração de UI/UX por código e orquestração multi-agente em Python, Rust e Go.

Leia também