Kimi K2.7 Code lidera coding entre MoE chineses, mas cobra US$ 3,40 por saída
Com IQ 43,02, o modelo da MoonshotAI vence os pares chineses no coding score por menos de um ponto — mas o preço de saída o coloca num nicho que não atrai nem quem busca custo nem quem busca o topo.
MoonshotAI anuncia o Kimi K2.7 Code como o coding mais alto entre os MoE chineses recentes. Olhando o preço que entra no catálogo hoje, o modelo ocupa um nicho desconfortável: não está no clube dos baratos de verdade e também não compete com o topo premium.
Coding score 60,76 — liderança por meio ponto
O Kimi K2.7 Code é uma mistura-de-experts de 1 trilhão de parâmetros totais com 32 bilhões ativos. Open weights, raciocínio habilitado, contexto de 262 mil tokens, multimodal (texto e imagem na entrada, texto na saída).
O número que o anúncio entrega é o coding score: 60,76. É o mais alto entre os MoE chineses lançados nas últimas semanas. A mesa:
| Modelo | Coding | IQ geral | Saída US$/M |
|---|---|---|---|
| Kimi K2.7 Code | 60,76 | 43,02 | 3,40 |
| Xiaomi MiMo-V2.5-Pro | 60,19 | 42,88 | 0,87 |
| Nex AGI Nex-N2-Pro (free) | 59,12 | 41,74 | 0 |
| MiniMax M3 | 58,57 | 45,40 | 1,20 |
| Xiaomi MiMo-V2.5 | 56,80 | 38,04 | 0,28 |
A liderança existe, mas é estreita: 0,57 ponto sobre o MiMo-V2.5-Pro da Xiaomi, que custa quase um quarto do preço de saída.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Kimi K2.7 Code (o novo) | 43.0 | 0.66 | 3.4 | 262k |
| Nex-N2-Pro (free) | 41.7 | 0 | 0 | 262k |
| MiMo-V2.5 | 38.0 | 0.14 | 0.28 | 1.05M |
| MiMo-V2.5-Pro | 42.9 | 0.435 | 0.87 | 1.05M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
O porém mora no IQ 43
O índice de inteligência geral do K2.7 Code está em 43,02. Isso fica abaixo da linha dos 45, que é onde mora a turma mais barata do catálogo:
- MiniMax M3 — IQ 45,40 a US$ 1,20/M de saída
- DeepSeek V4 Pro — IQ 45,27 a US$ 1,74/M
- Google Gemini 3.5 Flash — IQ 46,67 a US$ 9,00/M
O Kimi K2.7 Code cobra US$ 3,40 por milhão de tokens de saída. É mais caro que o M3 — que tem IQ maior, aceita vídeo na entrada e roda quase 2x mais rápido. É mais barato que o Gemini 3.5 Flash, mas Flash é produto Google com outro tipo de SLA.
Traduzindo o marketing: o headline diz "coding top da categoria". A conta diz "modelo intermediário entre o chão e o teto".
E contra o topo global?
Para situar, o topo do mercado em inteligência nesta data é o Anthropic Claude Fable 5 — IQ 62,07 a US$ 50,00/M de saída. Depois vem o Gemini 3.1 Pro Preview (IQ 47,74 / US$ 12) e o GPT-5.3-Codex (IQ 45,51 / US$ 14). Este último é o rival direto em proposta: coding-first, raciocínio habilitado.
O K2.7 Code custa cerca de um quarto da saída do Codex e vem com pesos abertos. No agregado de IQ, o Codex está dois pontos à frente. No recorte de coding score, o dado de hoje não traz o número do Codex para comparar diretamente — o que existe é o IQ geral.
A velocidade também entra na conta
Outro número que merece atenção: 41,28 tokens por segundo. Comparado com os pares chineses:
- Nex-N2-Pro (free): 135,32 t/s
- MiniMax M3: 89,42 t/s
- Kimi K2.7 Code: 41,28 t/s
- MiMo-V2.5-Pro: 34,05 t/s
O K2.7 Code é quase 3x mais lento que o Nex-N2-Pro gratuito. Em fluxos agentic com várias chamadas encadeadas, isso significa esperar. Em job batch de madrugada, não pesa.
| Campo | Valor |
|---|---|
| Identificador | moonshotai/kimi-k2.7-code |
| Criador | moonshotai |
| Preço de entrada | US$ 0.660 / M tokens |
| Preço de saída | US$ 3.40 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.180 / M (73% de desconto) |
| Índice de inteligência (AA) | 43.0 |
| Índice de código | 60.8 |
| Índice agêntico | 30.3 |
| Parâmetros | 1000B (32B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 41 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Para quem vale — e para quem não muda nada
Vale a pena se você:
- Quer pesos abertos para self-host ou auditabilidade de modelo
- Precisa especificamente de coding forte em contexto longo (262 mil tokens)
- Está disposto a pagar o intermediário de US$ 3,40/M pela liderança apertada no coding entre MoE chineses
- Não quer ficar preso a Anthropic, OpenAI ou Google
Não vale se você:
- Já roda Nex-N2-Pro (free) — coding quase tão bom, 3x mais rápido, zero de custo
- Precisa de IQ geral acima de 45 — o MiniMax M3 é mais barato e mais inteligente
- Faz agentic pesado em loop — os 41 t/s doem no tempo total
- Quer o melhor coding absoluto do mercado — o GPT-5.3-Codex tende a entregar mais no agregado
A implicação prática
Se o seu stack hoje é Nex-N2-Pro ou MiniMax M3, não há motivo forte para trocar. A liderança do K2.7 Code no coding score é estreita demais para justificar um salto de quase 3x no preço de saída do M3.
Se o seu stack é GPT-5.3-Codex e a conta está doendo, vale rodar um piloto. Mas meça no SEU codebase — benchmark agregado de coding score não paga boleto de API.
Se você já roda Nex-N2-Pro (free) ou MiniMax M3, não há motivo para trocar hoje; se a conta do GPT-5.3-Codex está doendo, pilote o Kimi K2.7 Code, mas meça no seu codebase antes de migrar.
Perguntas frequentes
Kimi K2.7 Code é melhor que o GPT-5.3-Codex em código?
O K2.7 Code lidera o coding score entre os MoE chineses recentes (60,76), mas o GPT-5.3-Codex é o coding-first da OpenAI, com IQ geral 45,51 contra 43,02 do K2.7 Code. Sem o coding score direto do Codex no recorte de hoje, o agregado sugere que o Codex tende a entregar mais — mas a US$ 14/M de saída contra US$ 3,40 do K2.7 Code, a diferença precisa ser grande para compensar na sua fatura.
Vale trocar o MiniMax M3 pelo Kimi K2.7 Code?
Pela conta, não. O M3 custa US$ 1,20/M de saída, tem IQ maior (45,40) e roda quase 2x mais rápido (89,42 t/s contra 41,28). O K2.7 Code só ganha em coding score por uma margem pequena (60,76 vs 58,57). Para a maioria dos workloads, o M3 continua sendo a escolha racional.
Existe versão gratuita do Kimi K2.7 Code?
Não no catálogo desta data — o modelo está listado como pago, a US$ 0,66/M de entrada e US$ 3,40/M de saída, com cache a US$ 0,18/M. Para uma alternativa free com coding parecido, o Nex AGI Nex-N2-Pro tem coding score 59,12, é gratuito e roda mais de 3x mais rápido.