MiniMax M2.1 chega cobrando US$ 0,30 de entrada e US$ 1,20 de saída
Modelo leve, com 10 bilhões de parâmetros ativados, mira coding e fluxos agentic. Promete 'state-of-the-art', mas o catálogo ainda não publicou o índice de inteligência — fica a dúvida para quem escolhe no escuro.
A MiniMax colocou hoje no catálogo um modelo novo, o M2.1, e a primeira coisa que chama atenção não é a promessa — é a conta. Entrada a US$ 0,30 por milhão de tokens, saída a US$ 1,20 e cache a US$ 0,03. Quem está acostumado a comparar linha por linha percebe rápido: o custo de entrada empatou com o do Xiaomi MiMo-V2-Flash, o modelo mais barato entre os bem-inteligentes do ranking. A saída, porém, cobra quatro vezes mais que esse mesmo rival.
O que entrou no catálogo hoje
O M2.1 vem descrito como leve — só 10 bilhões de parâmetros ativados, segundo a própria MiniMax — e otimizado para coding, fluxos agentic e desenvolvimento de aplicação moderna. Janela de contexto de 204.800 tokens, modalidade texto → texto, sem suporte a imagem, áudio ou vídeo. Não há nota no catálogo sobre país de origem, data de corte de conhecimento ou se os pesos são abertos.
A descrição oficial fala em "major jump" e "state-of-the-art" para os cenários-alvo. É o tipo de frase que aparece em todo release. O detalhe que vale guardar: o índice de inteligência (Artificial Analysis) não foi publicado para este modelo. Os campos IQ, coding, agentic, blended e omniscience chegaram vazios. Você vai ter que medir por conta própria.
O preço, traduzido
Pega o número e divide pelo que ele significa na prática. A US$ 0,30 por milhão de tokens de entrada, o M2.1 está no mesmo patamar do Xiaomi MiMo-V2-Flash. Mas enquanto o MiMo-V2-Flash cobra US$ 0,30 na saída, o M2.1 cobra US$ 1,20 — quatro vezes mais. E o MiMo-V2-Flash tem IQ 34,024 no ranking atual; o M2.1 ainda não tem nota publicada.
Quando você compara com os modelos "peso pesado", a história muda. O OpenAI o3 cobra US$ 8 por milhão de saída, o Claude Haiku 4.5 cobra US$ 5. Ou seja, o M2.1 é mais barato na saída que esses dois, mas não é barato. É preço de intermediário querendo brigar com os grandes.
Onde o M2.1 brilha mesmo é no cache: US$ 0,03 por milhão. Para quem reusa prompt com frequência — RAG, system prompts grandes, instruções repetidas — é uma economia relevante sobre o preço de entrada cheio. Vale olhar de perto se você tem volume alto de prompts cacheáveis.
Onde isso se encaixa (e onde não)
Para quem roda agentes em produção e gasta muito em cache, o M2.1 entra como candidato. A combinação de contexto de 200 mil tokens com cache agressivo é desenho pensado para workload agentic — você manda o system prompt e o histórico de tools uma vez, e o resto da conversa roda barato.
Não serve para quem precisa de resposta multimodal. Não há suporte a imagem, áudio ou vídeo. Também não substitui automaticamente quem já usa o MiMo-V2-Flash ou o Haiku: é mais caro na saída e não traz prova de inteligência superior.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| MiniMax M2.1 (o novo) | — | 0.3 | 1.2 | 205k |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
Vale lembrar do tamanho do cardápio: 313 modelos listados hoje, 34 deles entraram nos últimos 30 dias. O mercado não está parado, está trocando de modelo toda semana. Comprar sem medir hoje é mais arriscado do que era seis meses atrás.
O que muda para quem paga a conta
Se você já roda o MiMo-V2-Flash ou um Haiku da vida, o M2.1 não substitui no automático — é mais caro na saída e não traz prova de qualidade superior. Se você está rodando agentes em produção e gasta muito em cache, vale rodar uma semana de teste para ver se o desenho compensa.
A implicação é direta: o M2.1 é uma opção nova no menu, não um vencedor óbvio. Quem fecha a fatura do mês precisa colocar na planilha — entrada, saída, cache, contexto — antes de migrar qualquer workload. E esperar o índice de inteligência aparecer para comparar de verdade com o que já roda.
Coloque o M2.1 na planilha ao lado do MiMo-V2-Flash e do Claude Haiku 4.5 antes de migrar qualquer workload: o preço de cache é tentador, mas sem índice de inteligência publicado, é compra no escuro até você rodar benchmark próprio.
Perguntas frequentes
Quanto custa o MiniMax M2.1 na API?
Cobra US$ 0,30 por milhão de tokens de entrada, US$ 1,20 por milhão de tokens de saída e US$ 0,03 por milhão em cache. É preço intermediário — mais barato que OpenAI o3 e Claude Haiku 4.5 na saída, mas quatro vezes mais caro que o Xiaomi MiMo-V2-Flash.
MiniMax M2.1 tem suporte a imagem ou áudio?
Não. A ficha do catálogo indica modalidade apenas texto → texto. Quem precisa de entrada multimodal precisa continuar usando outro modelo — o M2.1 só processa e gera texto.
Qual é o índice de inteligência do MiniMax M2.1?
O catálogo ainda não publicou o índice Artificial Analysis para esse modelo. Os campos IQ, coding, agentic e blended vieram vazios na ficha — a única forma de comparar hoje é rodar benchmark próprio.