FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

MiniMax M2.1 chega cobrando US$ 0,30 de entrada e US$ 1,20 de saída

Modelo leve, com 10 bilhões de parâmetros ativados, mira coding e fluxos agentic. Promete 'state-of-the-art', mas o catálogo ainda não publicou o índice de inteligência — fica a dúvida para quem escolhe no escuro.

Redação FalaVIP IA 3 min de leitura
US$ 0,30por milhão de tokens de entrada
US$ 1,20por milhão de tokens de saída
US$ 0,03por milhão de tokens em cache

A MiniMax colocou hoje no catálogo um modelo novo, o M2.1, e a primeira coisa que chama atenção não é a promessa — é a conta. Entrada a US$ 0,30 por milhão de tokens, saída a US$ 1,20 e cache a US$ 0,03. Quem está acostumado a comparar linha por linha percebe rápido: o custo de entrada empatou com o do Xiaomi MiMo-V2-Flash, o modelo mais barato entre os bem-inteligentes do ranking. A saída, porém, cobra quatro vezes mais que esse mesmo rival.

O que entrou no catálogo hoje

O M2.1 vem descrito como leve — só 10 bilhões de parâmetros ativados, segundo a própria MiniMax — e otimizado para coding, fluxos agentic e desenvolvimento de aplicação moderna. Janela de contexto de 204.800 tokens, modalidade texto → texto, sem suporte a imagem, áudio ou vídeo. Não há nota no catálogo sobre país de origem, data de corte de conhecimento ou se os pesos são abertos.

A descrição oficial fala em "major jump" e "state-of-the-art" para os cenários-alvo. É o tipo de frase que aparece em todo release. O detalhe que vale guardar: o índice de inteligência (Artificial Analysis) não foi publicado para este modelo. Os campos IQ, coding, agentic, blended e omniscience chegaram vazios. Você vai ter que medir por conta própria.

O preço, traduzido

Pega o número e divide pelo que ele significa na prática. A US$ 0,30 por milhão de tokens de entrada, o M2.1 está no mesmo patamar do Xiaomi MiMo-V2-Flash. Mas enquanto o MiMo-V2-Flash cobra US$ 0,30 na saída, o M2.1 cobra US$ 1,20 — quatro vezes mais. E o MiMo-V2-Flash tem IQ 34,024 no ranking atual; o M2.1 ainda não tem nota publicada.

Preço de saída (US$ por milhão de tokens)
MiniMax M2.11,2MiMo-V2-Flash0,3o38Claude Haiku 4.55US$/M
Fonte: OpenRouter

Quando você compara com os modelos "peso pesado", a história muda. O OpenAI o3 cobra US$ 8 por milhão de saída, o Claude Haiku 4.5 cobra US$ 5. Ou seja, o M2.1 é mais barato na saída que esses dois, mas não é barato. É preço de intermediário querendo brigar com os grandes.

Índice de inteligência (Artificial Analysis)
MiMo-V2-Flash34o331,1Claude Haiku 4.529,9índice
Fonte: Artificial Analysis

Onde o M2.1 brilha mesmo é no cache: US$ 0,03 por milhão. Para quem reusa prompt com frequência — RAG, system prompts grandes, instruções repetidas — é uma economia relevante sobre o preço de entrada cheio. Vale olhar de perto se você tem volume alto de prompts cacheáveis.

Onde isso se encaixa (e onde não)

Para quem roda agentes em produção e gasta muito em cache, o M2.1 entra como candidato. A combinação de contexto de 200 mil tokens com cache agressivo é desenho pensado para workload agentic — você manda o system prompt e o histórico de tools uma vez, e o resto da conversa roda barato.

Não serve para quem precisa de resposta multimodal. Não há suporte a imagem, áudio ou vídeo. Também não substitui automaticamente quem já usa o MiMo-V2-Flash ou o Haiku: é mais caro na saída e não traz prova de inteligência superior.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
MiniMax M2.1 (o novo)0.31.2205k
MiMo-V2-Flash34.00.10.3262k
o331.128200k
Claude Haiku 4.529.915200k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Vale lembrar do tamanho do cardápio: 313 modelos listados hoje, 34 deles entraram nos últimos 30 dias. O mercado não está parado, está trocando de modelo toda semana. Comprar sem medir hoje é mais arriscado do que era seis meses atrás.

O que muda para quem paga a conta

Se você já roda o MiMo-V2-Flash ou um Haiku da vida, o M2.1 não substitui no automático — é mais caro na saída e não traz prova de qualidade superior. Se você está rodando agentes em produção e gasta muito em cache, vale rodar uma semana de teste para ver se o desenho compensa.

A implicação é direta: o M2.1 é uma opção nova no menu, não um vencedor óbvio. Quem fecha a fatura do mês precisa colocar na planilha — entrada, saída, cache, contexto — antes de migrar qualquer workload. E esperar o índice de inteligência aparecer para comparar de verdade com o que já roda.

Em uma frase

Coloque o M2.1 na planilha ao lado do MiMo-V2-Flash e do Claude Haiku 4.5 antes de migrar qualquer workload: o preço de cache é tentador, mas sem índice de inteligência publicado, é compra no escuro até você rodar benchmark próprio.

Perguntas frequentes

Quanto custa o MiniMax M2.1 na API?

Cobra US$ 0,30 por milhão de tokens de entrada, US$ 1,20 por milhão de tokens de saída e US$ 0,03 por milhão em cache. É preço intermediário — mais barato que OpenAI o3 e Claude Haiku 4.5 na saída, mas quatro vezes mais caro que o Xiaomi MiMo-V2-Flash.

MiniMax M2.1 tem suporte a imagem ou áudio?

Não. A ficha do catálogo indica modalidade apenas texto → texto. Quem precisa de entrada multimodal precisa continuar usando outro modelo — o M2.1 só processa e gera texto.

Qual é o índice de inteligência do MiniMax M2.1?

O catálogo ainda não publicou o índice Artificial Analysis para esse modelo. Os campos IQ, coding, agentic e blended vieram vazios na ficha — a única forma de comparar hoje é rodar benchmark próprio.

Leia também