MiniMax M2.1: 7 dias de mercado e zero benchmark publicado
Lançado em 23 de dezembro focado em coding e agentes, o modelo entra no catálogo com IQ, coding e agentic em branco — e a régua de comparação passa a ser o preço.
O "estado da arte" sem número no catálogo
Sete dias depois do lançamento, o catálogo ainda não tem um único índice de desempenho para o MiniMax M2.1. O release promete state-of-the-art. O banco de dados responde com campos vazios. É a diferença entre o que o fornecedor vende e o que a sua planilha consegue comparar.
Você está decidindo modelo com base no que pode medir. Aqui, o que dá para medir é o preço — e o preço é o gancho.
O que está no papel (e o que não está)
O M2.1 é um modelo texto-para-texto com 10 bilhões de parâmetros ativos. Esse número, na prática, é assinatura de Mistura de Especialistas (MoE): só uma fração da rede liga a cada token, o que costuma significar inferência mais barata por token gerado. O contexto é de 204.800 tokens, espaço de sobra para código longo e agente com várias ferramentas.
Lançado em 23 de dezembro de 2025, entra num catálogo com mais de 313 modelos ativos de 48 criadores diferentes. Em trinta dias, foram 31 lançamentos — o M2.1 é um entre vários.
O que está descrito: foco em coding, agentic workflows e desenvolvimento de aplicação moderna. O que está em branco: IQ, nota de coding, nota de agentic, blended, velocidade em tokens por segundo, país de origem, data de corte de conhecimento, se tem pesos abertos, número total de parâmetros. Nenhum desses campos foi publicado.
| Campo | Valor |
|---|---|
| Identificador | minimax/minimax-m2.1 |
| Criador | minimax |
| Preço de entrada | US$ 0.300 / M tokens |
| Preço de saída | US$ 1.20 / M tokens |
| Janela de contexto | 205k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.030 / M (90% de desconto) |
Preço contra quem está na frente
Sem benchmark público, a régua vira o dólar. O M2.1 cobra US$ 0,30 por milhão de tokens de entrada e US$ 1,20 por milhão de tokens de saída. O cache de leitura sai a US$ 0,03 por milhão — valor agressivo, do tipo que muda a conta de agente que relê a mesma janela a cada turno.
Coloque lado a lado dos modelos que o catálogo mediu e ranqueia hoje, por ordem de IQ atual:
- Xiaomi MiMo-V2-Flash: IQ 34,0, US$ 0,30 por milhão de tokens de saída. Topo do ranking, barato, rápido.
- OpenAI o3: IQ 31,1, US$ 8,00 por milhão de tokens de saída. Quase sete vezes o preço de saída do M2.1.
- Anthropic Claude Haiku 4.5: IQ 29,9, US$ 5,00 por milhão de tokens de saída. Quatro vezes o M2.1.
- OpenAI gpt-oss-120b: IQ 24,1, US$ 0,17 por milhão de tokens de saída. Open weights, mais barato na saída.
- Mistral Devstral 2 2512: IQ 19,2, US$ 2,00 por milhão de tokens de saída. Mesmo terreno de preço do M2.1, mas com benchmark.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Tradução do quadro: o M2.1 não é o mais barato. O gpt-oss-120b custa menos por token de saída, e o MiMo-V2-Flash empata no input e ganha na saída. Nenhum dos cinco tem como te dizer onde o M2.1 entra na fila de qualidade — porque o catálogo não tem número para ele.
Para quem vale — e para quem não muda nada
O M2.1 faz sentido se você já roda agente em produção, gasta em volume e confia no fornecedor. O cache a US$ 0,03 é o que chama atenção: cada turno de agente que relê contexto fica barato, e isso pesa mais que qualquer diferença de centavos no input. Os 10 bilhões de parâmetros ativos são compatíveis com inferência rápida, embora o catálogo não publique tokens por segundo para confirmar.
O M2.1 não faz sentido se a sua escolha depende de benchmark público. Você está comprando no escuro em qualidade. Antes de mover carga, rode um prompt seu — do tipo que você já paga em outro modelo —, meça taxa de acerto, e só então decida. Release bom não substitui planilha.
O que acontece a partir de agora
O catálogo é vivo: mais de 313 modelos, 48 criadores, 31 lançamentos nos últimos 30 dias. Se o M2.1 publicar IQ e notas de coding nas próximas semanas, esta análise perde a razão de ser. Até lá, a régua é preço e descrição — e descrição não entra na fatura da API.
Sem benchmark público, o M2.1 só vale para quem roda agente em volume e aceita medir qualidade por conta própria; quem precisa de nota antes de mover carga deve esperar o índice sair.
Perguntas frequentes
O MiniMax M2.1 já tem benchmark publicado?
Não. No catálogo atual, os campos de IQ, coding, agentic, blended, velocidade e país de origem estão vazios. A única régua comparável hoje é o preço por token.
Quanto custa usar o MiniMax M2.1 via API?
Custa US$ 0,30 por milhão de tokens de entrada, US$ 1,20 por milhão de tokens de saída e US$ 0,03 por milhão em leitura de cache. É mais barato na saída que Claude Haiku 4.5 e o3, e mais caro que gpt-oss-120b.
Para que tipo de uso o M2.1 foi feito?
O fornecedor declara foco em coding, agentic workflows e desenvolvimento de aplicação moderna, com 10 bilhões de parâmetros ativos em arquitetura MoE e contexto de 204.800 tokens.