FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiniMax M2 cobra US$ 1 o milhão e promete 'quase fronteira' — sem nota

Modelo MoE de 230B foca em código e agentes. Seis dias após o lançamento, o catálogo ainda não publicou benchmark.

Redação FalaVIP IA 3 min de leitura
US$ 1,02por milhão de tokens de saída
230B / 10Bparâmetros totais / ativos (MoE)
204.800tokens de contexto

US$ 1,02 por milhão de tokens de saída. É o que o catálogo cobra pelo MiniMax M2, liberado em 23 de outubro com a promessa de "inteligência quase de fronteira" para código e fluxos agênticos. Só que "quase" não tem número — e seis dias depois do lançamento, o índice de inteligência continua vazio. Você está pagando pela promessa ou pelo que foi medido?

O que o MoE de 230B entrega de verdade

O M2 é um Mixture-of-Experts: 230 bilhões de parâmetros no total, mas só 10 bilhões ativos por token processado. É como um escritório com 230 funcionários onde apenas 10 sentam para resolver cada tarefa — cada um especialista em algo, e a escolha de quem atende acontece a cada requisição. Por isso o preço de entrada fica em US$ 0,255 por milhão de tokens — competitivo, mas longe do fundo do poço. O gpt-oss-20b, por exemplo, cobra US$ 0,13 de saída, quase oito vezes menos que o M2.

A janela de contexto de 204.800 tokens (por volta de 150 mil palavras) é robusta. Serve para repositórios inteiros, cadeias longas de tool use e prompts de sistema carregados de instruções. Nada disso impressiona quem já trabalha com Claude Haiku 4.5 ou Qwen3 Next 80B A3B Thinking — todos na mesma faixa.

Ficha técnica — MiniMax M2
CampoValor
Identificadorminimax/minimax-m2
Criadorminimax
Preço de entradaUS$ 0.255 / M tokens
Preço de saídaUS$ 1.02 / M tokens
Janela de contexto205k
Modalidadetext->text

Onde o M2 senta na mesa

Compare a tarifa de saída. O OpenAI o3, com índice de inteligência 31,096 no catálogo, custa US$ 8 por milhão de tokens. O Claude Haiku 4.5 (29,892) sai por US$ 5. Os dois cobram de cinco a oito vezes mais que o M2 e entregam nota medida — vantagem que o M2 ainda não tem.

A briga real está mais embaixo: contra o Qwen3 Next 80B A3B Thinking (US$ 1,20 por milhão de saída, IQ 16,867) e os modelos abertos da OpenAI — gpt-oss-20b (US$ 0,13) e gpt-oss-120b (US$ 0,17). Nesses confrontos diretos, o M2 fica no meio do nada: preço parecido com o Qwen3, mas sem nota publicada para comparar. O catálogo guarda medição de IQ de 266 modelos; o M2 está entre os 23 lançados nos últimos 30 dias que ainda não entregaram a planilha.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 266 modelos disponíveis no catálogo nesta data.

Para quem vale (e para quem não muda nada)

Vale a pena testar se você roda pipelines de coding ou agentes em volume e quer cortar a fatura atual sem assumir uma queda cega de qualidade. O preço de entrada baixo ajuda em pré-processamento, embeddings de código e varredura de PRs. O foco oficial do modelo é "end-to-end coding and agentic workflows" — não raciocínio geral nem pesquisa acadêmica.

Não vale se você precisa de benchmark publicado para fechar SLA com cliente, comparar em dashboard interno ou justificar migração para o time financeiro. Sem IQ, sem coding score, sem agentic score, sem blended — você teria de rodar benchmark próprio antes de comprometer produção. E se seu workload depende de cache de prompt para amortizar system prompts gigantes, o catálogo não publicou esse valor; pergunte ao provedor antes de mover tráfego.

O que fazer com isso amanhã

Trate o M2 como hipótese, não como troca direta. Reserve uma fatia pequena do tráfego atual — uns 10% das chamadas de coding que hoje vão para o o3 — e meça latência, taxa de acerto em testes e custo efetivo por feature entregue em duas semanas. Se os números fecharem, você pode cortar até 87% do custo de saída naquela carga. Se não, gastou pouco para descobrir.

Não há dado de país de origem nem de velocidade publicada. Em pipelines sensíveis a latência (chat ao vivo, agente com time budget apertado), peça tokens por segundo antes de qualquer migração.

Em uma frase

Reserve 10% do tráfego de coding que hoje vai para o o3, meça custo efetivo em duas semanas e só então decida migrar.

Perguntas frequentes

O MiniMax M2 tem benchmark publicado?

Não. Seis dias depois do lançamento, o catálogo ainda não publicou índice de inteligência, coding nem agentic score. Você teria de medir por conta própria antes de fechar SLA com cliente.

Quanto custa o MiniMax M2 na API?

US$ 0,255 por milhão de tokens de entrada e US$ 1,02 por milhão de tokens de saída. O preço de cache não foi divulgado pelo catálogo — vale perguntar ao provedor antes de mover tráfego.

MiniMax M2 substitui o Claude Haiku 4.5 ou o o3?

Depende do que você está rodando. Em coding e fluxos agênticos com orçamento apertado, vale testar — é de cinco a oito vezes mais barato na saída. Em raciocínio pesado, Haiku 4.5 e o3 ainda têm nota medida e entregue.

Leia também