FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

M3 free da MiniMax custa zero e senta na mesa dos caros

Lançado há onze dias, o tier gratuito do M3 entrega o mesmo IQ do plano pago e força uma comparação incômoda com Claude Fable 5, Gemini 3.5 Flash e DeepSeek V4 Pro.

Redação FalaVIP IA 3 min de leitura
US$ 0por milhão de tokens de entrada e de saída no tier free
45,397IQ do M3 no índice atual, idêntico ao do plano pago
US$ 1,20por milhão de tokens de saída na versão paga do M3

O que está em jogo

A MiniMax abriu em 31 de maio o tier gratuito do seu modelo mais recente, o M3, e o número que importa não é tecnológico — é contábil. Entrada e saída custam US$ 0 por milhão de tokens. Em cima dessa conta zerada, o M3 aparece na quinta posição do ranking de inteligência do catálogo, com IQ 45,397. Você leu certo: a versão gratuita tem a mesma nota do plano pago, porque o catálogo não mede tier, mede modelo base. É o mesmo carro com a mesma latência, só que o tanque está sendo pago por outra pessoa.

A pergunta que sobra é: para que serve um modelo gratuito que senta na mesa dos pagos — e quando ele não te serve nem de graça?

Onde ele entra no tabuleiro

Compare o que está em volta. Logo acima do M3 estão OpenAI GPT-5.3-Codex (IQ 45,512, a US$ 14 por milhão de saída), Google Gemini 3.5 Flash (IQ 46,673, a US$ 9), Google Gemini 3.1 Pro Preview (IQ 47,738, a US$ 12) e, no topo isolado, Anthropic Claude Fable 5 (IQ 62,073, a US$ 50). Quando você filtra "barato acima de IQ 45", a ordem muda: M3 lidera (US$ 1,20), seguido de DeepSeek V4 Pro (US$ 1,74) e só depois Gemini 3.5 Flash (US$ 9). O M3 free apaga essa coluna inteira.

O catálogo hoje lista 465 modelos de 61 criadores, e 22 deles foram lançados nos últimos trinta dias. O M3 free entra nesse bloco como o único que combina multimodalidade de texto, imagem e vídeo com janela de um milhão de tokens e preço zero.

Ficha técnica — MiniMax M3 (free)
CampoValor
Identificadorminimax/minimax-m3:free
Criadorminimax
Preço de entradaUS$ 0.000 / M tokens
Preço de saídaUS$ 0.000 / M tokens
Janela de contexto1.05M
Modalidadetext+image+video->text

Para quem isso vale a pena

Se você está prototipando um agente, fazendo análise de logs longos ou quer colocar um classificador multimodal em produção sem aparecer no fim do mês com uma fatura de cinco dígitos, o M3 free é a porta de entrada óbvia. A janela de 1.048.576 tokens cobre praticamente qualquer transcrição de reunião, PDF corporativo ou dump de código que você jogue nele. E como o tier é gratuito, o custo de experimentar é literalmente zero.

A conta fica ainda mais favorável quando você olha para o blended real: muita chamada tem mais saída do que entrada, e cada token de resposta no M3 free deixa de custar US$ 1,20. Em um workload de agente que dispara 50 milhões de tokens de saída por mês, isso é diferença entre US$ 60 e US$ 2.500.

Para quem não muda nada

Se a sua carga depende de IQ muito alto — raciocínio encadeado, matemática simbólica, revisão de contratos longos com nuances —, o M3 fica a quase 17 pontos do Claude Fable 5. É a distância entre um carro de cidade e um sedã executivo: ambos te levam, mas em pistas diferentes. O catálogo não publicou benchmark específico de coding nem de agentic para o M3, então se essas são as suas métricas decisivas, o caminho seguro continua sendo GPT-5.3-Codex ou Claude Fable 5.

Também não espere velocidades publicadas: o campo de speed veio vazio, o que significa que o catálogo não informa latência. Em produção, isso é variável que você mede no seu próprio workload.

O detalhe que ninguém está olhando

O M3 free e o M3 pago compartilham o mesmo identificador de modelo no catálogo, o que explica a nota de IQ idêntica. A MiniMax não está vendendo uma versão capada da inteligência — está distribuindo a mesma capacidade, provavelmente com rate limit, e cobrando de quem precisa de mais vazão. É a economia da API em uma frase: o modelo é o mesmo, o que muda é quem paga a conta de infraestrutura.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
Entre os 465 modelos disponíveis no catálogo nesta data.

O que você faz com isso amanhã

Coloque o M3 free como default em qualquer fluxo onde você ainda não tem SLA definido e onde o custo marginal precisa ser zero. Suba para o tier pago (US$ 1,20 por milhão de saída) quando os rate limits começarem a cortar os seus agentes. E mantenha Claude Fable 5 ou GPT-5.3-Codex reservados para o topo da pirâmide — as tarefas em que cada ponto de IQ realmente vira dinheiro na entrega. O tabuleiro mudou: o melhor IQ não custa mais nada para ser testado.

Em uma frase

Use o M3 free como porta de entrada gratuita em workloads multimodais de contexto longo; pague o tier de US$ 1,20 só quando os rate limits começarem a cortar, e mantenha Claude Fable 5 ou GPT-5.3-Codex nas tarefas que exigem o topo absoluto de IQ.

Perguntas frequentes

O MiniMax M3 free tem a mesma qualidade do M3 pago?

Sim, segundo o índice de inteligência do catálogo, ambos compartilham IQ 45,397. A diferença entre os tiers tende a estar em rate limit e vazão, não na capacidade do modelo em si.

Quanto custa usar o MiniMax M3 free em produção?

Zero por milhão de tokens de entrada e de saída. O custo real passa a ser o da engenharia em torno: orquestração, retries e o que você gastar quando eventualmente migrar para o tier pago de US$ 1,20 por milhão de tokens de saída.

Para que tipo de tarefa o M3 free não é indicado?

Raciocínio encadeado pesado, matemática simbólica e tarefas que exigem o topo absoluto de inteligência continuam melhor servidas por Claude Fable 5 ou GPT-5.3-Codex. Para essas cargas, a diferença de IQ se traduz em qualidade de entrega que o preço zero não compensa.

Leia também