FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex

Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.

Redação FalaVIP IA 3 min de leitura
US$ 1,20por milhão de tokens de saída no M3
IQ 45,3974º lugar no índice atual de inteligência
11,7×mais barato que o GPT-5.3-Codex por token de saída

IQ 45,397 no índice atual — e US$ 1,20 por milhão de tokens de saída. Esses são os dois números que você precisa guardar sobre o MiniMax M3, lançado hoje pela MiniMax. O material promocional vai falar em "modelo competitivo com o topo". O que ele não vai estampar em letras grandes é que o topo mesmo cobra muito mais caro.

Índice de inteligência (Artificial Analysis)
MiniMax M345,4Gemini 3.1 Pro Preview47,7Gemini 3.5 Flash46,7GPT-5.3-Codex45,5DeepSeek V4 Pro 042345,3índice
Fonte: Artificial Analysis

Onde o M3 entra no ranking

No índice atual, o M3 aparece em quarto: abaixo do Gemini 3.1 Pro Preview (47,738), do Gemini 3.5 Flash (46,673) e do GPT-5.3-Codex da OpenAI (45,512). A diferença para o Codex é de 0,115 ponto — praticamente o mesmo lugar.

O detalhe que muda tudo é o preço. O GPT-5.3-Codex cobra US$ 14 por milhão de tokens de saída. O M3 cobra US$ 1,20. São quase 12 vezes menos por um modelo que, no índice agregado, está colado nele.

Preço de saída (US$ por milhão de tokens)
MiniMax M31,2Gemini 3.1 Pro Preview12Gemini 3.5 Flash9GPT-5.3-Codex14DeepSeek V4 Pro 04232,0845US$/M
Fonte: OpenRouter

O que ficou mais barato (e o que ficou igual)

Traduzindo o lançamento para a sua planilha: entrada a US$ 0,30 por milhão de tokens, saída a US$ 1,20 e cache a US$ 0,06. Janela de contexto de 1 milhão de tokens. Multimodal — aceita texto, imagem e vídeo — e devolve texto. Tem raciocínio nativo, 428 bilhões de parâmetros totais, 23 bilhões ativos por inferência, e pesos abertos.

Pense em 428 funcionários num escritório: cada requisição sua só mobiliza 23 deles por vez, porque a arquitetura é MoE. O custo total da operação é alto, mas o trabalho que chega até você sai barato.

No recorte de coding, o M3 marca 58,5 — um número alto, mas que precisa ser confrontado com o do Codex no seu workload real antes de migrar. Em tarefas agentic, fica em 36,1, dentro da faixa dos modelos que custam três vezes mais.

Inteligência × preço de saída
MiniMax M3Gemini 3.1 Pro PreviewGemini 3.5 FlashGPT-5.3-CodexDeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência

Para quem vale — e para quem não muda nada

Você roda volume alto, multimodalidade entra na rotina, raciocínio importa, e cada centavo por token aparece na fatura no fim do mês? O M3 entra na lista curta hoje. Ele é o modelo mais barato do catálogo inteiro com IQ acima de 45 — à frente do DeepSeek V4 Pro (US$ 1,74 por milhão de saída) e muito à frente do Gemini 3.5 Flash (US$ 9).

Se você precisa do máximo absoluto de capacidade e o orçamento não é o gargalo, o Gemini 3.1 Pro Preview segue na frente com folga — 2,34 pontos de IQ acima do M3. Se o seu fluxo já roda bem no GPT-5.3-Codex e a diferença de centavos não mexe na sua decisão, não há motivo para trocar.

A família completa

A MiniMax não soltou só o principal. Vieram duas variantes: M3 batch, com janela reduzida a 524 mil tokens mas mesmo preço; e M3 free, com entrada e saída zeradas. É a estrutura padrão de quem quer cobrir do desenvolvedor curioso até o cliente enterprise — o caminho sem custo para validar antes de colocar crédito na conta.

O catálogo tem mais de 454 modelos hoje, vindos de 61 criadores diferentes, e 19 deles foram lançados nos últimos 30 dias. O M3 entra como o melhor lançamento da MiniMax até aqui, e empurra a briga de custo-benefício para baixo — o DeepSeek V4 Pro, que reinava sozinho na faixa dos US$ 1,70, agora tem companhia imediata.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
DeepSeek V4 Pro 042345.32.0845
Entre os 454 modelos disponíveis no catálogo nesta data.

O que muda na sua escolha hoje

Se você já gasta com um modelo acima de IQ 45 e o orçamento pesa, vale testar o M3 hoje — o custo de experimentar é zero pela versão free, e a diferença de centavos pode virar milhares de reais no fim do mês. Se a sua escolha atual é o GPT-5.3-Codex, vale rodar um workload real pelos dois antes de renovar o contrato.

Em uma frase

Se você roda volume alto acima do IQ 45 e a fatura pesa, vale testar o MiniMax M3 hoje via versão free — e confrontá-lo com o GPT-5.3-Codex em um workload real antes de renovar o contrato.

Perguntas frequentes

O MiniMax M3 é melhor que o GPT-5.3-Codex?

No índice de inteligência atual, o M3 está marginalmente atrás (45,397 contra 45,512). Em muitas tarefas a diferença prática tende a ser pequena, mas o M3 custa quase 12 vezes menos por milhão de tokens de saída. Benchmarks específicos de coding e agentic precisam ser comparados no seu workload antes de decidir.

Posso rodar o MiniMax M3 localmente?

Os pesos são abertos, mas com 428 bilhões de parâmetros totais e 23 bilhões ativos por inferência, rodar fora de um datacenter exige hardware de servidor de alto desempenho. Não é viável em workstation comum.

Qual a diferença entre MiniMax M3 e M3 batch?

A versão batch mantém o mesmo preço de US$ 1,20 por milhão de tokens de saída, mas reduz a janela de contexto de 1 milhão para 524 mil tokens. É voltada para processamentos em lote que não exigem contexto tão longo.

Leia também