MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex
Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.
IQ 45,397 no índice atual — e US$ 1,20 por milhão de tokens de saída. Esses são os dois números que você precisa guardar sobre o MiniMax M3, lançado hoje pela MiniMax. O material promocional vai falar em "modelo competitivo com o topo". O que ele não vai estampar em letras grandes é que o topo mesmo cobra muito mais caro.
Onde o M3 entra no ranking
No índice atual, o M3 aparece em quarto: abaixo do Gemini 3.1 Pro Preview (47,738), do Gemini 3.5 Flash (46,673) e do GPT-5.3-Codex da OpenAI (45,512). A diferença para o Codex é de 0,115 ponto — praticamente o mesmo lugar.
O detalhe que muda tudo é o preço. O GPT-5.3-Codex cobra US$ 14 por milhão de tokens de saída. O M3 cobra US$ 1,20. São quase 12 vezes menos por um modelo que, no índice agregado, está colado nele.
O que ficou mais barato (e o que ficou igual)
Traduzindo o lançamento para a sua planilha: entrada a US$ 0,30 por milhão de tokens, saída a US$ 1,20 e cache a US$ 0,06. Janela de contexto de 1 milhão de tokens. Multimodal — aceita texto, imagem e vídeo — e devolve texto. Tem raciocínio nativo, 428 bilhões de parâmetros totais, 23 bilhões ativos por inferência, e pesos abertos.
Pense em 428 funcionários num escritório: cada requisição sua só mobiliza 23 deles por vez, porque a arquitetura é MoE. O custo total da operação é alto, mas o trabalho que chega até você sai barato.
No recorte de coding, o M3 marca 58,5 — um número alto, mas que precisa ser confrontado com o do Codex no seu workload real antes de migrar. Em tarefas agentic, fica em 36,1, dentro da faixa dos modelos que custam três vezes mais.
Para quem vale — e para quem não muda nada
Você roda volume alto, multimodalidade entra na rotina, raciocínio importa, e cada centavo por token aparece na fatura no fim do mês? O M3 entra na lista curta hoje. Ele é o modelo mais barato do catálogo inteiro com IQ acima de 45 — à frente do DeepSeek V4 Pro (US$ 1,74 por milhão de saída) e muito à frente do Gemini 3.5 Flash (US$ 9).
Se você precisa do máximo absoluto de capacidade e o orçamento não é o gargalo, o Gemini 3.1 Pro Preview segue na frente com folga — 2,34 pontos de IQ acima do M3. Se o seu fluxo já roda bem no GPT-5.3-Codex e a diferença de centavos não mexe na sua decisão, não há motivo para trocar.
A família completa
A MiniMax não soltou só o principal. Vieram duas variantes: M3 batch, com janela reduzida a 524 mil tokens mas mesmo preço; e M3 free, com entrada e saída zeradas. É a estrutura padrão de quem quer cobrir do desenvolvedor curioso até o cliente enterprise — o caminho sem custo para validar antes de colocar crédito na conta.
O catálogo tem mais de 454 modelos hoje, vindos de 61 criadores diferentes, e 19 deles foram lançados nos últimos 30 dias. O M3 entra como o melhor lançamento da MiniMax até aqui, e empurra a briga de custo-benefício para baixo — o DeepSeek V4 Pro, que reinava sozinho na faixa dos US$ 1,70, agora tem companhia imediata.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiniMax M3 | 45.4 | 1.2 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
O que muda na sua escolha hoje
Se você já gasta com um modelo acima de IQ 45 e o orçamento pesa, vale testar o M3 hoje — o custo de experimentar é zero pela versão free, e a diferença de centavos pode virar milhares de reais no fim do mês. Se a sua escolha atual é o GPT-5.3-Codex, vale rodar um workload real pelos dois antes de renovar o contrato.
Se você roda volume alto acima do IQ 45 e a fatura pesa, vale testar o MiniMax M3 hoje via versão free — e confrontá-lo com o GPT-5.3-Codex em um workload real antes de renovar o contrato.
Perguntas frequentes
O MiniMax M3 é melhor que o GPT-5.3-Codex?
No índice de inteligência atual, o M3 está marginalmente atrás (45,397 contra 45,512). Em muitas tarefas a diferença prática tende a ser pequena, mas o M3 custa quase 12 vezes menos por milhão de tokens de saída. Benchmarks específicos de coding e agentic precisam ser comparados no seu workload antes de decidir.
Posso rodar o MiniMax M3 localmente?
Os pesos são abertos, mas com 428 bilhões de parâmetros totais e 23 bilhões ativos por inferência, rodar fora de um datacenter exige hardware de servidor de alto desempenho. Não é viável em workstation comum.
Qual a diferença entre MiniMax M3 e M3 batch?
A versão batch mantém o mesmo preço de US$ 1,20 por milhão de tokens de saída, mas reduz a janela de contexto de 1 milhão para 524 mil tokens. É voltada para processamentos em lote que não exigem contexto tão longo.