FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiniMax M3 batch: o mais barato acima de IQ 45, sem tempo real

A versão assíncrona do M3 custa US$ 1,20 por milhão de tokens de saída — fica abaixo do DeepSeek V4 Pro e do Gemini 3.5 Flash, mas só serve para jobs em fila.

Redação FalaVIP IA 3 min de leitura
US$ 1,20por milhão de tokens de saída
45,397IQ do M3 na medição atual do catálogo
US$ 0,06por milhão de tokens com cache habilitado

US$ 1,20 por milhão de saída muda o cálculo do batch

Sete dias depois do lançamento, o M3 batch da MiniMax aparece como o modelo mais barato do catálogo acima de IQ 45. Custa US$ 1,20 por milhão de tokens de saída — abaixo do DeepSeek V4 Pro 0423 (US$ 1,74) e muito abaixo do Gemini 3.5 Flash (US$ 9). É o tipo de número que altera a conta no fim do mês. Mas vem com uma condição que muita gente ignora: é a versão batch, não a síncrona. Isso restringe o uso, mas não o torna irrelevante — pelo contrário.

O que muda quando o job é batch

Batch é trabalho assíncrono. Você envia uma lista de prompts, espera — horas, minutos, dependendo da fila — e recebe os resultados depois. Pense na diferença entre o hortifruti da esquina e o atacarejo: você paga menos, mas não leva o item na hora. Em troca, o provedor não precisa manter latência prometida, e o preço despenca.

Isso elimina o M3 batch para conversa em tempo real, autocompletar de IDE ou qualquer fluxo em que o usuário está esperando resposta na tela. Sobra o que muita empresa faz em escala offline: sumarização de documentos, classificação de tickets, extração de campos, transcrição multimodal, indexação de base de conhecimento, moderação em lote.

Ficha técnica — MiniMax M3 (batch)
CampoValor
Identificadorminimax/minimax-m3:batch
Criadorminimax
Preço de entradaUS$ 0.300 / M tokens
Preço de saídaUS$ 1.20 / M tokens
Janela de contexto524k
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.060 / M (80% de desconto)

Onde o M3 batch se encaixa no tabuleiro

O catálogo hoje tem 459 modelos de 61 criadores, com 18 lançamentos nos últimos 30 dias. No topo de inteligência, a ordem é: Gemini 3.1 Pro Preview (IQ 47,7, US$ 12 de saída), Gemini 3.5 Flash (IQ 46,7, US$ 9), GPT-5.3-Codex (IQ 45,5, US$ 14), e logo depois o M3 (IQ 45,4, US$ 1,20) e o DeepSeek V4 Pro 0423 (IQ 45,3, US$ 1,74).

O M3 batch empata com o DeepSeek em faixa de inteligência e ganha por quase 31% no preço de saída. A diferença para o GPT-5.3-Codex é brutal: US$ 14 contra US$ 1,20 — quase 12 vezes mais. Mas atenção: o Codex foi medido em código, e o M3 é generalista. Se o seu caso é especificamente geração de código avaliada, o catálogo não publicou índice comparável para o M3, e a conta não fecha só pelo preço.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
DeepSeek V4 Pro 042345.32.0845
Entre os 459 modelos disponíveis no catálogo nesta data.

Para entrada, são US$ 0,30 por milhão; com cache, US$ 0,06. Em workloads de ingestão longa — o M3 batch aceita 524.288 tokens de contexto — o cache muda a conta de verdade. Se você reprocessa o mesmo system prompt mil vezes, paga 0,06 em vez de 0,30 naquelas porções.

Para quem vale trocar

Se sua operação tem fila — processamento noturno de chamados, enrichment de leads, classificação de PDFs jurídicos, moderação de conteúdo em lote, transcrição de vídeos para indexação — vale testar o M3 batch. O argumento é custo-benefício frente ao DeepSeek V4 Pro e ao Gemini 3.5 Flash, especialmente porque o M3 aceita texto, imagem e vídeo como entrada e devolve texto. Se você já quebra o pipeline em duas etapas (visão → resumo), dá para consolidar em uma chamada só.

Em cargas acima de algumas dezenas de milhões de tokens por mês, a economia entre US$ 1,74 e US$ 1,20 de saída — repetida na entrada — começa a aparecer visível na fatura.

Para quem não muda nada

Se o usuário está na ponta esperando resposta, batch não serve. Você precisa do endpoint síncrono, e o catálogo tem opções melhores para isso em cada faixa de preço.

Se o que você precisa é o topo absoluto de inteligência, o Gemini 3.1 Pro Preview segue na frente, com folga de mais de 2 pontos de IQ. Não dá para trocar um pelo outro.

Se você já roda DeepSeek V4 Pro no síncrono para a mesma tarefa e está feliz com a fila, a economia de US$ 0,54 por milhão de saída talvez não compense uma segunda integração.

E se você não tem volume — testes pontuais, prompts avulsos — a diferença de centavos não muda nada.

O que fazer com isso hoje

Se você roda jobs batch acima de IQ 45, abra o M3 no próximo teste de custo. Compare contra o DeepSeek V4 Pro e o Gemini 3.5 Flash na mesma fila, com o mesmo prompt, e meça IQ funcional no seu caso, não o agregado do catálogo. Em multimodal de entrada longa é onde a economia tende a aparecer primeiro — exatamente o tipo de workload que antes era caro demais e agora fica viável.

Em uma frase

Coloque o M3 batch no próximo teste de custo contra o DeepSeek V4 Pro e o Gemini 3.5 Flash em jobs de fila com multimodal e contexto longo; se o usuário não está esperando resposta na tela, é onde a economia de ~31% na saída aparece de verdade.

Perguntas frequentes

MiniMax M3 batch serve para conversa em tempo real?

Não. A variante batch é assíncrona: você envia os prompts, espera a fila processar e recebe os resultados depois. Para chat, autocompletar ou qualquer fluxo com usuário esperando resposta, é preciso usar a versão síncrona do catálogo.

Quanto o M3 batch custa comparado ao DeepSeek V4 Pro?

Na saída, o M3 batch cobra US$ 1,20 por milhão de tokens contra US$ 1,74 do DeepSeek V4 Pro 0423 — diferença de cerca de 31%. Para comparar entrada e cache, vale puxar a ficha atualizada dos dois no catálogo, porque esses valores não foram publicados juntos aqui.

O M3 batch é multimodal?

Sim. Aceita texto, imagem e vídeo como entrada e devolve apenas texto. Em pipelines que combinam visão e linguagem, isso evita a etapa separada de OCR ou captioning — você envia o vídeo e recebe o resumo na mesma chamada.

Leia também