MiniMax M3 batch: o mais barato acima de IQ 45, sem tempo real
A versão assíncrona do M3 custa US$ 1,20 por milhão de tokens de saída — fica abaixo do DeepSeek V4 Pro e do Gemini 3.5 Flash, mas só serve para jobs em fila.
US$ 1,20 por milhão de saída muda o cálculo do batch
Sete dias depois do lançamento, o M3 batch da MiniMax aparece como o modelo mais barato do catálogo acima de IQ 45. Custa US$ 1,20 por milhão de tokens de saída — abaixo do DeepSeek V4 Pro 0423 (US$ 1,74) e muito abaixo do Gemini 3.5 Flash (US$ 9). É o tipo de número que altera a conta no fim do mês. Mas vem com uma condição que muita gente ignora: é a versão batch, não a síncrona. Isso restringe o uso, mas não o torna irrelevante — pelo contrário.
O que muda quando o job é batch
Batch é trabalho assíncrono. Você envia uma lista de prompts, espera — horas, minutos, dependendo da fila — e recebe os resultados depois. Pense na diferença entre o hortifruti da esquina e o atacarejo: você paga menos, mas não leva o item na hora. Em troca, o provedor não precisa manter latência prometida, e o preço despenca.
Isso elimina o M3 batch para conversa em tempo real, autocompletar de IDE ou qualquer fluxo em que o usuário está esperando resposta na tela. Sobra o que muita empresa faz em escala offline: sumarização de documentos, classificação de tickets, extração de campos, transcrição multimodal, indexação de base de conhecimento, moderação em lote.
| Campo | Valor |
|---|---|
| Identificador | minimax/minimax-m3:batch |
| Criador | minimax |
| Preço de entrada | US$ 0.300 / M tokens |
| Preço de saída | US$ 1.20 / M tokens |
| Janela de contexto | 524k |
| Modalidade | text+image+video->text |
| Leitura de cache | US$ 0.060 / M (80% de desconto) |
Onde o M3 batch se encaixa no tabuleiro
O catálogo hoje tem 459 modelos de 61 criadores, com 18 lançamentos nos últimos 30 dias. No topo de inteligência, a ordem é: Gemini 3.1 Pro Preview (IQ 47,7, US$ 12 de saída), Gemini 3.5 Flash (IQ 46,7, US$ 9), GPT-5.3-Codex (IQ 45,5, US$ 14), e logo depois o M3 (IQ 45,4, US$ 1,20) e o DeepSeek V4 Pro 0423 (IQ 45,3, US$ 1,74).
O M3 batch empata com o DeepSeek em faixa de inteligência e ganha por quase 31% no preço de saída. A diferença para o GPT-5.3-Codex é brutal: US$ 14 contra US$ 1,20 — quase 12 vezes mais. Mas atenção: o Codex foi medido em código, e o M3 é generalista. Se o seu caso é especificamente geração de código avaliada, o catálogo não publicou índice comparável para o M3, e a conta não fecha só pelo preço.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiniMax M3 | 45.4 | 1.2 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
Para entrada, são US$ 0,30 por milhão; com cache, US$ 0,06. Em workloads de ingestão longa — o M3 batch aceita 524.288 tokens de contexto — o cache muda a conta de verdade. Se você reprocessa o mesmo system prompt mil vezes, paga 0,06 em vez de 0,30 naquelas porções.
Para quem vale trocar
Se sua operação tem fila — processamento noturno de chamados, enrichment de leads, classificação de PDFs jurídicos, moderação de conteúdo em lote, transcrição de vídeos para indexação — vale testar o M3 batch. O argumento é custo-benefício frente ao DeepSeek V4 Pro e ao Gemini 3.5 Flash, especialmente porque o M3 aceita texto, imagem e vídeo como entrada e devolve texto. Se você já quebra o pipeline em duas etapas (visão → resumo), dá para consolidar em uma chamada só.
Em cargas acima de algumas dezenas de milhões de tokens por mês, a economia entre US$ 1,74 e US$ 1,20 de saída — repetida na entrada — começa a aparecer visível na fatura.
Para quem não muda nada
Se o usuário está na ponta esperando resposta, batch não serve. Você precisa do endpoint síncrono, e o catálogo tem opções melhores para isso em cada faixa de preço.
Se o que você precisa é o topo absoluto de inteligência, o Gemini 3.1 Pro Preview segue na frente, com folga de mais de 2 pontos de IQ. Não dá para trocar um pelo outro.
Se você já roda DeepSeek V4 Pro no síncrono para a mesma tarefa e está feliz com a fila, a economia de US$ 0,54 por milhão de saída talvez não compense uma segunda integração.
E se você não tem volume — testes pontuais, prompts avulsos — a diferença de centavos não muda nada.
O que fazer com isso hoje
Se você roda jobs batch acima de IQ 45, abra o M3 no próximo teste de custo. Compare contra o DeepSeek V4 Pro e o Gemini 3.5 Flash na mesma fila, com o mesmo prompt, e meça IQ funcional no seu caso, não o agregado do catálogo. Em multimodal de entrada longa é onde a economia tende a aparecer primeiro — exatamente o tipo de workload que antes era caro demais e agora fica viável.
Coloque o M3 batch no próximo teste de custo contra o DeepSeek V4 Pro e o Gemini 3.5 Flash em jobs de fila com multimodal e contexto longo; se o usuário não está esperando resposta na tela, é onde a economia de ~31% na saída aparece de verdade.
Perguntas frequentes
MiniMax M3 batch serve para conversa em tempo real?
Não. A variante batch é assíncrona: você envia os prompts, espera a fila processar e recebe os resultados depois. Para chat, autocompletar ou qualquer fluxo com usuário esperando resposta, é preciso usar a versão síncrona do catálogo.
Quanto o M3 batch custa comparado ao DeepSeek V4 Pro?
Na saída, o M3 batch cobra US$ 1,20 por milhão de tokens contra US$ 1,74 do DeepSeek V4 Pro 0423 — diferença de cerca de 31%. Para comparar entrada e cache, vale puxar a ficha atualizada dos dois no catálogo, porque esses valores não foram publicados juntos aqui.
O M3 batch é multimodal?
Sim. Aceita texto, imagem e vídeo como entrada e devolve apenas texto. Em pipelines que combinam visão e linguagem, isso evita a etapa separada de OCR ou captioning — você envia o vídeo e recebe o resumo na mesma chamada.