FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiniMax M3 batch entra no top 4 de QI cobrando US$ 1,20 o milhão

Modelo multimodal de 524 mil tokens fica a 0,13 ponto do DeepSeek V4 Pro e cobra um sétimo do Gemini Flash.

Redação FalaVIP IA 3 min de leitura
US$ 1,20por milhão de tokens de saída — o mais barato do dia com QI acima de 45
524.288tokens de contexto
45,397QI atual, 4º lugar no ranking geral do catálogo

Por US$ 1,20 o milhão, M3 batch senta na frente de quase todo mundo

Sete dias depois do lançamento, o MiniMax M3 (batch) aparece em quarto lugar no índice de inteligência atual do catálogo — e cobra uma fração do que cobra quem está acima dele. A US$ 1,20 por milhão de tokens de saída, é o modelo mais barato do dia com QI acima de 45.

Para efeito de comparação, o Gemini 3.5 Flash, em segundo no ranking (QI 46,673), sai por US$ 9,00 pelo mesmo milhão. São 7,5 vezes mais caro. O Gemini 3.1 Pro Preview, primeiro colocado (QI 47,738), cobra US$ 12,00 — dez vezes o preço do M3 batch. A diferença bruta de QI entre M3 e Flash é de 1,28 ponto. Entre M3 e o líder, 2,34 pontos. Cabe a você decidir se essa diferença vale pagar sete a dez vezes mais.

Ficha técnica — MiniMax M3 (batch)
CampoValor
Identificadorminimax/minimax-m3:batch
Criadorminimax
Preço de entradaUS$ 0.300 / M tokens
Preço de saídaUS$ 1.20 / M tokens
Janela de contexto524k
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.060 / M (80% de desconto)

O que justifica o preço (e o que não mudou)

O M3 batch é multimodal: aceita texto, imagem e vídeo como entrada e devolve texto. Tem 524.288 tokens de contexto, o suficiente para analisar um repositório inteiro ou horas de transcrição. Para jobs em lote — pipelines noturnos, ETL de documentos, classificação massiva — a janela grande e o suporte a vídeo fazem diferença real.

O preço de entrada também é agressivo: US$ 0,30 por milhão de tokens lidos, com cache de prompt a US$ 0,06 por milhão. Em workloads que repetem o mesmo preâmbulo milhares de vezes, esse cache derruba o custo por chamada a quase nada.

O que o catálogo não publicou: número de parâmetros, velocidade (tokens por segundo), notas específicas de raciocínio, codificação e agente. A ficha também não informa país de origem, data de corte de conhecimento nem se há pesos abertos — pontos que pesam em contratos com fornecedor único.

Onde o M3 ganha e onde perde no tabuleiro

O concorrente direto em preço é o DeepSeek V4 Pro, a US$ 1,74 por milhão de tokens de saída. O M3 batch é 31% mais barato e tem 0,13 ponto de QI a mais. É a diferença mais apertada do ranking inteiro: você paga menos e leva um modelo marginalmente melhor.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
DeepSeek V4 Pro 042345.32.0845
Entre os 459 modelos disponíveis no catálogo nesta data.

Atrás dos dois vem o Flash, já com salto grande de preço (US$ 9,00) e 1,28 ponto acima. Acima do Flash, a próxima opção é o GPT-5.3-Codex a US$ 14,00 — quase 12 vezes o preço do M3 batch, separado por apenas 0,12 ponto de QI. Para quem não precisa do topo, a fronteira de preço entre "bom o suficiente" e "caríssimo" está hoje entre US$ 1,20 e US$ 9,00.

Vale situar: o catálogo soma 459 modelos ativos hoje, e 18 deles foram lançados nos 30 dias anteriores. O M3 chega em mercado saturado, e preço é a única alavanca que ele tem para furar fila.

Para quem vale a troca

Se seu produto roda jobs assíncronos de classificação, extração a partir de vídeo, ou indexação massiva de documentos, o M3 batch entrega o melhor QI por dólar do catálogo hoje. Tem contexto grande, multimodal completo, cache barato. Migrando do Flash para economizar, a perda de 1,28 ponto de QI pode ser aceitável — mas teste antes. Em benchmarks de codificação pesada e raciocínio formal, o Flash e o GPT-5.3-Codex costumam manter folga.

Para quem não muda nada

Se seu sistema exige latência baixa (resposta em milissegundos), a API batch não é o caminho — você precisa da variante síncrona, e a comparação de preço muda. Se você já tem contrato ou prompt ajustado para OpenAI ou Google, migrar por US$ 0,54 de economia por milhão raramente compensa o retrabalho. E se você precisa do teto absoluto de raciocínio, nem M3 batch nem DeepSeek chegam lá — o caminho continua sendo o Gemini 3.1 Pro Preview.

Em uma frase

Para jobs em lote com multimodal, M3 batch é a melhor relação preço/QI do catálogo hoje; para latência baixa ou teto de raciocínio, o caminho segue em Gemini 3.5 Flash ou Gemini 3.1 Pro.

Perguntas frequentes

O que é a variante batch do MiniMax M3?

Batch é a API assíncrona do modelo — você submete um lote de requisições e recebe os resultados depois, sem garantia de resposta imediata. Pelo preço de US$ 1,20 por milhão de tokens de saída mostrado no catálogo, é indicada para jobs noturnos, classificação massiva e pipelines de extração de informação.

M3 batch serve para codificação e agentes longos?

O catálogo não publicou notas separadas para codificação e agente neste modelo. A janela de 524.288 tokens, porém, comporta bases de código extensas e históricos longos de agente. Para benchmarks específicos de codificação pesada, o GPT-5.3-Codex segue como referência publicada no catálogo.

Vale trocar do Gemini Flash pelo M3 batch?

Se seu caso de uso é multimodal em lote, a economia de US$ 7,80 por milhão de tokens de saída pode ser relevante em alto volume. Se você precisa de baixa latência ou das notas consolidadas do Flash em benchmarks de codificação, ele entrega 1,28 ponto a mais de QI — teste antes de migrar.

Leia também