FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

MiniMax M2.5 free chega com 200K de contexto e zero na fatura

Modelo chinês de produtividade estreia gratuito no catálogo um dia após o lançamento; ficha técnica sem preço nem benchmark publicado

Redação FalaVIP IA 3 min de leitura
US$ 0por milhão de tokens de entrada e saída
204.800tokens de janela de contexto
334modelos listados no catálogo nesta data

O preço que não está na fatura

Você abriu o painel da API, escolheu o modelo novo e a linha do custo ficou em branco. Não é bug: é o ponto. O MiniMax M2.5 free entrou no catálogo ontem, dia 12 de fevereiro de 2026, com tarifa zero tanto na entrada quanto na saída de tokens. Em outras palavras, você pode mandar 200 mil tokens de contexto, receber a resposta inteira e o extrato do mês não se move.

A conta, claro, é de outro lugar — quem paga é o provedor que hospeda a versão gratuita, não você. Mas se a pergunta é "quanto custa testar isso na minha aplicação", a resposta é: literalmente nada.

O que o catálogo não te conta

A ficha do M2.5 free vem com buracos que merecem atenção. Não há índice de inteligência publicado, nem benchmark de coding, agentic ou raciocínio. Não há tamanho de parâmetros, país de origem explícito, velocidade medida nem data de corte de conhecimento. O criador é o mesmo MiniMax que assina o catálogo desde o começo, e a descrição oficial fala em "SOTA large language model para produtividade do mundo real", treinado em ambientes digitais complexos e construído sobre a expertise de código do M2.1.

Quando o fornecedor não publica benchmark, você tem duas opções: confiar no release e gastar a sua quota de testes, ou tratar o modelo como caixa-preta até alguém independente medir. Para um modelo gratuito, a segunda postura costuma ser a mais barata.

Ficha técnica — MiniMax M2.5
CampoValor
Identificadorminimax/minimax-m2.5
Criadorminimax
Preço de entradaUS$ 0.270 / M tokens
Preço de saídaUS$ 1.08 / M tokens
Janela de contexto205k
Modalidadetext->text
Leitura de cacheUS$ 0.027 / M (90% de desconto)

Onde ele se encaixa no tabuleiro

O topo do catálogo hoje, medido pelo índice de inteligência atual, tem a Xiaomi na frente com o MiMo-V2-Flash (IQ 34,024, a US$ 0,30 por milhão de saída), seguida do OpenAI o3 (IQ 31,096, a US$ 8) e do Anthropic Claude Haiku 4.5 (IQ 29,892, a US$ 5). Mais abaixo aparecem o gpt-oss-120b da OpenAI (IQ 24,126, a US$ 0,17) e o Qwen3 Coder Next (IQ 21,294, a US$ 0,80). O M2.5 free não tem nota publicada, então não dá para colocá-lo nessa régua com honestidade.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 334 modelos disponíveis no catálogo nesta data.

O que dá para dizer é o seguinte: entre os modelos com preço de saída abaixo de US$ 1 por milhão, o M2.5 free é o único que cobra zero. O gpt-oss-120b, da OpenAI, é o concorrente natural para quem busca capacidade alta a custo baixo — e aliás é um modelo de pesos abertos, o que muda completamente a conversa se você roda local. Para quem busca especificamente o tier gratuito, o M2.5 entra como mais uma opção num espaço que costuma ter um ou dois modelos por vez.

Para quem vale — e para quem não muda nada

Vale para você se está prototipando uma feature nova, precisa de uma janela de contexto grande (os 204.800 tokens são o dobro do que se vê em modelos de entrada) e quer esticar o orçamento até validar a ideia antes de migrar para um modelo pago. Vale também para workloads de baixo risco onde um erro a mais ou a menos não pesa — classificação simples, extração de dados, rascunhos longos, transformação de texto.

Não muda nada para você se já roda o gpt-oss-120b ou um modelo local de pesos abertos e está satisfeito com a qualidade. Não muda nada se a sua aplicação depende de benchmark específico e reprodutível — sem nota de inteligência publicada, você não tem como comparar antes de gastar tempo testando. E não muda nada se o seu gargalo é latência ou throughput: a velocidade do M2.5 free não foi divulgada, e modelos gratuitos costumam ter rate limit agressivo que aparece só quando você escala.

O que fazer agora

Se você é dev e paga a API, o movimento de hoje é simples: pegue um caso real do seu produto que cabe em 200 mil tokens, rode pelo M2.5 free e meça o que importa para você — taxa de acerto, latência, formato da saída. Se o resultado for próximo do que você paga caro para obter, aí sim vale pensar em mover volume. Se for pior, você perdeu algumas horas e zero dólares, o que é o melhor cenário possível para um teste cego.

E fica de olho: 19 modelos foram lançados nos últimos 30 dias, e a faixa gratuita costuma rotacionar rápido. Quem entra de graça hoje pode deixar de ser gratuito amanhã, ou sumir do catálogo sem aviso.

Em uma frase

Teste o M2.5 free em um caso real com janela de contexto longa antes de migrar volume; sem benchmark publicado, a única régua que vale é a sua.

Perguntas frequentes

O MiniMax M2.5 free tem benchmark publicado?

Não. A ficha no catálogo não traz índice de inteligência, nem notas de coding, agentic ou raciocínio. Para comparar com outros modelos, você precisa rodar o seu próprio teste.

Quanto custa usar o MiniMax M2.5 free?

Zero por milhão de tokens de entrada e de saída. O custo é absorvido pelo provedor que hospeda a versão gratuita, não pelo usuário da API.

Qual a diferença entre o M2.5 free e o gpt-oss-120b da OpenAI?

O gpt-oss-120b tem índice de inteligência 24,126 e custa US$ 0,17 por milhão de tokens de saída, além de ser um modelo de pesos abertos. O M2.5 free é gratuito, tem janela de contexto maior (204.800 tokens), mas não tem benchmark publicado nem informação sobre pesos abertos.

Leia também