Ministral 3 3B custa US$ 0,10 por milhão de tokens e não vence ninguém em inteligência
O modelo pequeno e aberto da Mistral chega barato, mas o índice de inteligência fica abaixo de alternativas que cobram menos ou o mesmo.
Oito dias depois de entrar no catálogo, o Ministral 3 3B 2512 já coleciona números que merecem ser lidos com lupa. A Mistral vendeu a novidade como um modelo pequeno, aberto e barato, com visão. Os três adjetivos batem. O problema mora no quarto quesito, o que ninguém põe em slide: inteligência.
O preço é o ponto
A cobrança do Ministral 3 3B é simples: US$ 0,10 por milhão de tokens na entrada e na saída, com cache a US$ 0,01. Para colocar em perspectiva, é o mesmo preço de tabela do irmão maior, o Ministral 3 8B, que entrega índice de inteligência 27% maior (8,974 contra 7,074). Paga-se o mesmo por um modelo que pontua menos.
A diferença para o IBM Granite 4.0 Micro, do outro lado, é mais cruel ainda. O Micro custa US$ 0,017 de entrada e US$ 0,112 de saída, com 3B de parâmetros, e mesmo assim o índice de inteligência é de 1,952 — pior que o do Ministral 3 3B. Em outras palavras: o Ministral 3 3B é mais inteligente que o IBM, mas não por dinheiro: por capacidade. Se a conta da API é o que manda, o IBM vence. Se a capacidade é o que manda, o Ministral 3 3B vence. Os dois não vencem juntos.
A inteligência não impressiona
Olhando o índice de inteligência de 7,074, o 3B fica atrás do Amazon Nova Micro (4,416) em capacidade absoluta — espera, não: à frente dele (7,074 > 4,416), mas atrás do NVIDIA Nemotron Nano 9B V2 (8,677) e bem atrás do próprio Ministral 3 8B (8,974). Em programação, a nota é 4,784; em tarefas agentic, 1,581. Nenhum desses números o coloca no topo de nada.
Para localizar no tabuleiro: o topo do catálogo nesta data tem OpenAI o3 com 31,096, Claude Haiku 4.5 com 29,892 e gpt-oss-120b com 24,126. O Ministral 3 3B está a cerca de um quarto do Haiku 4.5 em capacidade por dólar. É um modelo pequeno competindo em uma faixa onde a régua é, por definição, baixa.
Para quem ele vale — e para quem não
Vale para quem precisa de um modelo aberto, de 3B de parâmetros, com visão (text+image->text) e 131 072 tokens de contexto, rodando local ou em infraestrutura enxuta. A velocidade reportada de 208,41 tokens por segundo combina com tarefas de classificação, extração, resumo curto e roteamento de intenção. Pesa a favor o fato de ser open weights, com pesos disponíveis, o que permite ajuste fino e inferência on-premise sem custo de API por token.
Não vale para quem quer o melhor da categoria pequena. O Ministral 3 8B, do mesmo lançamento, custa o mesmo preço e pontua mais em quase tudo. Para quem busca custo mínimo absoluto, o IBM Granite 4.0 Micro cobra uma fração pela entrada. Para quem busca capacidade próxima, o NVIDIA Nemotron Nano 9B V2 (9B, raciocínio ativo) custa US$ 0,04 de entrada e entrega mais inteligência, embora seja maior.
| Campo | Valor |
|---|---|
| Identificador | mistralai/ministral-3b-2512 |
| Criador | mistralai |
| Preço de entrada | US$ 0.100 / M tokens |
| Preço de saída | US$ 0.100 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.010 / M (90% de desconto) |
| Índice de inteligência (AA) | 7.1 |
| Índice de código | 4.8 |
| Índice agêntico | 1.6 |
| Parâmetros | 3B (3B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 208 tokens/s |
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Ministral 3 3B 2512 (o novo) | 7.1 | 0.1 | 0.1 | 131k |
| Granite 4.0 Micro | 2.0 | 0.017 | 0.112 | 131k |
| Nova Micro 1.0 | 4.4 | 0.035 | 0.14 | 128k |
| Ministral 3 8B 2512 | 9.0 | 0.15 | 0.15 | 262k |
| Nemotron Nano 9B V2 | 8.7 | 0.04 | 0.16 | 131k |
O detalhe que ninguém comenta
O preço de US$ 0,10 por milhão é o mesmo do Ministral 3 8B. A Mistral não criou uma faixa de preço para o modelo menor — apenas uma faixa de capacidade. Isso significa que, na prática, escolher entre os dois dentro da família é escolher quanto de inteligência você quer pelo mesmo dinheiro. Não há economia ao optar pelo 3B; há perda de capacidade.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
| Nova 2 Lite | 19.2 | 2.5 |
A conta final depende do que você roda. Para inferência local em CPU ou GPU pequena, o 3B é viável onde o 8B não é. Para API, o 8B é a escolha racional ao mesmo preço. Para um projeto novo que não exige open weights, o Nova Micro da Amazon, mais barato na entrada, ainda entrega menos inteligência — mas a discussão volta à pergunta original: você está comprando capacidade ou está comprando bytes?
Se você roda na API e não precisa de pesos abertos, o Ministral 3 8B pelo mesmo preço é a escolha racional; o 3B só compensa quando o limite é rodar local em hardware pequeno.
Perguntas frequentes
O Ministral 3 3B é gratuito?
Não. No catálogo, ele aparece como modelo pago a US$ 0,10 por milhão de tokens de entrada e de saída, com cache a US$ 0,01. O que é gratuito é o acesso aos pesos abertos (open weights), o que permite rodar local sem pagar API.
Qual a diferença entre Ministral 3 3B e Ministral 3 8B?
Ambos foram lançados em 2 de dezembro de 2025 e custam US$ 0,10 por milhão de tokens. O 8B tem índice de inteligência 8,974 contra 7,074 do 3B, contexto de 262 144 tokens (o dobro) e nota de programação 9,691 contra 4,784. O 3B é menor e mais barato de rodar local.
O Ministral 3 3B tem visão?
Sim. A modalidade declarada é text+image->text, ou seja, aceita imagem como entrada e gera só texto na saída, segundo a ficha do catálogo nesta data.