Ministral 3 8B batch da Mistral cobra preço único nos dois lados
Modelo de 8 bilhões de parâmetros com visão e contexto de 262k chega por US$ 0,075 por milhão de token — entrada e saída. Onde ele se encaixa e onde não.
O detalhe que ninguém comenta no release
A Mistral lançou o Ministral 3 8B 2512 há quinze dias, e o que chama atenção não é o tamanho — 8 bilhões de parâmetros é pequeno em 2025 — mas a conta no fim do mês. Entrada e saída custam exatamente a mesma coisa: US$ 0,075 por milhão de tokens. Não é erro de tabela. É a aposta da casa para um modelo que cabe em workloads onde o peso da resposta costuma ser maior que o peso do prompt.
Traduzindo: se você joga um PDF de 50 mil tokens e recebe um resumo de 500 tokens, você paga pelo PDF quase cem vezes mais do que pelo resumo. Com tarifa única, esse desequilíbrio some. Para fluxos onde a saída é longa — geração de código, transcrição estruturada, extração em massa — o cálculo muda.
| Campo | Valor |
|---|---|
| Identificador | mistralai/ministral-8b-2512:batch |
| Criador | mistralai |
| Preço de entrada | US$ 0.075 / M tokens |
| Preço de saída | US$ 0.075 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.007 / M (90% de desconto) |
Onde o Ministral 3 8B se encaixa no tabuleiro
A categoria dele é "modelo pequeno com visão". Não disputa o topo de inteligência com ninguém. O catálogo atual tem 309 modelos listados, e os cinco mais bem posicionados em índice de inteligência são o Xiaomi MiMo-V2-Flash, o OpenAI o3, o Claude Haiku 4.5, o gpt-oss-120b e o Devstral 2 2512 — todos com nota de IQ acima de 19. O Ministral 3 8B nem aparece nessa faixa no recorte de hoje, e a própria ficha não traz nota de inteligência publicada.
Mas a comparação que importa é outra. O Claude Haiku 4.5 cobra US$ 5 por milhão de tokens de saída; o Devstral 2 2512 cobra US$ 2; o gpt-oss-120b cobra US$ 0,17. O Ministral 3 8B batch cobra US$ 0,075. É menos da metade do gpt-oss-120b, menos de 4% do Haiku 4.5. Para o usuário que não precisa de raciocínio pesado e precisa de volume, o argumento é puramente econômico.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
O que ele tem e o que ele não tem
O pacote é direto: contexto de 262.144 tokens (entre os maiores da categoria), multimodalidade texto+imagem→texto, e cache de leitura a US$ 0,0075 por milhão — dez vezes mais barato que o preço de entrada e saída. Esse último ponto é o que paga a conta em pipelines repetitivos: prompts de sistema que entram toda hora, schemas JSON, instruções longas.
O que não está no dado: parâmetros ativos, país de origem, velocidade, raciocínio, cutoff de conhecimento e pesos abertos. Sem isso, não dá para cravar se ele roda bem em hardware próprio, se serve para agente de múltiplas etapas ou se o conhecimento dele para em 2023 ou 2024. A Mistral historicamente libera pesos de modelos pequenos, mas a ficha deste lote não confirma.
Para quem vale — e para quem não muda nada
Vale para você se: roda extração de dados em documentos longos, faz OCR com LLM, gera JSON em massa a partir de imagem, ou tem um agente simples onde o gargalo é custo por chamada e não qualidade de raciocínio. O preço único entrada/saída elimina a necessidade de otimizar prompt para economizar tokens de saída.
Não muda nada se: você precisa de raciocínio encadeado forte, comparação com frontier models, ou nota de benchmark para justificar a escolha para o time. Para isso, o Claude Haiku 4.5 e o o3 continuam sendo as referências — e custam ordens de grandeza acima.
O que fazer com isso hoje
Se você já paga Mistral via API, vale testar o Ministral 3 8B batch em workloads de alto volume e baixo risco — sumarização, classificação, extração. Se você usa OpenAI ou Anthropic, o ponto de comparação interno é o gpt-oss-120b da OpenAI, que tem preço parecido (US$ 0,17 saída) mas score de inteligência superior no recorte atual. A decisão entre os dois passa por benchmark específico da sua tarefa, não por preço.
Roteie o Ministral 3 8B batch para tarefas de alto volume onde a saída não precisa ser brilhante; para raciocínio, continue pagando Haiku 4.5 ou o3.
Perguntas frequentes
Quanto custa o Mistral Ministral 3 8B 2512 batch?
US$ 0,075 por milhão de tokens tanto de entrada quanto de saída, com cache de leitura a US$ 0,0075 por milhão. É um dos preços mais baixos do catálogo atual para modelo multimodal.
O Ministral 3 8B tem visão?
Sim, a modalidade é texto+imagem→texto, então aceita imagem como entrada e devolve texto. O contexto vai até 262.144 tokens.
Vale trocar o Claude Haiku 4.5 pelo Ministral 3 8B?
Só em tarefas de alto volume e baixa exigência de raciocínio. O Haiku 4.5 tem nota de inteligência superior no recorte atual e custa cerca de 67 vezes mais na saída — a diferença existe por algum motivo.