Ministral 3 8B custa o dobro do Nemotron com mesmo QI
Modelo francês de 8B tem visão, pesos abertos e contexto de 262 mil tokens. Concorrente americano entrega QI parecido por metade do preço.
A conta que aparece primeiro
Quatro dias depois do lançamento, o Ministral 3 8B entra no catálogo cobrando US$ 0,15 por milhão de tokens — mesmo preço na entrada e na saída, cache a US$ 0,015. É o típico "SUV compacto" do mercado de LLM: tem mais que um sedan pequeno, custa mais que um sedan pequeno. A pergunta que o release não responde é para quem esse SUV, de fato, faz sentido.
O concorrente que cobra a metade
Olha o que está sentado na prateleira ao lado. O NVIDIA Nemotron Nano 9B V2, lançado em setembro, marca QI de 8,677 na medição atual. O Ministral 3 8B marca 8,974. Praticamente o mesmo. A diferença aparece no boleto: Nemotron blended a US$ 0,07, Ministral a US$ 0,15 — mais que o dobro. E o Nova Micro 1.0 da Amazon? US$ 0,06125 blended, com 261 tokens por segundo e QI de apenas 4,4.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Ministral 3 8B 2512 (o novo) | 9.0 | 0.15 | 0.15 | 262k |
| Ministral 3 3B 2512 | 7.1 | 0.1 | 0.1 | 131k |
| Nova Micro 1.0 | 4.4 | 0.035 | 0.14 | 128k |
| Nemotron Nano 9B V2 | 8.7 | 0.04 | 0.16 | 131k |
| Ministral 3 14B 2512 | 11.2 | 0.2 | 0.2 | 262k |
Então por que alguém pagaria mais caro no 8B? Porque a Mistral não está vendendo QI pelo QI. Está vendendo um pacote: lê imagem, tem 262 mil tokens de contexto, é de origem francesa e vem com pesos abertos. Os rivais diretos nesse recorte são texto-puro, fechados ou menores.
Onde ele senta no tabuleiro dos pequenos
A própria família Ministral 3 tem três tamanhos, e vale olhar de dentro. O 3B (US$ 0,10) é o econômico, rápido a 208 t/s, mas fraco em código (4,8). O 8B é o meio: código em 9,7, multimodal, contexto longo. O 14B (US$ 0,20) é onde o código sobe para 14,4 e o QI para 11,2.
O 8B não pensa passo a passo (reasoning: false), o que limita uso em agentes que dependem de cadeia explícita — o índice agentic fica em apenas 1,237, contra 2,199 do 14B. A velocidade de 112 tokens por segundo é decente, mas perde feio para o Nova Micro e até para o próprio 3B da casa. No ranking geral de inteligência do catálogo hoje, o topo é o OpenAI o3 com 31,1 — mais que três vezes o QI do 8B. Ninguém compara este modelo com o topo da pirâmide, e a Mistral também não.
Para quem vale pagar a diferença
Você se encaixa se precisa das três coisas ao mesmo tempo: ler imagem dentro de um modelo pequeno, manter 200 mil tokens de contexto sem cortar, e rodar com pesos abertos em servidor próprio — de preferência com requisito de origem europeia. Empresa francesa ou de União Europeia regulada, time que vai fazer fine-tune em GPU interna, produto que ingere PDF com imagem e responde sobre histórico longo. Esse é o nicho onde o 8B para de ser caro e vira escolha.
| Campo | Valor |
|---|---|
| Identificador | mistralai/ministral-8b-2512 |
| Criador | mistralai |
| Preço de entrada | US$ 0.150 / M tokens |
| Preço de saída | US$ 0.150 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.015 / M (90% de desconto) |
| Índice de inteligência (AA) | 9.0 |
| Índice de código | 9.7 |
| Índice agêntico | 1.2 |
| Parâmetros | 8B (8B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 112 tokens/s |
Para quem não muda nada
Se o seu caso é classificar ticket, resumir texto curto ou extrair campo de JSON, o Nemotron Nano 9B entrega o mesmo QI por metade do preço. Se você precisa de código de verdade, salte para o 14B ou para um modelo com reasoning ligado. E se o orçamento é critério número um, Nova Micro continua difícil de bater na entrada — desde que você não precise ler imagem. O Ministral 3 8B não é mau negócio; só não é o "balanced" universal que o nome sugere.
Se você precisa ler imagem, manter 262 mil tokens de contexto e rodar com pesos abertos em servidor europeu, o Ministral 3 8B justifica os US$ 0,15. Para todo o resto — classificação, resumo, agente sem visão — o Nemotron Nano 9B entrega o mesmo QI por metade do preço.
Perguntas frequentes
Quanto custa o Ministral 3 8B 2512 na API?
Cobra US$ 0,15 por milhão de tokens na entrada e na saída, com cache a US$ 0,015 por milhão. O preço blended fica em US$ 0,15, mais que o dobro do Nemotron Nano 9B.
Ministral 3 8B é melhor que o Nemotron Nano 9B?
Em capacidade bruta, são quase iguais: QI 8,974 contra 8,677. O Ministral ganha em multimodalidade (lê imagem), contexto (262 mil contra 131 mil) e origem europeia. Perde em preço (US$ 0,15 contra US$ 0,07 blended).
O Ministral 3 8B serve para rodar agentes?
Não é a melhor escolha. O modelo não tem reasoning ligado e marca apenas 1,237 no índice agentic — bem abaixo do irmão maior 14B, que chega a 2,199. Para agente, melhor saltar para o 14B ou para um modelo com raciocínio.