FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Ministral 3 8B custa o dobro do Nemotron com mesmo QI

Modelo francês de 8B tem visão, pesos abertos e contexto de 262 mil tokens. Concorrente americano entrega QI parecido por metade do preço.

Redação FalaVIP IA 2 min de leitura
US$ 0,15por milhão de tokens de entrada e saída
QI 8,974índice de inteligência (medição atual)
2,1×mais caro que o Nemotron Nano 9B no preço blended

A conta que aparece primeiro

Quatro dias depois do lançamento, o Ministral 3 8B entra no catálogo cobrando US$ 0,15 por milhão de tokens — mesmo preço na entrada e na saída, cache a US$ 0,015. É o típico "SUV compacto" do mercado de LLM: tem mais que um sedan pequeno, custa mais que um sedan pequeno. A pergunta que o release não responde é para quem esse SUV, de fato, faz sentido.

Preço de saída (US$ por milhão de tokens)
Ministral 3 8B 25120,15Ministral 3 3B 25120,1Nova Micro 1.00,14Nemotron Nano 9B V20,16Ministral 3 14B 25120,2US$/M
Fonte: OpenRouter

O concorrente que cobra a metade

Olha o que está sentado na prateleira ao lado. O NVIDIA Nemotron Nano 9B V2, lançado em setembro, marca QI de 8,677 na medição atual. O Ministral 3 8B marca 8,974. Praticamente o mesmo. A diferença aparece no boleto: Nemotron blended a US$ 0,07, Ministral a US$ 0,15 — mais que o dobro. E o Nova Micro 1.0 da Amazon? US$ 0,06125 blended, com 261 tokens por segundo e QI de apenas 4,4.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Ministral 3 8B 2512 (o novo)9.00.150.15262k
Ministral 3 3B 25127.10.10.1131k
Nova Micro 1.04.40.0350.14128k
Nemotron Nano 9B V28.70.040.16131k
Ministral 3 14B 251211.20.20.2262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Então por que alguém pagaria mais caro no 8B? Porque a Mistral não está vendendo QI pelo QI. Está vendendo um pacote: lê imagem, tem 262 mil tokens de contexto, é de origem francesa e vem com pesos abertos. Os rivais diretos nesse recorte são texto-puro, fechados ou menores.

Onde ele senta no tabuleiro dos pequenos

A própria família Ministral 3 tem três tamanhos, e vale olhar de dentro. O 3B (US$ 0,10) é o econômico, rápido a 208 t/s, mas fraco em código (4,8). O 8B é o meio: código em 9,7, multimodal, contexto longo. O 14B (US$ 0,20) é onde o código sobe para 14,4 e o QI para 11,2.

Inteligência × preço de saída
Ministral 3 8B 2512Ministral 3 3B 2512Nova Micro 1.0Nemotron Nano 9B V2Ministral 3 14B 2512US$ por milhão (saída, escala log)índice de inteligência

O 8B não pensa passo a passo (reasoning: false), o que limita uso em agentes que dependem de cadeia explícita — o índice agentic fica em apenas 1,237, contra 2,199 do 14B. A velocidade de 112 tokens por segundo é decente, mas perde feio para o Nova Micro e até para o próprio 3B da casa. No ranking geral de inteligência do catálogo hoje, o topo é o OpenAI o3 com 31,1 — mais que três vezes o QI do 8B. Ninguém compara este modelo com o topo da pirâmide, e a Mistral também não.

Para quem vale pagar a diferença

Você se encaixa se precisa das três coisas ao mesmo tempo: ler imagem dentro de um modelo pequeno, manter 200 mil tokens de contexto sem cortar, e rodar com pesos abertos em servidor próprio — de preferência com requisito de origem europeia. Empresa francesa ou de União Europeia regulada, time que vai fazer fine-tune em GPU interna, produto que ingere PDF com imagem e responde sobre histórico longo. Esse é o nicho onde o 8B para de ser caro e vira escolha.

Ficha técnica — Ministral 3 8B 2512
CampoValor
Identificadormistralai/ministral-8b-2512
Criadormistralai
Preço de entradaUS$ 0.150 / M tokens
Preço de saídaUS$ 0.150 / M tokens
Janela de contexto262k
Modalidadetext+image->text
Leitura de cacheUS$ 0.015 / M (90% de desconto)
Índice de inteligência (AA)9.0
Índice de código9.7
Índice agêntico1.2
Parâmetros8B (8B ativos por token)
Pesosabertos
Velocidade de saída112 tokens/s

Para quem não muda nada

Se o seu caso é classificar ticket, resumir texto curto ou extrair campo de JSON, o Nemotron Nano 9B entrega o mesmo QI por metade do preço. Se você precisa de código de verdade, salte para o 14B ou para um modelo com reasoning ligado. E se o orçamento é critério número um, Nova Micro continua difícil de bater na entrada — desde que você não precise ler imagem. O Ministral 3 8B não é mau negócio; só não é o "balanced" universal que o nome sugere.

Em uma frase

Se você precisa ler imagem, manter 262 mil tokens de contexto e rodar com pesos abertos em servidor europeu, o Ministral 3 8B justifica os US$ 0,15. Para todo o resto — classificação, resumo, agente sem visão — o Nemotron Nano 9B entrega o mesmo QI por metade do preço.

Perguntas frequentes

Quanto custa o Ministral 3 8B 2512 na API?

Cobra US$ 0,15 por milhão de tokens na entrada e na saída, com cache a US$ 0,015 por milhão. O preço blended fica em US$ 0,15, mais que o dobro do Nemotron Nano 9B.

Ministral 3 8B é melhor que o Nemotron Nano 9B?

Em capacidade bruta, são quase iguais: QI 8,974 contra 8,677. O Ministral ganha em multimodalidade (lê imagem), contexto (262 mil contra 131 mil) e origem europeia. Perde em preço (US$ 0,15 contra US$ 0,07 blended).

O Ministral 3 8B serve para rodar agentes?

Não é a melhor escolha. O modelo não tem reasoning ligado e marca apenas 1,237 no índice agentic — bem abaixo do irmão maior 14B, que chega a 2,199. Para agente, melhor saltar para o 14B ou para um modelo com raciocínio.

Leia também