FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Ministral 3 14B cobra US$ 0,20/M e perde em IQ para o gpt-oss-20b

Modelo open-weight da Mistral custa 54% mais na saída que o gpt-oss-20b da OpenAI, que pontua 15,225 contra 11,243 no índice da Artificial Analysis

Redação FalaVIP IA 3 min de leitura
US$ 0,20por milhão de tokens de saída
11.243índice de inteligência Artificial Analysis
262.144tokens de contexto

Três dias depois de chegar ao catálogo, o Ministral 3 14B já perdeu a primeira batalha: a da fatura. Cobra US$ 0,20 por milhão de tokens de saída — e o gpt-oss-20b, open-weight da OpenAI lançado em agosto, cobra US$ 0,13 pelo mesmo token, com índice de inteligência maior.

A conta que não fecha

Preço de saída (US$ por milhão de tokens)
Ministral 3 14B 25120,2Ministral 3 3B 25120,1gpt-oss-20b0,13Ministral 3 8B 25120,15Nemotron Nano 9B V20,16US$/M
Fonte: OpenRouter

A Mistral não está vendendo um modelo pior à toa. O Ministral 3 14B é denso (14B parâmetros ativos, sem truques de MoE), aceita imagem e tem contexto de 262 mil tokens — o dobro do gpt-oss-20b. Mas quando o boleto chega, "denso" e "visão" não aparecem: aparecem centavos por milhão. E ali o modelo da OpenAI ganha: 35% mais barato na saída, índice 15,225 contra 11,243, raciocínio embutido, 3,6B ativos em 21B totais.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Ministral 3 14B 2512 (o novo)11.20.20.2262k
Ministral 3 3B 25127.10.10.1131k
gpt-oss-20b15.20.030.13131k
Ministral 3 8B 25129.00.150.15262k
Nemotron Nano 9B V28.70.040.16131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem roda volume, esses 7 centavos de diferença por milhão viram milhares de reais no fim do mês.

A família toda de uma vez

Índice de inteligência (Artificial Analysis)
Ministral 3 14B 251211,2Ministral 3 3B 25127,1gpt-oss-20b15,2Ministral 3 8B 25129Nemotron Nano 9B V28,7índice
Fonte: Artificial Analysis

Em 2 de dezembro, a Mistral soltou três modelos no mesmo dia: Ministral 3 3B (US$ 0,10/M, IQ 7,074), 8B (US$ 0,15/M, IQ 8,974) e 14B (US$ 0,20/M, IQ 11,243). O salto do 8B para o 14B dá 2,3 pontos de IQ por 33% a mais de custo. Se você está escolhendo dentro da própria família, o 8B entrega 80% do IQ por 75% do preço.

A descrição oficial chama o 14B de "capacidades de fronteira comparáveis ao Mistral Small 3.2 24B". Traduzindo do marketing: a Mistral quer que você leia o 14B como substituto compacto do Small. O índice 11,243 está bem longe do top 5 do mercado hoje — OpenAI o3 (31,096), Claude Haiku 4.5 (29,892), gpt-oss-120b (24,126), Nova 2 Lite da Amazon (19,24) e Qwen3 Next 80B Thinking (16,867). É um modelo competente de faixa média, não fronteira.

Inteligência × preço de saída
Ministral 3 14B 2512Ministral 3 3B 2512gpt-oss-20bMinistral 3 8B 2512Nemotron Nano 9B V2US$ por milhão (saída, escala log)índice de inteligência

No gráfico de inteligência por dólar, o 14B não fica no pior canto — mas também não fica no melhor. O gpt-oss-20b ocupa posição dominante: mais IQ, menos preço.

Onde o 14B ainda se sustenta

Três diferenciais reais contra o open-weight da OpenAI:

  • Visão nativa: recebe imagem, devolve texto. Serve para PDFs com figuras, screenshots e layouts visuais.
  • Contexto de 262 mil tokens: cabe um codebase médio inteiro sem truncar.
  • Densidade: 14B ativos sempre, sem surpresas de roteamento de especialistas — mais simples de fazer fine-tuning e servir em edge.

Velocidade fica em 107 tokens por segundo, contra 112 do gpt-oss-20b. Empate prático.

Para quem vale — e para quem não

Vale se você precisa de multimodalidade open-weight com contexto longo e quer manter tudo em uma família só. Vale se roda local e prefere modelo denso. Vale se a workload é imagem-pesada e texto-leve.

Não vale se o trabalho é raciocínio puro ou extração de custo por token de saída — o gpt-oss-20b ganha nos dois. Não vale se o orçamento está apertado e multimodalidade não é requisito — o próprio Ministral 8B custa US$ 0,15/M e entrega 80% do IQ. E não vale se você quer o melhor da categoria, porque aí o caminho é Claude Haiku 4.5 ou gpt-oss-120b, que custam mais caro mas estão em outra liga de inteligência.

A implicação prática é direta: o Ministral 3 14B não é o modelo padrão da sua stack. É uma ferramenta específica — multimodal, contexto longo, pesos abertos, francês — para casos onde essas quatro coisas importam juntas. No resto do tabuleiro, há opção mais barata e mais inteligente pelo mesmo token.

Em uma frase

Só vá de Ministral 3 14B quando multimodalidade nativa e contexto de 262 mil tokens forem requisito; para o resto, o gpt-oss-20b entrega mais IQ por menos dólar, e o próprio Ministral 8B cobre 80% do uso por 75% do preço.

Perguntas frequentes

O Ministral 3 14B aceita imagem?

Sim, é multimodal nativo: recebe texto e imagem, devolve texto. É um dos diferenciais contra o gpt-oss-20b, que só processa texto.

Quanto custa o Ministral 3 14B?

US$ 0,20 por milhão de tokens de entrada e saída, com cache de leitura a US$ 0,02/M. Foi colocado no catálogo em 2 de dezembro de 2025.

Vale mais que o gpt-oss-20b?

Só em casos específicos — quando você precisa de visão nativa ou contexto de 262 mil tokens. Em custo por token de saída e índice de inteligência, o open-weight da OpenAI ganha.

Leia também