Ministral 3 14B cobra US$ 0,20/M e perde em IQ para o gpt-oss-20b
Modelo open-weight da Mistral custa 54% mais na saída que o gpt-oss-20b da OpenAI, que pontua 15,225 contra 11,243 no índice da Artificial Analysis
Três dias depois de chegar ao catálogo, o Ministral 3 14B já perdeu a primeira batalha: a da fatura. Cobra US$ 0,20 por milhão de tokens de saída — e o gpt-oss-20b, open-weight da OpenAI lançado em agosto, cobra US$ 0,13 pelo mesmo token, com índice de inteligência maior.
A conta que não fecha
A Mistral não está vendendo um modelo pior à toa. O Ministral 3 14B é denso (14B parâmetros ativos, sem truques de MoE), aceita imagem e tem contexto de 262 mil tokens — o dobro do gpt-oss-20b. Mas quando o boleto chega, "denso" e "visão" não aparecem: aparecem centavos por milhão. E ali o modelo da OpenAI ganha: 35% mais barato na saída, índice 15,225 contra 11,243, raciocínio embutido, 3,6B ativos em 21B totais.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Ministral 3 14B 2512 (o novo) | 11.2 | 0.2 | 0.2 | 262k |
| Ministral 3 3B 2512 | 7.1 | 0.1 | 0.1 | 131k |
| gpt-oss-20b | 15.2 | 0.03 | 0.13 | 131k |
| Ministral 3 8B 2512 | 9.0 | 0.15 | 0.15 | 262k |
| Nemotron Nano 9B V2 | 8.7 | 0.04 | 0.16 | 131k |
Para quem roda volume, esses 7 centavos de diferença por milhão viram milhares de reais no fim do mês.
A família toda de uma vez
Em 2 de dezembro, a Mistral soltou três modelos no mesmo dia: Ministral 3 3B (US$ 0,10/M, IQ 7,074), 8B (US$ 0,15/M, IQ 8,974) e 14B (US$ 0,20/M, IQ 11,243). O salto do 8B para o 14B dá 2,3 pontos de IQ por 33% a mais de custo. Se você está escolhendo dentro da própria família, o 8B entrega 80% do IQ por 75% do preço.
A descrição oficial chama o 14B de "capacidades de fronteira comparáveis ao Mistral Small 3.2 24B". Traduzindo do marketing: a Mistral quer que você leia o 14B como substituto compacto do Small. O índice 11,243 está bem longe do top 5 do mercado hoje — OpenAI o3 (31,096), Claude Haiku 4.5 (29,892), gpt-oss-120b (24,126), Nova 2 Lite da Amazon (19,24) e Qwen3 Next 80B Thinking (16,867). É um modelo competente de faixa média, não fronteira.
No gráfico de inteligência por dólar, o 14B não fica no pior canto — mas também não fica no melhor. O gpt-oss-20b ocupa posição dominante: mais IQ, menos preço.
Onde o 14B ainda se sustenta
Três diferenciais reais contra o open-weight da OpenAI:
- Visão nativa: recebe imagem, devolve texto. Serve para PDFs com figuras, screenshots e layouts visuais.
- Contexto de 262 mil tokens: cabe um codebase médio inteiro sem truncar.
- Densidade: 14B ativos sempre, sem surpresas de roteamento de especialistas — mais simples de fazer fine-tuning e servir em edge.
Velocidade fica em 107 tokens por segundo, contra 112 do gpt-oss-20b. Empate prático.
Para quem vale — e para quem não
Vale se você precisa de multimodalidade open-weight com contexto longo e quer manter tudo em uma família só. Vale se roda local e prefere modelo denso. Vale se a workload é imagem-pesada e texto-leve.
Não vale se o trabalho é raciocínio puro ou extração de custo por token de saída — o gpt-oss-20b ganha nos dois. Não vale se o orçamento está apertado e multimodalidade não é requisito — o próprio Ministral 8B custa US$ 0,15/M e entrega 80% do IQ. E não vale se você quer o melhor da categoria, porque aí o caminho é Claude Haiku 4.5 ou gpt-oss-120b, que custam mais caro mas estão em outra liga de inteligência.
A implicação prática é direta: o Ministral 3 14B não é o modelo padrão da sua stack. É uma ferramenta específica — multimodal, contexto longo, pesos abertos, francês — para casos onde essas quatro coisas importam juntas. No resto do tabuleiro, há opção mais barata e mais inteligente pelo mesmo token.
Só vá de Ministral 3 14B quando multimodalidade nativa e contexto de 262 mil tokens forem requisito; para o resto, o gpt-oss-20b entrega mais IQ por menos dólar, e o próprio Ministral 8B cobre 80% do uso por 75% do preço.
Perguntas frequentes
O Ministral 3 14B aceita imagem?
Sim, é multimodal nativo: recebe texto e imagem, devolve texto. É um dos diferenciais contra o gpt-oss-20b, que só processa texto.
Quanto custa o Ministral 3 14B?
US$ 0,20 por milhão de tokens de entrada e saída, com cache de leitura a US$ 0,02/M. Foi colocado no catálogo em 2 de dezembro de 2025.
Vale mais que o gpt-oss-20b?
Só em casos específicos — quando você precisa de visão nativa ou contexto de 262 mil tokens. Em custo por token de saída e índice de inteligência, o open-weight da OpenAI ganha.