FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Olmo 3.1 32B Instruct custa US$ 0,60 por milhão de saída — e entrega menos inteligência que um modelo de 3B da Mistral

A AllenAI abriu o código de um 32B que perde, no índice de inteligência, para o Ministral 3B que cabe em qualquer GPU.

Redação FalaVIP IA 3 min de leitura
6,212índice de inteligência do Olmo 3.1 32B Instruct
US$ 0,60por milhão de tokens de saída
8,974índice do Ministral 3 8B, menor e mais barato

A conta chegou antes da curiosidade. O Olmo 3.1 32B Instruct, da AllenAI, entra hoje no catálogo cobrando US$ 0,20 por milhão de tokens de entrada e US$ 0,60 por milhão de saída — e, no índice de inteligência que rege essa discussão, marca 6,212. É um número baixo. Para situar: o topo da tabela hoje é o Xiaomi MiMo-V2-Flash, com 34,024, seguido do OpenAI o3 (31,096) e do Claude Haiku 4.5 (29,892). Estamos falando de um modelo que não está brigando com esses.

Índice de inteligência (Artificial Analysis)
Olmo 3.1 32B Instruct6,2Ministral 3 3B 25127,1Granite 4.0 Micro2Nova Micro 1.04,4Ministral 3 8B 25129índice
Fonte: Artificial Analysis

Onde ele se encaixa, então

O 3.1 32B Instruct é um modelo denso de 32,2 bilhões de parâmetros, todos ativos, com pesos abertos, contexto de 65.536 tokens e foco declarado em diálogo multi-turno e seguimento de instrução. Não é um modelo de raciocínio — o campo reasoning está em falso — e não traz preço de cache publicado. A descrição do catálogo não traz data de corte de conhecimento, então trate qualquer coisa factual que ele afirme como suspeita até checar.

A pergunta que importa é: para que serve um 32B com esse índice, nesse preço? A resposta vem quando você compara com o que já existia.

A comparação que dói

Olha o que está sentado na mesma prateleira de modelos pequenos e abertos:

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Olmo 3.1 32B Instruct (o novo)6.20.20.666k
Ministral 3 3B 25127.10.10.1131k
Granite 4.0 Micro2.00.0170.112131k
Nova Micro 1.04.40.0350.14128k
Ministral 3 8B 25129.00.150.15262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O Ministral 3 8B, da Mistral, lançado em 2 de dezembro de 2025, custa US$ 0,15 por milhão de saída — quatro vezes mais barato — e marca 8,974 no índice de inteligência. É menor (8B contra 32B), mas entrega mais. O Ministral 3 3B, ainda mais barato (US$ 0,10 por milhão de saída), marca 7,074. O Olmo 3.1 32B perde para os dois.

Preço de saída (US$ por milhão de tokens)
Olmo 3.1 32B Instruct0,6Ministral 3 3B 25120,1Granite 4.0 Micro0,112Nova Micro 1.00,14Ministral 3 8B 25120,15US$/M
Fonte: OpenRouter

Quer o contraponto de outro lado? O Granite 4.0 Micro, da IBM, custa US$ 0,112 por milhão de saída e marca 1,952 — é pior no índice, mas é quase cinco vezes mais barato. O Nova Micro 1.0, da Amazon, marca 4,416 a US$ 0,14 por milhão de saída. Em nenhum desses pares o Olmo 3.1 32B ganha.

Inteligência × preço de saída
Olmo 3.1 32B InstructMinistral 3 3B 2512Granite 4.0 MicroNova Micro 1.0Ministral 3 8B 2512US$ por milhão (saída, escala log)índice de inteligência

O argumento dos pesos abertos

Existe um porém que os números não capturam: o Olmo 3.1 32B Instruct tem pesos abertos (open_weights: true). Você pode baixar, fazer fine-tune, hospedar na sua própria infraestrutura e tirar a fatura da API do meio. Para quem precisa de soberania sobre o modelo — empresas reguladas, times que ajustam o modelo para domínio próprio, projetos que não podem mandar dado sensível para API de terceiros — esse é o ponto. É o mesmo argumento que vale para a família Olmo há meses.

Mas o índice de inteligência é o que é. Se você quer o melhor modelo aberto pequeno pelo dinheiro, hoje, o Ministral 3 8B entrega mais por menos e ainda tem visão (text+image->text). Se você quer o mais barato possível e aceita qualidade menor, o Granite Micro ou o Nova Micro resolvem.

Ficha técnica — Olmo 3.1 32B Instruct
CampoValor
Identificadorallenai/olmo-3.1-32b-instruct
Criadorallenai
Preço de entradaUS$ 0.200 / M tokens
Preço de saídaUS$ 0.600 / M tokens
Janela de contexto66k
Modalidadetext->text
Índice de inteligência (AA)6.2
Parâmetros32.2B (32.2B ativos por token)
Pesosabertos

Para quem vale

Vale para quem precisa de pesos abertos acima de qualquer outra coisa, tem hardware para rodar 32B em GPU própria e aceita o índice de inteligência atual como piso para fine-tunar em cima. É o canivete suíço do time que quer treinar, não o canivete suíço do time que quer chamar de API.

Para quem não muda nada

Não muda nada para quem já chama Mistral, Granite ou Nova por API e não tem demanda específica por pesos abertos nesse tamanho. Não muda nada para quem precisa de raciocínio — o campo está em falso. Não muda nada para quem busca o melhor custo-benefício da categoria pequena: o índice de 6,212 perde para modelos menores e mais baratos que já estão no mercado há mais de um mês.

O tabuleiro

Em 6 de janeiro de 2026, o catálogo tem mais de 314 modelos de 48 criadores diferentes, e 19 foram lançados nos últimos 30 dias. A briga na faixa pequena e aberta está densa: Mistral, IBM, AllenAI, Amazon, todos disputando o mesmo centavo por milhão de tokens. O Olmo 3.1 32B Instruct entra nesse ringue cobrando caro pelo que entrega — a menos que o seu caso de uso seja especificamente "quero os pesos".

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 314 modelos disponíveis no catálogo nesta data.

A implicação prática: antes de colocar o Olmo 3.1 32B Instruct numa rota de produção, rode o seu próprio eval com o seu dado. O índice de catálogo é referência, não sentença — e, nesse caso, a referência aponta para os concorrentes menores e mais baratos.

Em uma frase

Só faz sentido trocar para o Olmo 3.1 32B Instruct se você precisa especificamente de pesos abertos de 32B; em custo-benefício, o Ministral 3 8B ganha no índice e no preço.

Perguntas frequentes

O Olmo 3.1 32B Instruct é melhor que o Ministral 3 8B?

Não pelo índice de inteligência atual: o Olmo 3.1 32B marca 6,212 contra 8,974 do Ministral 3 8B, e custa quatro vezes mais por milhão de tokens de saída (US$ 0,60 contra US$ 0,15).

Quanto custa usar o Olmo 3.1 32B Instruct pela API?

US$ 0,20 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. O catálogo não publicou preço de cache para este modelo.

O Olmo 3.1 32B Instruct serve para raciocínio ou agentes?

Não. O catálogo marca o campo `reasoning` como falso e não traz nota de agentic — é um modelo de instrução e diálogo, não um modelo de raciocínio estruturado.

Leia também