FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Mistral Large 3 2512 cobra US$ 1,50 por milhão de saída e perde em inteligência para o3

Modelo aberto da Mistral estreia com 675B parâmetros, mas fica abaixo do Claude Haiku 4.5 e do gpt-oss-120b no índice de inteligência atual.

Redação FalaVIP IA 3 min de leitura
US$ 1,50por milhão de tokens de saída
15,92índice de inteligência (atual)
41B / 675Bparâmetros ativos sobre totais (MoE)

O que a conta mostra antes do entusiasmo

A Mistral soltou o Large 3 2512 há três dias, em 1º de dezembro, e o discurso oficial é o de sempre: "nosso modelo mais capaz até hoje". Olhando só o preço, a proposta parece agressiva — US$ 0,50 por milhão de tokens de entrada e US$ 1,50 por milhão de saída, com cache a US$ 0,05. É mais barato do que o Claude Haiku 4.5 (US$ 5,00 de saída) e do que o o3 (US$ 8,00). Só que, quando você cruza preço com o índice de inteligência medido hoje, a conta começa a complicar.

Preço de saída (US$ por milhão de tokens)
Mistral Large 3 25121,5gpt-oss-20b0,13Ministral 3 14B 25120,2Llama 4 Scout0,3Llama 3.3 Nemotron Super 49B0,4US$/M
Fonte: OpenRouter

Onde ele se posiciona de verdade

O Large 3 2512 marca 15,92 no índice de inteligência atual. Para situar: o o3 lidera com 31,10, o Claude Haiku 4.5 vem em 29,89, o gpt-oss-120b da OpenAI está em 24,13, o Nova 2 Lite da Amazon em 19,24 e o Qwen3 Next 80B Thinking em 16,87. O Mistral fica logo abaixo do Qwen3 e distante do Haiku 4.5 por uma margem grande.

Índice de inteligência (Artificial Analysis)
Mistral Large 3 251215,9gpt-oss-20b15,2Ministral 3 14B 251211,2Llama 4 Scout10,3Llama 3.3 Nemotron Super 49B12,4índice
Fonte: Artificial Analysis

Em coding ele vai melhor: 20,07, praticamente empatado com o gpt-oss-20b (20,70). Já em agentic a nota é 5,52 — mais alta que a do gpt-oss-20b (3,10) e do Llama 4 Scout (1,10), mas ainda longe de modelos pensados para tool calling pesado. É um perfil de coder competente, não de agente autônomo.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Mistral Large 3 2512 (o novo)15.90.51.5262k
gpt-oss-20b15.20.030.13131k
Ministral 3 14B 251211.20.20.2262k
Llama 4 Scout10.30.10.31.31M
Llama 3.3 Nemotron Super 49B12.40.40.4131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A analogia que ajuda

Pense no Large 3 2512 como um motor 2.0 turbo: tem potência de pico boa (coding) e entrega torque em várias faixas, mas o consumo por quilômetro (preço por inteligência entregue) não é o melhor da categoria. Você não está comprando economia — está comprando flexibilidade.

Para quem vale a pena

Vale se você precisa de três coisas ao mesmo tempo: pesos abertos (licença Apache 2.0), contexto de 262 mil tokens e multimodalidade de entrada (texto, imagem e arquivo). É um dos poucos modelos abertos com essa combinação completa hoje. Para rodar localmente, os 675B parâmetros totais com 41B ativos exigem infraestrutura séria — não é um modelo de fim de semana.

Se o seu gargalo é custo puro em tarefas de texto simples, o gpt-oss-120b entrega mais inteligência por dólar (US$ 0,17 de saída). Se é coding puro e você não liga para open weights, o Claude Haiku 4.5 entrega o dobro de IQ pelo tripo do preço — e provavelmente compensa em produtividade. Se é agente autônomo com tool calling, o Haiku 4.5 também vence.

Para quem não muda nada

Não vale se você já está rodando o Haiku 4.5 em produção e está satisfeito. Não vale se você só precisa de um coder barato — o gpt-oss-20b faz isso por US$ 0,13 de saída. Não vale se sua aplicação é agentic pesada, porque 5,52 nesse eixo é nota de quem ainda tropeça em workflows longos. E não vale se você esperava um "o3 open source": a distância de 15 pontos no índice de inteligência não se explica só por MoE.

O tabuleiro em 4 de dezembro

A Mistral francesa repete um movimento que conhece bem: abrir o topo de linha sob Apache 2.0 antes de qualquer concorrente americano fazer o mesmo com escala equivalente. O Llama 4 Scout, da Meta, tem contexto de 1,3 milhão e é mais barato (US$ 0,30 de saída), mas marca só 10,26 de inteligência e 8,17 em coding. O Nemotron Super 49B da NVIDIA, de outubro, é mais barato (US$ 0,40) e marca 12,40 — fica abaixo. O Ministral 3 14B, da própria Mistral, lançado um dia depois do Large 3, custa US$ 0,20 de saída e marca 11,24: é a versão econômica da família.

Inteligência × preço de saída
Mistral Large 3 2512gpt-oss-20bMinistral 3 14B 2512Llama 4 ScoutLlama 3.3 Nemotron Super 49BUS$ por milhão (saída, escala log)índice de inteligência
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Nova 2 Lite19.22.5
Qwen3 Next 80B A3B Thinking16.91.2
Entre os 293 modelos disponíveis no catálogo nesta data.

O que fazer com isso

Se você está montando um stack aberto e precisa de multimodalidade com contexto longo, faça um piloto de duas semanas com o Large 3 2512 — meça custo por tarefa concluída, não só por token. Se o seu caso de uso é texto puro ou coding puro, comece pelo gpt-oss-120b ou pelo gpt-oss-20b e só suba para o Mistral se a multimodalidade for bloqueante. E se você roda agentes, espere: o agentic 5,52 ainda não é argumento suficiente para trocar o que está funcionando.

Ficha técnica — Mistral Large 3 2512
CampoValor
Identificadormistralai/mistral-large-2512
Criadormistralai
Preço de entradaUS$ 0.500 / M tokens
Preço de saídaUS$ 1.50 / M tokens
Janela de contexto262k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.050 / M (90% de desconto)
Índice de inteligência (AA)15.9
Índice de código20.1
Índice agêntico5.5
Parâmetros675B (41B ativos por token)
Pesosabertos
Velocidade de saída77 tokens/s
Em uma frase

O Mistral Large 3 2512 é o melhor pacote aberto multimodal com contexto longo de 262k, mas só vale o piloto se você realmente precisa de pesos abertos + visão + arquivo na mesma chamada — para coding ou texto puro, há opções mais baratas e mais inteligentes.

Perguntas frequentes

O Mistral Large 3 2512 é melhor que o Claude Haiku 4.5?

Não no índice de inteligência atual: o Haiku 4.5 marca 29,89 contra 15,92 do Mistral. O Mistral vence em preço (US$ 1,50 vs US$ 5,00 por milhão de saída) e em open weights, mas perde em capacidade bruta.

Quanto custa rodar o Mistral Large 3 2512?

Pela API, US$ 0,50 por milhão de tokens de entrada, US$ 1,50 por milhão de saída e US$ 0,05 por milhão em cache. Localmente, os 675B parâmetros totais (41B ativos) exigem GPU de ponta — não é viável em hardware de consumidor.

O Mistral Large 3 2512 serve para agentes autônomos?

Serve para fluxos agentic leves. O índice agentic é 5,52, acima do gpt-oss-20b (3,10) e do Llama 4 Scout (1,10), mas abaixo de modelos otimizados para tool calling pesado como o Claude Haiku 4.5.

Leia também