FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Mistral Large 3 2512 e INTELLECT-3 custam quase o mesmo e tiram quase a mesma nota

Dois modelos abertos com arquiteturas parecidas, preços parecidos e um IQ separados por 0,2 ponto — mas só um deles tem modo de raciocínio

Redação FalaVIP IA 3 min de leitura
US$ 1,50preço de saída do Mistral Large 3 2512 por milhão de tokens
US$ 1,10preço de saída do INTELLECT-3 por milhão de tokens
0,2 pontodiferença de IQ entre os dois modelos

Pôr US$ 1,10 ou US$ 1,50 por milhão de tokens de saída não muda muita coisa na fatura do fim do mês. O que muda — e é o que está separando esses dois modelos abertos na prateleira de janeiro — é o que vem junto da conta. Mistral Large 3 2512 e INTELLECT-3 são dois MoE com pesos abertos, lançados com menos de duas semanas de diferença, e entregam um índice de inteligência quase idêntico. A diferença de 0,2 ponto no IQ está dentro do que você veria se rodasse o mesmo modelo duas vezes.

O tamanho não é o que parece

Os dois usam mistura de especialistas, mas com receitas bem diferentes. O Mistral ativa 41B de 675B totais — só uma fração pequena dos parâmetros entra em ação a cada token. O INTELLECT-3 é mais enxuto: 12B ativos de 107B totais, pós-treinado a partir do GLM-4.5-Air-Base com ajuste supervisionado seguido de RL em escala grande. Em tradução direta: o Mistral é um caminhão pesado com motor eficiente, o INTELLECT-3 é um carro menor com motor muito bem regulado.

Índice de inteligência (Artificial Analysis)
Mistral Large 3 251215,9INTELLECT-315,7índice
Fonte: Artificial Analysis

No índice de inteligência, eles ficam colados: 15,919 contra 15,718. Só que o catálogo tem 314 modelos e o topo da tabela hoje é o Xiaomi MiMo-V2-Flash, com IQ 34,024 — mais que o dobro. Ou seja, nenhum dos dois está brigando pela ponta; estão brigando pelo melhor custo-benefício na faixa intermediária.

Preço: o detalhe que decide

Olhando só o número de saída, a diferença é de US$ 0,40 por milhão de tokens. Parece pouco, mas é 36% a mais no Mistral. O detalhe que muda a conta de verdade é outro: o Mistral cobra US$ 0,05 por milhão de tokens em cache; o INTELLECT-3 não publica preço de cache. Se você repete muito o mesmo prompt — em RAG, em agentes, em pipelines de código — esse 0,05 vira economia real no Mistral.

Preço de saída (US$ por milhão de tokens)
Mistral Large 3 25121,5INTELLECT-31,1US$/M
Fonte: OpenRouter

A entrada também pesa: US$ 0,50 contra US$ 0,20 por milhão de tokens no INTELLECT-3. Em workloads onde o prompt é grande e a resposta é curta — sumarização, classificação, extração — essa diferença de entrada domina a fatura e o INTELLECT-3 ganha.

O que cada um faz melhor (e pior)

O Mistral traz números que o INTELLECT-3 não traz: coding 20,066 e agentic 5,519. Em coding, ele fica à frente do Devstral 2 2512 da própria Mistral (19,242), que é a referência da casa para código. Em agentic, 5,519 não é brilhante — é um número modesto, mas é um número. Já o INTELLECT-3 não tem coding nem agentic medidos no catálogo; você só sabe que ele tem modo de raciocínio e que o pós-treinamento foi focado em matemática.

A velocidade também joga a favor do Mistral: 77,45 tokens por segundo medidos. O INTELLECT-3 não tem velocidade publicada — e quando o catálogo não publica, é porque ainda não mediu, não porque é segredo.

Mistral Large 3 2512 × INTELLECT-3
CritérioMistral Large 3 2512INTELLECT-3
Índice de inteligência15.915.7
Entrada US$/M0.50.2
Saída US$/M1.51.1
Contexto262k131k
Pesos abertossimsim
Velocidade (tok/s)77
Índice de código20.1
Índice agêntico5.5

Contexto, modalidade e o resto da prateleira

O Mistral aceita texto, imagem e arquivo, e devolve texto, com janela de 262 mil tokens. O INTELLECT-3 é só texto, com janela de 131 mil tokens. Se você precisa mandar PDF ou imagem no mesmo request, o Mistral é o único dos dois que resolve sem预处理.

Para situar no tabuleiro: o topo do catálogo hoje tem o Xiaomi MiMo-V2-Flash a US$ 0,30 por milhão de saída e IQ 34,024 — ou seja, mais que o dobro de inteligência por uma fração do preço. O OpenAI o3 cobra US$ 8 de saída e marca IQ 31,096. Esses dois são o teto. O Claude Haiku 4.5, da Anthropic, fica em IQ 29,892 por US$ 5. Os dois modelos desta pauta estão bem abaixo disso.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 314 modelos disponíveis no catálogo nesta data.

Quando cada um ganha

Escolha o Mistral Large 3 2512 quando você precisa de multimodalidade (texto + imagem + arquivo), de velocidade medida e de um preço de cache publicado para workloads com prompt repetido. É também a escolha quando coding e agentic importam e você quer números de benchmark para comparar.

Escolha o INTELLECT-3 quando o workload é texto puro, o prompt é grande e a resposta é curta, e o modo de raciocínio nativo faz diferença no seu pipeline. É também a escolha se você quer gastar menos na entrada e não se importa em não ter benchmark de coding nem velocidade publicada.

Nos dois casos, você está comprando faixa intermediária com pesos abertos — não está comprando o topo do catálogo. Para isso, o MiMo-V2-Flash continua sendo o negócio mais agressivo da prateleira.

Em uma frase

Se a fatura é dominada por entrada de texto puro, vá de INTELLECT-3; se você repete prompt, precisa de imagem ou quer números de coding e agentic, vá de Mistral Large 3 2512 — e se o orçamento permitir, olhe o MiMo-V2-Flash antes de fechar.

Perguntas frequentes

Qual a diferença de preço entre Mistral Large 3 2512 e INTELLECT-3?

O Mistral cobra US$ 0,50 de entrada e US$ 1,50 de saída por milhão de tokens, com cache a US$ 0,05. O INTELLECT-3 cobra US$ 0,20 de entrada e US$ 1,10 de saída, e não publica preço de cache. Em workloads com prompt grande e resposta curta, o INTELLECT-3 fica mais barato; em workloads com prompt repetido, o cache do Mistral compensa a diferença.

Qual dos dois tem modo de raciocínio?

Só o INTELLECT-3 tem reasoning nativo, segundo o catálogo. O Mistral Large 3 2512 aparece como modelo sem raciocínio dedicado.

Eles são modelos abertos?

Os dois têm pesos abertos (open_weights). O Mistral é liberado sob Apache 2.0; o INTELLECT-3 é pós-treinado a partir do GLM-4.5-Air-Base, também com pesos publicados.

Leia também