FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Mistral Medium 3.5 custa 4x o Gemma 4 31B e não entrega mais inteligência

Modelo denso de 128B da Mistral estreia a US$ 7,50 por milhão de tokens de saída e fica abaixo de alternativas chinesas mais baratas.

Redação FalaVIP IA 3 min de leitura
US$ 7,50por milhão de tokens de saída
30,39índice de inteligência Artificial Analysis
46,90nota de codificação (acima da média da faixa)

O preço chegou antes da vantagem

A Mistral soltou o Medium 3.5 há dois dias, em 30 de abril, e o catálogo já o lista a US$ 7,50 por milhão de tokens de saída — com entrada a US$ 1,50. Em dólar, parece um número redondo; em contexto, é quase 22 vezes o que a Xiaomi cobra pelo MiMo-V2-Flash (US$ 0,30) e mais que o dobro do MiMo-V2-Omni (US$ 2,00). Para um modelo denso de 128B com pesos abertos, a conta precisa de uma justificativa técnica que não está no release.

Preço de saída (US$ por milhão de tokens)
Mistral Medium 3.57,5MiMo-V2-Flash0,3Gemma 4 31B0,34Gemma 4 26B A4B 0,34MiMo-V2-Omni2US$/M
Fonte: OpenRouter

O que o índice de inteligência diz

O Mistral Medium 3.5 marca 30,39 no índice Artificial Analysis. Não é ruim — é um meio de campo competente. Mas olha o que está do lado dele no catálogo: o MiMo-V2-Flash, da Xiaomi, está em 34,02 custando US$ 0,30 de saída. O Gemma 4 31B, do Google, está em 29,70 custando US$ 0,34. O Medium 3.5 perde dos dois em inteligência e perde dos dois em preço.

Índice de inteligência (Artificial Analysis)
Mistral Medium 3.530,4MiMo-V2-Flash34Gemma 4 31B29,7Gemma 4 26B A4B 26,1MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

Onde ele brilha é em codificação: 46,90, contra 43,43 do Gemma 4 31B. É uma diferença real, não inflada. Se o seu workload é geração de código, revisão ou refactor, esse número pesa. Em agente, porém, ele marca 19,20 — abaixo da média do segmento e pior que o Flash em uso geral.

Inteligência × preço de saída
Mistral Medium 3.5MiMo-V2-FlashGemma 4 31BGemma 4 26B A4B MiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência

Para quem vale a pena

Você roda um pipeline de codificação em volume moderado, precisa de multimodal (texto e imagem entram, só texto sai) e quer um modelo denso que você mesmo pode hospedar em GPU própria. O Medium 3.5 entrega isso: 128B ativos, contexto de 262k tokens, pesos abertos, raciocínio nativo. Para uma startup europeia com requisito de residência de dados na França, é uma escolha coerente — o país do criador é fr, e isso conta em algumas licitações.

Se o seu caso é agente de longa duração, o número de 19,20 em agentic sugere que você vai gastar mais tokens para chegar no mesmo lugar que um modelo mais barato entrega em menos chamadas. E se você só quer extrair o máximo de inteligência por dólar, a equação não fecha.

Para quem NÃO muda nada

Se você já usa MiMo-V2-Flash ou Gemma 4 31B no dia a dia, não há motivo para trocar. O Flash custa 25 vezes menos por token de saída e tem índice de inteligência maior. O Gemma 4 31B custa 22 vezes menos, é multimodal (inclui vídeo) e tem contexto idêntico de 262k. O Medium 3.5 só ganha em codificação — e mesmo aí, a vantagem de 3,5 pontos não compensa a diferença de preço para a maioria dos workloads.

Ficha técnica — Mistral Medium 3.5
CampoValor
Identificadormistralai/mistral-medium-3-5
Criadormistralai
Preço de entradaUS$ 1.50 / M tokens
Preço de saídaUS$ 7.50 / M tokens
Janela de contexto262k
Modalidadetext+image+file->text
Índice de inteligência (AA)30.4
Índice de código46.9
Índice agêntico19.2
Parâmetros128B (128B ativos por token)
Pesosabertos
Velocidade de saída132 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Onde ele se encaixa no tabuleiro

O topo do mercado hoje é o Gemini 3.1 Pro Preview (47,74) a US$ 12, seguido pelo GPT-5.3-Codex (45,51) a US$ 14 e pelo DeepSeek V4 Pro (45,27) a US$ 1,74. O Medium 3.5 está três andares abaixo disso em inteligência e cobra mais que o DeepSeek. A janela competitiva dele é a faixa intermediária — entre US$ 0,30 e US$ 2,00 de saída — onde ele perde por preço.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Mistral Medium 3.5 (o novo)30.41.57.5262k
MiMo-V2-Flash34.00.10.3262k
Gemma 4 31B29.70.090.34262k
Gemma 4 26B A4B 26.10.070.34262k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 435 modelos disponíveis no catálogo nesta data.

O que fazer com isso

Se codificação é o seu gargalo e você roda em volume que torna o preço relevante, teste o Medium 3.5 em um benchmark seu antes de migrar. Se você está pagando a API, mantenha o MiMo-V2-Flash como padrão e use o Mistral apenas para tarefas onde o ganho de 3,5 pontos em codificação se traduz em menos iterações — e, portanto, menos tokens gastos no total. Em hospedagem própria, a conta é outra: 128B densos cabem em dois H100 e o custo de inferência local pode inverter a equação a favor do Mistral.

Em uma frase

Só vale trocar para o Mistral Medium 3.5 se codificação for seu gargalo principal e você rodar volume que justifique pagar 22 vezes mais por token de saída que o MiMo-V2-Flash.

Perguntas frequentes

Quanto custa o Mistral Medium 3.5?

US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. O catálogo não publicou preço de cache.

Mistral Medium 3.5 é melhor que o Gemma 4 31B?

Em codificação, sim: marca 46,90 contra 43,43 do Gemma. Em inteligência geral e agente, perde — e custa cerca de 22 vezes mais por token de saída.

O Mistral Medium 3.5 tem pesos abertos?

Sim. É um modelo denso de 128B parâmetros com pesos abertos, contexto de 262k tokens e suporte a entrada de texto e imagem.

Leia também