Mistral Medium 3.5 custa 4x o Gemma 4 31B e não entrega mais inteligência
Modelo denso de 128B da Mistral estreia a US$ 7,50 por milhão de tokens de saída e fica abaixo de alternativas chinesas mais baratas.
O preço chegou antes da vantagem
A Mistral soltou o Medium 3.5 há dois dias, em 30 de abril, e o catálogo já o lista a US$ 7,50 por milhão de tokens de saída — com entrada a US$ 1,50. Em dólar, parece um número redondo; em contexto, é quase 22 vezes o que a Xiaomi cobra pelo MiMo-V2-Flash (US$ 0,30) e mais que o dobro do MiMo-V2-Omni (US$ 2,00). Para um modelo denso de 128B com pesos abertos, a conta precisa de uma justificativa técnica que não está no release.
O que o índice de inteligência diz
O Mistral Medium 3.5 marca 30,39 no índice Artificial Analysis. Não é ruim — é um meio de campo competente. Mas olha o que está do lado dele no catálogo: o MiMo-V2-Flash, da Xiaomi, está em 34,02 custando US$ 0,30 de saída. O Gemma 4 31B, do Google, está em 29,70 custando US$ 0,34. O Medium 3.5 perde dos dois em inteligência e perde dos dois em preço.
Onde ele brilha é em codificação: 46,90, contra 43,43 do Gemma 4 31B. É uma diferença real, não inflada. Se o seu workload é geração de código, revisão ou refactor, esse número pesa. Em agente, porém, ele marca 19,20 — abaixo da média do segmento e pior que o Flash em uso geral.
Para quem vale a pena
Você roda um pipeline de codificação em volume moderado, precisa de multimodal (texto e imagem entram, só texto sai) e quer um modelo denso que você mesmo pode hospedar em GPU própria. O Medium 3.5 entrega isso: 128B ativos, contexto de 262k tokens, pesos abertos, raciocínio nativo. Para uma startup europeia com requisito de residência de dados na França, é uma escolha coerente — o país do criador é fr, e isso conta em algumas licitações.
Se o seu caso é agente de longa duração, o número de 19,20 em agentic sugere que você vai gastar mais tokens para chegar no mesmo lugar que um modelo mais barato entrega em menos chamadas. E se você só quer extrair o máximo de inteligência por dólar, a equação não fecha.
Para quem NÃO muda nada
Se você já usa MiMo-V2-Flash ou Gemma 4 31B no dia a dia, não há motivo para trocar. O Flash custa 25 vezes menos por token de saída e tem índice de inteligência maior. O Gemma 4 31B custa 22 vezes menos, é multimodal (inclui vídeo) e tem contexto idêntico de 262k. O Medium 3.5 só ganha em codificação — e mesmo aí, a vantagem de 3,5 pontos não compensa a diferença de preço para a maioria dos workloads.
| Campo | Valor |
|---|---|
| Identificador | mistralai/mistral-medium-3-5 |
| Criador | mistralai |
| Preço de entrada | US$ 1.50 / M tokens |
| Preço de saída | US$ 7.50 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image+file->text |
| Índice de inteligência (AA) | 30.4 |
| Índice de código | 46.9 |
| Índice agêntico | 19.2 |
| Parâmetros | 128B (128B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 132 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Onde ele se encaixa no tabuleiro
O topo do mercado hoje é o Gemini 3.1 Pro Preview (47,74) a US$ 12, seguido pelo GPT-5.3-Codex (45,51) a US$ 14 e pelo DeepSeek V4 Pro (45,27) a US$ 1,74. O Medium 3.5 está três andares abaixo disso em inteligência e cobra mais que o DeepSeek. A janela competitiva dele é a faixa intermediária — entre US$ 0,30 e US$ 2,00 de saída — onde ele perde por preço.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Mistral Medium 3.5 (o novo) | 30.4 | 1.5 | 7.5 | 262k |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
| Gemma 4 31B | 29.7 | 0.09 | 0.34 | 262k |
| Gemma 4 26B A4B | 26.1 | 0.07 | 0.34 | 262k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
O que fazer com isso
Se codificação é o seu gargalo e você roda em volume que torna o preço relevante, teste o Medium 3.5 em um benchmark seu antes de migrar. Se você está pagando a API, mantenha o MiMo-V2-Flash como padrão e use o Mistral apenas para tarefas onde o ganho de 3,5 pontos em codificação se traduz em menos iterações — e, portanto, menos tokens gastos no total. Em hospedagem própria, a conta é outra: 128B densos cabem em dois H100 e o custo de inferência local pode inverter a equação a favor do Mistral.
Só vale trocar para o Mistral Medium 3.5 se codificação for seu gargalo principal e você rodar volume que justifique pagar 22 vezes mais por token de saída que o MiMo-V2-Flash.
Perguntas frequentes
Quanto custa o Mistral Medium 3.5?
US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de tokens de saída. O catálogo não publicou preço de cache.
Mistral Medium 3.5 é melhor que o Gemma 4 31B?
Em codificação, sim: marca 46,90 contra 43,43 do Gemma. Em inteligência geral e agente, perde — e custa cerca de 22 vezes mais por token de saída.
O Mistral Medium 3.5 tem pesos abertos?
Sim. É um modelo denso de 128B parâmetros com pesos abertos, contexto de 262k tokens e suporte a entrada de texto e imagem.