FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Mistral Small 4 custa US$ 0,60 por milhão de saída e mira no meio do pacote

Modelo aberto de 119B parâmetros chega com IQ 19,7 e preço 20 vezes menor que o topo da tabela — útil para quem não precisa do melhor raciocínio.

Redação FalaVIP IA 3 min de leitura
US$ 0,60por milhão de tokens de saída
19,7índice de inteligência (Artificial Analysis)
119B / 6,5B ativosparâmetros totais e ativos

O que muda na sua fatura

A conta de API da Mistral ficou mais barata hoje, mas o teto do que o modelo entrega também desceu. O Mistral Small 4 entra no catálogo cobrando US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída — preço de prateleira, sem negociação. Para efeito de comparação, o Google Gemini 3.1 Pro Preview, que lidera o índice de inteligência, cobra US$ 12 por milhão de saída. São 20 vezes mais caro.

Preço de saída (US$ por milhão de tokens)
Mistral Small 40,6Gemini 3.1 Pro Preview12GPT-5.3-Codex14Claude Sonnet 4.615US$/M
Fonte: OpenRouter

A pergunta que você precisa responder antes de clicar em "integrar" é simples: você está pagando caro demais pelo raciocínio que está usando? Se a sua aplicação é classificar tickets, gerar resumos de texto ou alimentar um chatbot de primeiro nível, a resposta provavelmente é sim.

Onde o Small 4 se encaixa na tabela

O índice de inteligência do Small 4 é 19,7. Não é pouco, mas está bem distante dos 47,7 do Gemini 3.1 Pro Preview e dos 45,5 do GPT-5.3-Codex, que são os únicos acima de 45 hoje. O Claude Sonnet 4.6, da Anthropic, marca 35,1 — também acima. O Mistral Small 4 não disputa essa faixa.

Índice de inteligência (Artificial Analysis)
Mistral Small 419,7Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5Claude Sonnet 4.635,1índice
Fonte: Artificial Analysis

O que ele faz é ocupar um andar intermediário com um custo por unidade de inteligência muito mais agressivo. É a mesma lógica do voo econômico: você não vai chegar mais rápido, mas a conta fecha.

Inteligência × preço de saída
Mistral Small 4Gemini 3.1 Pro PreviewGPT-5.3-CodexClaude Sonnet 4.6US$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Mistral Small 4 (o novo)19.70.150.6262k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
Claude Sonnet 4.635.13151M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O que a Mistral entregou de fato

O Small 4 é um modelo de 119 bilhões de parâmetros totais, com 6,5 bilhões ativos por inferência. É open weights — você pode baixar e rodar onde quiser, se tiver o hardware. Aceita texto e imagem como entrada e devolve texto. Janela de contexto de 262 mil tokens. Suporta raciocínio, o que significa que pode gastar mais tokens "pensando" antes de responder quando o prompt pede.

Ficha técnica — Mistral Small 4
CampoValor
Identificadormistralai/mistral-small-2603
Criadormistralai
Preço de entradaUS$ 0.150 / M tokens
Preço de saídaUS$ 0.600 / M tokens
Janela de contexto262k
Modalidadetext+image->text
Leitura de cacheUS$ 0.015 / M (90% de desconto)
Índice de inteligência (AA)19.7
Índice de código26.6
Índice agêntico4.6
Parâmetros119B (6.5B ativos por token)
Pesosabertos
Velocidade de saída155 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Tem uma versão batch saindo no mesmo pacote, com metade do preço: US$ 0,075 de entrada e US$ 0,30 de saída por milhão de tokens. Batch não é para tempo real — é para processar mil e-mails, transcrever dez mil áudios, gerar relatório em massa durante a madrugada. Quem tem fila assíncrona ganha mais 50% de desconto sem mudar uma linha de código.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Mistral Small 4 (batch)0.0750.3262k

Para quem vale e para quem não muda nada

Vale para você se: roda volume alto de tarefas de complexidade média, quer pagar menos por token sem sair do ecossistema Mistral, ou precisa de um modelo aberto para rodar on-premise. O índice de coding (26,6) sugere que dá para usar em geração de código simples e revisão assistida, embora não vá competir com Codex em agentic (4,6 contra 14 do Codex).

Não muda nada se: você já usa Gemini 3.1 Pro ou GPT-5.3-Codex porque precisa do topo de raciocínio, ou se o seu gargalo é qualidade absoluta e não custo. Também não substitui o Claude Sonnet 4.6 em tarefas de nuance — a distância no índice é grande.

O tabuleiro hoje

A Mistral é francesa, e esse é um dado que pesa em compras corporativas europeias com requisito de soberania de dados. O catálogo hoje lista mais de 365 modelos de 53 criadores, e 31 deles foram lançados nos últimos 30 dias. O topo continua concentrado em três nomes americanos — Google, OpenAI e Anthropic — com a Qwen e a Xiaomi brigando pelo quarto lugar em inteligência por fração do custo.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 365 modelos disponíveis no catálogo nesta data.

O Small 4 não entra nesse pódio. Entra no andar de baixo com um preço que obriga o resto do mercado a justificar por que cobra mais caro.

Em uma frase

Se sua tarefa é média em complexidade e alta em volume, o Mistral Small 4 corta a conta em até 20 vezes sem trocar de fornecedor — mas não espere o raciocínio dos modelos de topo.

Perguntas frequentes

Quanto custa o Mistral Small 4 na API?

Cobra US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. A versão batch sai por metade: US$ 0,075 de entrada e US$ 0,30 de saída por milhão.

O Mistral Small 4 é modelo aberto?

Sim. Tem 119 bilhões de parâmetros totais com 6,5 bilhões ativos por inferência, e os pesos podem ser baixados para rodar on-premise, sujeito ao hardware disponível.

Como o Mistral Small 4 se compara com Gemini 3.1 Pro e GPT-5.3-Codex?

Fica bem abaixo no índice de inteligência (19,7 contra 47,7 e 45,5), mas custa cerca de 20 vezes menos por token de saída. É escolha de custo, não de capacidade máxima.

Leia também