Mistral Small 4 custa US$ 0,60 por milhão de saída e mira no meio do pacote
Modelo aberto de 119B parâmetros chega com IQ 19,7 e preço 20 vezes menor que o topo da tabela — útil para quem não precisa do melhor raciocínio.
O que muda na sua fatura
A conta de API da Mistral ficou mais barata hoje, mas o teto do que o modelo entrega também desceu. O Mistral Small 4 entra no catálogo cobrando US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída — preço de prateleira, sem negociação. Para efeito de comparação, o Google Gemini 3.1 Pro Preview, que lidera o índice de inteligência, cobra US$ 12 por milhão de saída. São 20 vezes mais caro.
A pergunta que você precisa responder antes de clicar em "integrar" é simples: você está pagando caro demais pelo raciocínio que está usando? Se a sua aplicação é classificar tickets, gerar resumos de texto ou alimentar um chatbot de primeiro nível, a resposta provavelmente é sim.
Onde o Small 4 se encaixa na tabela
O índice de inteligência do Small 4 é 19,7. Não é pouco, mas está bem distante dos 47,7 do Gemini 3.1 Pro Preview e dos 45,5 do GPT-5.3-Codex, que são os únicos acima de 45 hoje. O Claude Sonnet 4.6, da Anthropic, marca 35,1 — também acima. O Mistral Small 4 não disputa essa faixa.
O que ele faz é ocupar um andar intermediário com um custo por unidade de inteligência muito mais agressivo. É a mesma lógica do voo econômico: você não vai chegar mais rápido, mas a conta fecha.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Mistral Small 4 (o novo) | 19.7 | 0.15 | 0.6 | 262k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| Claude Sonnet 4.6 | 35.1 | 3 | 15 | 1M |
O que a Mistral entregou de fato
O Small 4 é um modelo de 119 bilhões de parâmetros totais, com 6,5 bilhões ativos por inferência. É open weights — você pode baixar e rodar onde quiser, se tiver o hardware. Aceita texto e imagem como entrada e devolve texto. Janela de contexto de 262 mil tokens. Suporta raciocínio, o que significa que pode gastar mais tokens "pensando" antes de responder quando o prompt pede.
| Campo | Valor |
|---|---|
| Identificador | mistralai/mistral-small-2603 |
| Criador | mistralai |
| Preço de entrada | US$ 0.150 / M tokens |
| Preço de saída | US$ 0.600 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image->text |
| Leitura de cache | US$ 0.015 / M (90% de desconto) |
| Índice de inteligência (AA) | 19.7 |
| Índice de código | 26.6 |
| Índice agêntico | 4.6 |
| Parâmetros | 119B (6.5B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 155 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Tem uma versão batch saindo no mesmo pacote, com metade do preço: US$ 0,075 de entrada e US$ 0,30 de saída por milhão de tokens. Batch não é para tempo real — é para processar mil e-mails, transcrever dez mil áudios, gerar relatório em massa durante a madrugada. Quem tem fila assíncrona ganha mais 50% de desconto sem mudar uma linha de código.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Mistral Small 4 (batch) | 0.075 | 0.3 | 262k |
Para quem vale e para quem não muda nada
Vale para você se: roda volume alto de tarefas de complexidade média, quer pagar menos por token sem sair do ecossistema Mistral, ou precisa de um modelo aberto para rodar on-premise. O índice de coding (26,6) sugere que dá para usar em geração de código simples e revisão assistida, embora não vá competir com Codex em agentic (4,6 contra 14 do Codex).
Não muda nada se: você já usa Gemini 3.1 Pro ou GPT-5.3-Codex porque precisa do topo de raciocínio, ou se o seu gargalo é qualidade absoluta e não custo. Também não substitui o Claude Sonnet 4.6 em tarefas de nuance — a distância no índice é grande.
O tabuleiro hoje
A Mistral é francesa, e esse é um dado que pesa em compras corporativas europeias com requisito de soberania de dados. O catálogo hoje lista mais de 365 modelos de 53 criadores, e 31 deles foram lançados nos últimos 30 dias. O topo continua concentrado em três nomes americanos — Google, OpenAI e Anthropic — com a Qwen e a Xiaomi brigando pelo quarto lugar em inteligência por fração do custo.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
O Small 4 não entra nesse pódio. Entra no andar de baixo com um preço que obriga o resto do mercado a justificar por que cobra mais caro.
Se sua tarefa é média em complexidade e alta em volume, o Mistral Small 4 corta a conta em até 20 vezes sem trocar de fornecedor — mas não espere o raciocínio dos modelos de topo.
Perguntas frequentes
Quanto custa o Mistral Small 4 na API?
Cobra US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída. A versão batch sai por metade: US$ 0,075 de entrada e US$ 0,30 de saída por milhão.
O Mistral Small 4 é modelo aberto?
Sim. Tem 119 bilhões de parâmetros totais com 6,5 bilhões ativos por inferência, e os pesos podem ser baixados para rodar on-premise, sujeito ao hardware disponível.
Como o Mistral Small 4 se compara com Gemini 3.1 Pro e GPT-5.3-Codex?
Fica bem abaixo no índice de inteligência (19,7 contra 47,7 e 45,5), mas custa cerca de 20 vezes menos por token de saída. É escolha de custo, não de capacidade máxima.