Devstral 2 custa US$ 2 por milhão de saída — e abre o código
Modelo de 123B da Mistral foca em coding agentic, cobra 4× menos que o Claude Haiku 4.5 e ainda entrega pesos abertos.
Sai por US$ 2 o milhão de tokens de saída. É quatro vezes mais barato que o Claude Haiku 4.5 e mais de dez vezes mais caro que o gpt-oss-120b da OpenAI. Esse é o número que define o Devstral 2 2512, o modelo da Mistral que entrou no catálogo hoje — e o motivo de ele já estar chamando atenção de quem roda agente de código em produção.
O que é o Devstral 2, em uma frase
É um transformer denso de 123 bilhões de parâmetros, todos ativos, com janela de 256 mil tokens, otimizado para coding agentic — ou seja, para a tarefa em que o modelo lê um repositório, planeja uma sequência de edições e executa. Não é um modelo de raciocínio: não tem aquele modo "thinking" que consome tokens extras antes de responder. É ferramenta, não consultor.
Onde ele se encaixa no tabuleiro
O índice de inteligência do Devstral 2 marca 19,24. Parece baixo se você comparar com o topo da lista — o3 da OpenAI está em 31,09 e o Claude Haiku 4.5 em 29,89. Mas o índice geral mistura raciocínio, matemática, conhecimento geral. Em coding puro, o Devstral 2 sobe para 31,26, basicamente no mesmo nível do o3. A conta da API, porém, não é a mesma: o3 cobra US$ 8 por milhão de saída, o Haiku cobra US$ 5, o Devstral 2 cobra US$ 2.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Devstral 2 2512 (o novo) | 19.2 | 0.4 | 2 | 262k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
O detalhe que muda a conta
O preço de entrada é US$ 0,40 por milhão e o de cache é US$ 0,04. Pensa no cache como a geladeira da cozinha: você paga caro pela primeira vez que abre a porta, mas cada vez que reaproveita o conteúdo já está ali dentro, o custo despenca. Para um agente que relê o mesmo repositório dezenas de vezes numa sessão, esse cache a um décimo do preço de entrada é onde mora a economia real — não no headline de "US$ 2 por milhão".
Para quem isso vale a pena
Você roda agente de código em volume e quer manter o custo sob controle sem migrar para um modelo fechado americano. O Devstral 2 é francês, open weights, e o catálogo tem hoje 299 modelos listados vindos de 46 criadores — espaço para um player europeu nesse nicho ainda existe.
| Campo | Valor |
|---|---|
| Identificador | mistralai/devstral-2512 |
| Criador | mistralai |
| Preço de entrada | US$ 0.400 / M tokens |
| Preço de saída | US$ 2.00 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+file->text |
| Leitura de cache | US$ 0.040 / M (90% de desconto) |
| Índice de inteligência (AA) | 19.2 |
| Índice de código | 31.3 |
| Índice agêntico | 10.6 |
| Parâmetros | 125B (125B ativos por token) |
| Pesos | abertos |
| Velocidade de saída | 117 tokens/s |
Para quem não muda nada
Se você já paga o3 ou Claude Haiku 4.5 pela capacidade de raciocínio geral, o Devstral 2 não substitui — ele não foi feito para isso. O índice de inteligência geral fica bem abaixo dos dois. E se o seu fluxo cabe no gpt-oss-120b a US$ 0,17 por milhão, pagar US$ 2 para fazer a mesma coisa em coding é pior negócio. O Devstral 2 ocupa uma faixa específica: coding agentic com pesos abertos, sem raciocínio, a preço médio.
O detalhe técnico que ninguém comenta
123 bilhões de parâmetros todos ativos, sem mistura de especialistas. É um modelo denso, o que significa que cada token passa por todos os 123B de pesos — mais lento que um MoE equivalente, mais previsível no consumo de GPU. A velocidade medida fica em 117 tokens por segundo. Não é o mais rápido do catálogo, mas aguenta o tranco de uma sessão agentic sem engasgar.
29 modelos foram lançados nos últimos 30 dias. O catálogo está girando rápido, e a maioria das novidades mira nichos — coding, multimodal barato, variantes de raciocínio. O Devstral 2 entra exatamente nesse padrão: não tenta ser o melhor em tudo, tenta ser o mais útil para um trabalho específico a um preço que cabe no orçamento.
Se você está rodando agente de código e o custo do Haiku 4.5 começou a aparecer na fatura, vale testar o Devstral 2 antes de subir para o3. Se está satisfeito com gpt-oss-120b, fique onde está.
Troque o Claude Haiku 4.5 pelo Devstral 2 em fluxos de coding agentic se o custo de saída pesa na fatura; mantenha o o3 quando precisar de raciocínio geral e mantenha o gpt-oss-120b quando o orçamento for o fator número um.
Perguntas frequentes
Quanto custa o Devstral 2 2512 por milhão de tokens?
Custa US$ 0,40 por milhão de tokens de entrada, US$ 2,00 por milhão de saída e US$ 0,04 por milhão em cache. O preço de cache é dez vezes menor que o de entrada, o que ajuda em sessões agentic que relêem o mesmo contexto várias vezes.
Devstral 2 é melhor que Claude Haiku 4.5 para código?
Em coding puro o índice fica próximo (31,26 contra um Haiku 4.5 que não tem benchmark direto comparável no dado), mas em inteligência geral o Haiku 4.5 lidera com folga (29,89 contra 19,24). A escolha depende se você quer pagar menos pelo mesmo trabalho de código ou pagar mais por um modelo mais versátil.
Devstral 2 tem pesos abertos?
Sim. É um modelo open weights da Mistral AI, da França, com 123 bilhões de parâmetros densos e janela de 256 mil tokens. Não é um modelo de raciocínio — não tem modo thinking — então responde direto, sem etapa intermediária de planejamento visível.