FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Devstral 2 custa US$ 2 por milhão de saída — e abre o código

Modelo de 123B da Mistral foca em coding agentic, cobra 4× menos que o Claude Haiku 4.5 e ainda entrega pesos abertos.

Redação FalaVIP IA 3 min de leitura
US$ 2,00por milhão de tokens de saída
123Bparâmetros, todos ativos
256Ktokens de contexto

Sai por US$ 2 o milhão de tokens de saída. É quatro vezes mais barato que o Claude Haiku 4.5 e mais de dez vezes mais caro que o gpt-oss-120b da OpenAI. Esse é o número que define o Devstral 2 2512, o modelo da Mistral que entrou no catálogo hoje — e o motivo de ele já estar chamando atenção de quem roda agente de código em produção.

O que é o Devstral 2, em uma frase

É um transformer denso de 123 bilhões de parâmetros, todos ativos, com janela de 256 mil tokens, otimizado para coding agentic — ou seja, para a tarefa em que o modelo lê um repositório, planeja uma sequência de edições e executa. Não é um modelo de raciocínio: não tem aquele modo "thinking" que consome tokens extras antes de responder. É ferramenta, não consultor.

Índice de inteligência (Artificial Analysis)
Devstral 2 251219,2o331,1Claude Haiku 4.529,9gpt-oss-120b24,1índice
Fonte: Artificial Analysis

Onde ele se encaixa no tabuleiro

O índice de inteligência do Devstral 2 marca 19,24. Parece baixo se você comparar com o topo da lista — o3 da OpenAI está em 31,09 e o Claude Haiku 4.5 em 29,89. Mas o índice geral mistura raciocínio, matemática, conhecimento geral. Em coding puro, o Devstral 2 sobe para 31,26, basicamente no mesmo nível do o3. A conta da API, porém, não é a mesma: o3 cobra US$ 8 por milhão de saída, o Haiku cobra US$ 5, o Devstral 2 cobra US$ 2.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Devstral 2 2512 (o novo)19.20.42262k
o331.128200k
Claude Haiku 4.529.915200k
gpt-oss-120b24.10.0370.17131k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O detalhe que muda a conta

O preço de entrada é US$ 0,40 por milhão e o de cache é US$ 0,04. Pensa no cache como a geladeira da cozinha: você paga caro pela primeira vez que abre a porta, mas cada vez que reaproveita o conteúdo já está ali dentro, o custo despenca. Para um agente que relê o mesmo repositório dezenas de vezes numa sessão, esse cache a um décimo do preço de entrada é onde mora a economia real — não no headline de "US$ 2 por milhão".

Preço de saída (US$ por milhão de tokens)
Devstral 2 25122o38Claude Haiku 4.55gpt-oss-120b0,17US$/M
Fonte: OpenRouter

Para quem isso vale a pena

Você roda agente de código em volume e quer manter o custo sob controle sem migrar para um modelo fechado americano. O Devstral 2 é francês, open weights, e o catálogo tem hoje 299 modelos listados vindos de 46 criadores — espaço para um player europeu nesse nicho ainda existe.

Ficha técnica — Devstral 2 2512
CampoValor
Identificadormistralai/devstral-2512
Criadormistralai
Preço de entradaUS$ 0.400 / M tokens
Preço de saídaUS$ 2.00 / M tokens
Janela de contexto262k
Modalidadetext+file->text
Leitura de cacheUS$ 0.040 / M (90% de desconto)
Índice de inteligência (AA)19.2
Índice de código31.3
Índice agêntico10.6
Parâmetros125B (125B ativos por token)
Pesosabertos
Velocidade de saída117 tokens/s

Para quem não muda nada

Se você já paga o3 ou Claude Haiku 4.5 pela capacidade de raciocínio geral, o Devstral 2 não substitui — ele não foi feito para isso. O índice de inteligência geral fica bem abaixo dos dois. E se o seu fluxo cabe no gpt-oss-120b a US$ 0,17 por milhão, pagar US$ 2 para fazer a mesma coisa em coding é pior negócio. O Devstral 2 ocupa uma faixa específica: coding agentic com pesos abertos, sem raciocínio, a preço médio.

Inteligência × preço de saída
Devstral 2 2512o3Claude Haiku 4.5gpt-oss-120bUS$ por milhão (saída, escala log)índice de inteligência

O detalhe técnico que ninguém comenta

123 bilhões de parâmetros todos ativos, sem mistura de especialistas. É um modelo denso, o que significa que cada token passa por todos os 123B de pesos — mais lento que um MoE equivalente, mais previsível no consumo de GPU. A velocidade medida fica em 117 tokens por segundo. Não é o mais rápido do catálogo, mas aguenta o tranco de uma sessão agentic sem engasgar.

29 modelos foram lançados nos últimos 30 dias. O catálogo está girando rápido, e a maioria das novidades mira nichos — coding, multimodal barato, variantes de raciocínio. O Devstral 2 entra exatamente nesse padrão: não tenta ser o melhor em tudo, tenta ser o mais útil para um trabalho específico a um preço que cabe no orçamento.

Se você está rodando agente de código e o custo do Haiku 4.5 começou a aparecer na fatura, vale testar o Devstral 2 antes de subir para o3. Se está satisfeito com gpt-oss-120b, fique onde está.

Em uma frase

Troque o Claude Haiku 4.5 pelo Devstral 2 em fluxos de coding agentic se o custo de saída pesa na fatura; mantenha o o3 quando precisar de raciocínio geral e mantenha o gpt-oss-120b quando o orçamento for o fator número um.

Perguntas frequentes

Quanto custa o Devstral 2 2512 por milhão de tokens?

Custa US$ 0,40 por milhão de tokens de entrada, US$ 2,00 por milhão de saída e US$ 0,04 por milhão em cache. O preço de cache é dez vezes menor que o de entrada, o que ajuda em sessões agentic que relêem o mesmo contexto várias vezes.

Devstral 2 é melhor que Claude Haiku 4.5 para código?

Em coding puro o índice fica próximo (31,26 contra um Haiku 4.5 que não tem benchmark direto comparável no dado), mas em inteligência geral o Haiku 4.5 lidera com folga (29,89 contra 19,24). A escolha depende se você quer pagar menos pelo mesmo trabalho de código ou pagar mais por um modelo mais versátil.

Devstral 2 tem pesos abertos?

Sim. É um modelo open weights da Mistral AI, da França, com 123 bilhões de parâmetros densos e janela de 256 mil tokens. Não é um modelo de raciocínio — não tem modo thinking — então responde direto, sem etapa intermediária de planejamento visível.

Leia também