FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída

O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.

Redação FalaVIP IA 5 min de leitura
19,242índice de inteligência atual do Devstral 2 2512
US$ 2,00por milhão de tokens de saída do Devstral 2 2512
262.144tokens de contexto do Devstral 2 2512

A diferença que importa está na fatura: a INTELLECT-3 cobra US$ 1,10 por milhão de tokens de saída, contra US$ 2,00 da Devstral 2 2512. Em 18 de dezembro de 2025, a decisão não é escolher entre dois modelos abertos como se fossem equivalentes. É decidir se o seu fluxo precisa do contexto, da entrada de arquivos e das medições adicionais que só a ficha de um deles publica, ou se o orçamento manda mais forte.

O catálogo reúne mais de 309 modelos ainda listados, registra 47 criadores e viu 33 modelos lançados nos últimos 30 dias. O número 309 é um piso: modelos removidos deixam de aparecer, portanto não representa a contagem histórica fechada. Os dois concorrentes chegam em meio a uma renovação forte, e não precisam ser bons em tudo para justificarem uma chamada de API.

Intelligence has a winner, but with limits

Na medição atual do índice de inteligência, a Devstral 2 2512 marca 19,242, enquanto a INTELLECT-3 marca 15,718. A fonte dessa medição é explicitamente atual. O catálogo não traz uma série histórica, então esses números situam os modelos hoje, mas não permitem afirmar que a nota de um subiu ou caiu.

Índice de inteligência (Artificial Analysis)
Devstral 2 251219,2INTELLECT-315,7índice
Fonte: Artificial Analysis

A Devstral ainda registra 31,259 em coding e 10,642 na métrica agentic. Esses dois campos aparecem como nulos na ficha da INTELLECT-3. Nulo não quer dizer zero: neste comparativo, significa apenas que a fonte não publicou uma medição correspondente. Você não pode concluir que a INTELLECT-3 é pior em coding ou agentic. Pode concluir que a Devstral fornece números onde a concorrente não fornece.

The bill is cheaper on the other side

Na entrada, a INTELLECT-3 custa US$ 0,20 por milhão de tokens, contra US$ 0,40 da Devstral. Na saída, a vantagem continua: US$ 1,10 contra US$ 2,00. Os dois são modelos pagos, portanto a redução de preço não transforma a INTELLECT-3 em uma opção gratuita.

Preço de saída (US$ por milhão de tokens)
Devstral 2 25122INTELLECT-31,1US$/M
Fonte: OpenRouter

A Devstral divulga cache por US$ 0,04 por milhão de tokens. Para a INTELLECT-3, o preço de cache não foi publicado no catálogo. A comparação fica clara nas tarifas de entrada e saída, mas incompleta no cache: você não deve atribuir à INTELLECT-3 o preço de US$ 0,04 cobrado pela concorrente. Para uma previsão de custo comparável, esse item precisa de cotação própria.

Context, modalities and architecture change the choice

A Devstral oferece 262.144 tokens de contexto e trabalha na modalidade text+file->text. A INTELLECT-3 oferece 131.072 tokens e aparece como text->text. Na prática, este comparativo separa os casos: um pipeline que envia arquivos e precisa ultrapassar 131.072 tokens de contexto tem uma alternativa explícita; um fluxo somente de texto pode encontrar a janela suficiente na INTELLECT-3.

Devstral 2 2512 × INTELLECT-3
CritérioDevstral 2 2512INTELLECT-3
Índice de inteligência19.215.7
Entrada US$/M0.40.2
Saída US$/M21.1
Contexto262k131k
Pesos abertossimsim
Velocidade (tok/s)117
Índice de código31.3
Índice agêntico10.6

As duas fichas marcam open weights como verdadeiro. A Devstral é descrita como uma transformadora densa, com 125 bilhões de parâmetros totais e 125 bilhões ativos nos campos estruturados. A INTELLECT-3 é uma Mixture-of-Experts com 107 bilhões totais e 12 bilhões ativos; sua descrição informa pós-treinamento com SFT e RL a partir de GLM-4.5-Air-Base.

A analogia para a Mistura de Especialistas é um escritório com 107 posições, mas apenas 12 atendentes trabalhando em cada tarefa. Os 12 bilhões ativos não eliminam os demais parâmetros, apenas mostram que o modelo estruturou sua capacidade para usar um subconjunto durante a operação.

Há uma divergência que merece entrar na sua planilha. A descrição da Devstral diz 123 bilhões de parâmetros, enquanto o campo estruturado registra 125 bilhões. Na INTELLECT-3, a descrição diz 106 bilhões e o campo estruturado marca 107 bilhões. Como se trata da mesma fonte com valores diferentes, vale usar os campos estruturados para a comparação e validar a arquitetura antes de planejar infraestrutura. O campo de velocidade traz 117,08 para a Devstral, mas fica nulo para a INTELLECT-3; sem uma medição publicada para a segunda, não há confronto justo de velocidade.

Where they stand on December 18

No recorte de inteligência fornecido hoje, a MiMo-V2-Flash lidera com 34,042 e saída a US$ 0,30 por milhão de tokens. Depois vêm o OpenAI o3, com 31,096 e US$ 8,00; Claude Haiku 4.5, com 29,892 e US$ 5,00; e gpt-oss-120b, com 24,126 e US$ 0,17. A Devstral fica abaixo dos quatro, com 19,242, enquanto a INTELLECT-3 aparece com 15,718. Portanto, ambas ficam atrás do grupo que forma o topo desse recorte, e a Devstral é a mais bem posicionada das duas na medição atual.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 309 modelos disponíveis no catálogo nesta data.

A origem também não deve ser ignorada: a Devstral é da Mistral, da França, e foi lançada em 9 de dezembro de 2025. A INTELLECT-3 vem da Prime Intellect, dos Estados Unidos, com lançamento em 27 de novembro de 2025. As duas estão abertas em pesos, mas têm arquiteturas, modalidades e estruturas de preço diferentes.

When each model wins

A Devstral 2 2512 vence quando o fluxo recebe arquivos, exige mais de 131.072 tokens de contexto, precisa de uma medição de velocidade publicada ou quer as métricas atuais de coding e agentic. Ela também é a escolha coerente para um workload de codificação agentic no qual a interface text+file->text já reduz etapas de adaptação.

A INTELLECT-3 vence quando a entrada é somente texto, 131.072 tokens de contexto são suficientes e o custo de entrada e saída pesa mais que contexto, modalidade e métricas adicionais. Ela também atende à situação em que a arquitetura Mixture-of-Experts com 12 bilhões de parâmetros ativos faz sentido para a equipe responsável pela infraestrutura. A marca de raciocínio aparece como verdadeiro na sua ficha, contra falso na Devstral.

Para quem exige um modelo gratuito, nenhuma das duas muda o cenário: ambas são pagas. Para quem precisa comparar cache, velocidade e coding lado a lado, a INTELLECT-3 não traz preço de cache, velocidade ou coding no catálogo, e esses campos não podem ser preenchidos com os números da Devstral.

Na planilha operacional, use a Devstral quando houver arquivos, janela acima de 131.072 tokens ou necessidade das métricas de coding e agentic. Use a INTELLECT-3 quando o tráfego for somente texto e a prioridade for pagar US$ 0,20 de entrada e US$ 1,10 de saída por milhão de tokens, deixando a cotação de cache em uma linha separada.

Em uma frase

Devstral 2 2512 vence com arquivos, mais contexto e métricas de coding e agentic; INTELLECT-3 vence com tarifas menores de entrada e saída em fluxos somente de texto, mas exige cotação de cache.

Perguntas frequentes

Qual modelo é mais barato, Devstral 2 2512 ou INTELLECT-3?

A INTELLECT-3. A entrada custa US$ 0,20 por milhão de tokens, contra US$ 0,40 da Devstral, enquanto a saída sai por US$ 1,10 contra US$ 2,00. Os dois são pagos, e o catálogo não publicou o preço de cache da INTELLECT-3.

O Devstral 2 2512 aceita arquivos?

Sim, a modalidade catalogada é text+file->text, com 262.144 tokens de contexto. A INTELLECT-3 aparece como text->text, com 131.072 tokens de contexto.

Qual modelo tem o maior índice de inteligência atual?

A Devstral 2 2512, com 19,242, contra 15,718 da INTELLECT-3. Como a fonte é atual e não traz uma série histórica, esses números não mostram que a pontuação de algum modelo subiu ou caiu.

Leia também