Devstral 2 2512 cobra US$ 2 por milhão de tokens de saída
O modelo francês tem 262.144 tokens de contexto, sai mais caro na entrada e na saída e pontua 19.242 no índice de inteligência atual. A INTELLECT-3, dos EUA, tem tarifas menores de entrada e saída e aparece com raciocínio habilitado.
A diferença que importa está na fatura: a INTELLECT-3 cobra US$ 1,10 por milhão de tokens de saída, contra US$ 2,00 da Devstral 2 2512. Em 18 de dezembro de 2025, a decisão não é escolher entre dois modelos abertos como se fossem equivalentes. É decidir se o seu fluxo precisa do contexto, da entrada de arquivos e das medições adicionais que só a ficha de um deles publica, ou se o orçamento manda mais forte.
O catálogo reúne mais de 309 modelos ainda listados, registra 47 criadores e viu 33 modelos lançados nos últimos 30 dias. O número 309 é um piso: modelos removidos deixam de aparecer, portanto não representa a contagem histórica fechada. Os dois concorrentes chegam em meio a uma renovação forte, e não precisam ser bons em tudo para justificarem uma chamada de API.
Intelligence has a winner, but with limits
Na medição atual do índice de inteligência, a Devstral 2 2512 marca 19,242, enquanto a INTELLECT-3 marca 15,718. A fonte dessa medição é explicitamente atual. O catálogo não traz uma série histórica, então esses números situam os modelos hoje, mas não permitem afirmar que a nota de um subiu ou caiu.
A Devstral ainda registra 31,259 em coding e 10,642 na métrica agentic. Esses dois campos aparecem como nulos na ficha da INTELLECT-3. Nulo não quer dizer zero: neste comparativo, significa apenas que a fonte não publicou uma medição correspondente. Você não pode concluir que a INTELLECT-3 é pior em coding ou agentic. Pode concluir que a Devstral fornece números onde a concorrente não fornece.
The bill is cheaper on the other side
Na entrada, a INTELLECT-3 custa US$ 0,20 por milhão de tokens, contra US$ 0,40 da Devstral. Na saída, a vantagem continua: US$ 1,10 contra US$ 2,00. Os dois são modelos pagos, portanto a redução de preço não transforma a INTELLECT-3 em uma opção gratuita.
A Devstral divulga cache por US$ 0,04 por milhão de tokens. Para a INTELLECT-3, o preço de cache não foi publicado no catálogo. A comparação fica clara nas tarifas de entrada e saída, mas incompleta no cache: você não deve atribuir à INTELLECT-3 o preço de US$ 0,04 cobrado pela concorrente. Para uma previsão de custo comparável, esse item precisa de cotação própria.
Context, modalities and architecture change the choice
A Devstral oferece 262.144 tokens de contexto e trabalha na modalidade text+file->text. A INTELLECT-3 oferece 131.072 tokens e aparece como text->text. Na prática, este comparativo separa os casos: um pipeline que envia arquivos e precisa ultrapassar 131.072 tokens de contexto tem uma alternativa explícita; um fluxo somente de texto pode encontrar a janela suficiente na INTELLECT-3.
| Critério | Devstral 2 2512 | INTELLECT-3 |
|---|---|---|
| Índice de inteligência | 19.2 | 15.7 |
| Entrada US$/M | 0.4 | 0.2 |
| Saída US$/M | 2 | 1.1 |
| Contexto | 262k | 131k |
| Pesos abertos | sim | sim |
| Velocidade (tok/s) | 117 | — |
| Índice de código | 31.3 | — |
| Índice agêntico | 10.6 | — |
As duas fichas marcam open weights como verdadeiro. A Devstral é descrita como uma transformadora densa, com 125 bilhões de parâmetros totais e 125 bilhões ativos nos campos estruturados. A INTELLECT-3 é uma Mixture-of-Experts com 107 bilhões totais e 12 bilhões ativos; sua descrição informa pós-treinamento com SFT e RL a partir de GLM-4.5-Air-Base.
A analogia para a Mistura de Especialistas é um escritório com 107 posições, mas apenas 12 atendentes trabalhando em cada tarefa. Os 12 bilhões ativos não eliminam os demais parâmetros, apenas mostram que o modelo estruturou sua capacidade para usar um subconjunto durante a operação.
Há uma divergência que merece entrar na sua planilha. A descrição da Devstral diz 123 bilhões de parâmetros, enquanto o campo estruturado registra 125 bilhões. Na INTELLECT-3, a descrição diz 106 bilhões e o campo estruturado marca 107 bilhões. Como se trata da mesma fonte com valores diferentes, vale usar os campos estruturados para a comparação e validar a arquitetura antes de planejar infraestrutura. O campo de velocidade traz 117,08 para a Devstral, mas fica nulo para a INTELLECT-3; sem uma medição publicada para a segunda, não há confronto justo de velocidade.
Where they stand on December 18
No recorte de inteligência fornecido hoje, a MiMo-V2-Flash lidera com 34,042 e saída a US$ 0,30 por milhão de tokens. Depois vêm o OpenAI o3, com 31,096 e US$ 8,00; Claude Haiku 4.5, com 29,892 e US$ 5,00; e gpt-oss-120b, com 24,126 e US$ 0,17. A Devstral fica abaixo dos quatro, com 19,242, enquanto a INTELLECT-3 aparece com 15,718. Portanto, ambas ficam atrás do grupo que forma o topo desse recorte, e a Devstral é a mais bem posicionada das duas na medição atual.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
A origem também não deve ser ignorada: a Devstral é da Mistral, da França, e foi lançada em 9 de dezembro de 2025. A INTELLECT-3 vem da Prime Intellect, dos Estados Unidos, com lançamento em 27 de novembro de 2025. As duas estão abertas em pesos, mas têm arquiteturas, modalidades e estruturas de preço diferentes.
When each model wins
A Devstral 2 2512 vence quando o fluxo recebe arquivos, exige mais de 131.072 tokens de contexto, precisa de uma medição de velocidade publicada ou quer as métricas atuais de coding e agentic. Ela também é a escolha coerente para um workload de codificação agentic no qual a interface text+file->text já reduz etapas de adaptação.
A INTELLECT-3 vence quando a entrada é somente texto, 131.072 tokens de contexto são suficientes e o custo de entrada e saída pesa mais que contexto, modalidade e métricas adicionais. Ela também atende à situação em que a arquitetura Mixture-of-Experts com 12 bilhões de parâmetros ativos faz sentido para a equipe responsável pela infraestrutura. A marca de raciocínio aparece como verdadeiro na sua ficha, contra falso na Devstral.
Para quem exige um modelo gratuito, nenhuma das duas muda o cenário: ambas são pagas. Para quem precisa comparar cache, velocidade e coding lado a lado, a INTELLECT-3 não traz preço de cache, velocidade ou coding no catálogo, e esses campos não podem ser preenchidos com os números da Devstral.
Na planilha operacional, use a Devstral quando houver arquivos, janela acima de 131.072 tokens ou necessidade das métricas de coding e agentic. Use a INTELLECT-3 quando o tráfego for somente texto e a prioridade for pagar US$ 0,20 de entrada e US$ 1,10 de saída por milhão de tokens, deixando a cotação de cache em uma linha separada.
Devstral 2 2512 vence com arquivos, mais contexto e métricas de coding e agentic; INTELLECT-3 vence com tarifas menores de entrada e saída em fluxos somente de texto, mas exige cotação de cache.
Perguntas frequentes
Qual modelo é mais barato, Devstral 2 2512 ou INTELLECT-3?
A INTELLECT-3. A entrada custa US$ 0,20 por milhão de tokens, contra US$ 0,40 da Devstral, enquanto a saída sai por US$ 1,10 contra US$ 2,00. Os dois são pagos, e o catálogo não publicou o preço de cache da INTELLECT-3.
O Devstral 2 2512 aceita arquivos?
Sim, a modalidade catalogada é text+file->text, com 262.144 tokens de contexto. A INTELLECT-3 aparece como text->text, com 131.072 tokens de contexto.
Qual modelo tem o maior índice de inteligência atual?
A Devstral 2 2512, com 19,242, contra 15,718 da INTELLECT-3. Como a fonte é atual e não traz uma série histórica, esses números não mostram que a pontuação de algum modelo subiu ou caiu.