Devstral 2 e Nova 2 Lite empatam no IQ e dividem a conta diferente
Dois modelos com nota quase idêntica, preços parecidos e promessas opostas: código agente da Mistral contra multimodal barato da Amazon.
O empate que ninguém pediu
Os números de inteligência saíram quase iguais: 19,242 para o Devstral 2 2512 e 19,24 para o Nova 2 Lite. Diferença de dois milésimos. Em qualquer榜单 de modelos isso é o mesmo lugar na prateleira, mas basta abrir a ficha técnica para perceber que são produtos pensados para problemas diferentes — e é aí que a escolha começa.
Lançados com uma semana de diferença (Nova 2 Lite em 2 de dezembro, Devstral 2 em 9), os dois chegam ao catálogo de 304 modelos ativos exatamente na mesma faixa de preço e de capacidade geral. É o tipo de coincidência que costuma esconder uma decisão de compra mal tomada.
O que cada um faz de verdade
O Devstral 2 é um transformer denso de 125 bilhões de parâmetros, com pesos abertos, contexto de 256 mil tokens e foco declarado em codificação agentic. O índice de coding dele é 31,259 — o mais alto entre os modelos da faixa intermediária do catálogo. O índice agentic fica em 10,642, que é respeitável mas não excepcional. Traduzindo: ele lê um repositório inteiro, planeja e executa tarefas de engenharia de software em várias etapas. É um dev sênior que cabe numa única chamada de API.
O Nova 2 Lite faz outra coisa. É um modelo de raciocínio rápido, multimodal (aceita texto, imagem, arquivo e vídeo e devolve texto), contexto de 1 milhão de tokens e preço de entrada mais baixo. Não tem nota de coding nem agentic publicada no catálogo, e os pesos são fechados. O índice de raciocínio e a velocidade de 153 tokens por segundo mostram onde a Amazon quis apertar o parafuso: throughput alto, multimodalidade barata, sem pretensão de ser o melhor em código.
| Critério | Devstral 2 2512 | Nova 2 Lite |
|---|---|---|
| Índice de inteligência | 19.2 | 19.2 |
| Entrada US$/M | 0.4 | 0.3 |
| Saída US$/M | 2 | 2.5 |
| Contexto | 262k | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 117 | 153 |
| Índice de código | 31.3 | — |
| Índice agêntico | 10.6 | — |
A conta no fim do mês
A diferença de 50 centavos por milhão de tokens de saída parece pequena até você multiplicar. Em 100 milhões de tokens gerados por mês, são US$ 50 a mais com o Nova 2 Lite. Em 1 bilhão, US$ 500. O Devstral 2 cobra US$ 2,00 de saída e US$ 0,40 de entrada; o Nova 2 Lite cobra US$ 2,50 de saída e US$ 0,30 de entrada. O cache do Devstral 2 está em US$ 0,04 por milhão — o Nova 2 Lite não publicou preço de cache no catálogo.
Se o seu workload é majoritariamente agentic e roda em prompts longos reaproveitados, o cache do Devstral 2 paga a conta. Se você consome multimodal barato e não se importa em pagar um pouco mais na saída, o Nova 2 Lite entrega contexto dez vezes maior pelo mesmo tipo de nota.
Onde cada um ganha
Devstral 2 2512 ganha quando: o trabalho é engenharia de software em múltiplos passos, o time quer inspecionar ou hospedar os pesos (são abertos), e o cache hit é alto. É o modelo para quem está construindo um agente de código ou um Copilot interno e precisa de nota forte de coding sem migrar para a faixa de US$ 8 por milhão de saída do o3.
Nova 2 Lite ganha quando: o pipeline é multimodal, o contexto de 1 milhão de tokens faz diferença (documentos longos, vídeos, bases inteiras), e a velocidade de 153 tps importa mais que uma nota de coding que nem foi publicada. É o modelo para extração, sumarização e raciocínio rápido sobre conteúdo misto.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
| Nova 2 Lite | 19.2 | 2.5 |
Para quem está fora desses dois casos — chat genérico, escrita criativa, tarefas que exigem o topo absoluto da régua — nenhum dos dois resolve. O o3 segue custando US$ 8 por milhão de saída e entregando IQ 31,096, e o Claude Haiku 4.5 cobra US$ 5 com IQ 29,892. A conta da API não mente.
Use Devstral 2 para agentes de código com pesos abertos e cache ativo; use Nova 2 Lite para multimodal com contexto longo e velocidade. Para qualquer outra coisa, o dinheiro vai para o3 ou Claude Haiku.
Perguntas frequentes
Devstral 2 ou Nova 2 Lite para programar?
Devstral 2. O índice de coding dele é 31,259 e o modelo foi treinado para tarefas agentic de engenharia de software. O Nova 2 Lite não publicou nota de coding no catálogo e não é multimodal de código.
Qual é mais barato na prática?
Depende do perfil de uso. Nova 2 Lite cobra menos na entrada (US$ 0,30 contra US$ 0,40), mas mais na saída (US$ 2,50 contra US$ 2,00). Se você gera muito token, Devstral 2 vence; se consome muito token de entrada, Nova 2 Lite ganha.
Os pesos do Devstral 2 são mesmo abertos?
Sim. O catálogo lista open_weights como true e descreve o modelo como open-source da Mistral AI, com 125 bilhões de parâmetros ativos. O Nova 2 Lite é fechado.