FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Devstral 2 e Nova 2 Lite empatam no IQ e dividem a conta diferente

Dois modelos com nota quase idêntica, preços parecidos e promessas opostas: código agente da Mistral contra multimodal barato da Amazon.

Redação FalaVIP IA 3 min de leitura
US$ 2,00preço de saída do Devstral 2 por milhão de tokens
US$ 2,50preço de saída do Nova 2 Lite por milhão de tokens
31,259índice de coding do Devstral 2

O empate que ninguém pediu

Os números de inteligência saíram quase iguais: 19,242 para o Devstral 2 2512 e 19,24 para o Nova 2 Lite. Diferença de dois milésimos. Em qualquer榜单 de modelos isso é o mesmo lugar na prateleira, mas basta abrir a ficha técnica para perceber que são produtos pensados para problemas diferentes — e é aí que a escolha começa.

Índice de inteligência (Artificial Analysis)
Devstral 2 251219,2Nova 2 Lite19,2índice
Fonte: Artificial Analysis

Lançados com uma semana de diferença (Nova 2 Lite em 2 de dezembro, Devstral 2 em 9), os dois chegam ao catálogo de 304 modelos ativos exatamente na mesma faixa de preço e de capacidade geral. É o tipo de coincidência que costuma esconder uma decisão de compra mal tomada.

O que cada um faz de verdade

O Devstral 2 é um transformer denso de 125 bilhões de parâmetros, com pesos abertos, contexto de 256 mil tokens e foco declarado em codificação agentic. O índice de coding dele é 31,259 — o mais alto entre os modelos da faixa intermediária do catálogo. O índice agentic fica em 10,642, que é respeitável mas não excepcional. Traduzindo: ele lê um repositório inteiro, planeja e executa tarefas de engenharia de software em várias etapas. É um dev sênior que cabe numa única chamada de API.

O Nova 2 Lite faz outra coisa. É um modelo de raciocínio rápido, multimodal (aceita texto, imagem, arquivo e vídeo e devolve texto), contexto de 1 milhão de tokens e preço de entrada mais baixo. Não tem nota de coding nem agentic publicada no catálogo, e os pesos são fechados. O índice de raciocínio e a velocidade de 153 tokens por segundo mostram onde a Amazon quis apertar o parafuso: throughput alto, multimodalidade barata, sem pretensão de ser o melhor em código.

Devstral 2 2512 × Nova 2 Lite
CritérioDevstral 2 2512Nova 2 Lite
Índice de inteligência19.219.2
Entrada US$/M0.40.3
Saída US$/M22.5
Contexto262k1M
Pesos abertossimnão
Velocidade (tok/s)117153
Índice de código31.3
Índice agêntico10.6

A conta no fim do mês

A diferença de 50 centavos por milhão de tokens de saída parece pequena até você multiplicar. Em 100 milhões de tokens gerados por mês, são US$ 50 a mais com o Nova 2 Lite. Em 1 bilhão, US$ 500. O Devstral 2 cobra US$ 2,00 de saída e US$ 0,40 de entrada; o Nova 2 Lite cobra US$ 2,50 de saída e US$ 0,30 de entrada. O cache do Devstral 2 está em US$ 0,04 por milhão — o Nova 2 Lite não publicou preço de cache no catálogo.

Preço de saída (US$ por milhão de tokens)
Devstral 2 25122Nova 2 Lite2,5US$/M
Fonte: OpenRouter

Se o seu workload é majoritariamente agentic e roda em prompts longos reaproveitados, o cache do Devstral 2 paga a conta. Se você consome multimodal barato e não se importa em pagar um pouco mais na saída, o Nova 2 Lite entrega contexto dez vezes maior pelo mesmo tipo de nota.

Onde cada um ganha

Devstral 2 2512 ganha quando: o trabalho é engenharia de software em múltiplos passos, o time quer inspecionar ou hospedar os pesos (são abertos), e o cache hit é alto. É o modelo para quem está construindo um agente de código ou um Copilot interno e precisa de nota forte de coding sem migrar para a faixa de US$ 8 por milhão de saída do o3.

Nova 2 Lite ganha quando: o pipeline é multimodal, o contexto de 1 milhão de tokens faz diferença (documentos longos, vídeos, bases inteiras), e a velocidade de 153 tps importa mais que uma nota de coding que nem foi publicada. É o modelo para extração, sumarização e raciocínio rápido sobre conteúdo misto.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Nova 2 Lite19.22.5
Entre os 304 modelos disponíveis no catálogo nesta data.

Para quem está fora desses dois casos — chat genérico, escrita criativa, tarefas que exigem o topo absoluto da régua — nenhum dos dois resolve. O o3 segue custando US$ 8 por milhão de saída e entregando IQ 31,096, e o Claude Haiku 4.5 cobra US$ 5 com IQ 29,892. A conta da API não mente.

Em uma frase

Use Devstral 2 para agentes de código com pesos abertos e cache ativo; use Nova 2 Lite para multimodal com contexto longo e velocidade. Para qualquer outra coisa, o dinheiro vai para o3 ou Claude Haiku.

Perguntas frequentes

Devstral 2 ou Nova 2 Lite para programar?

Devstral 2. O índice de coding dele é 31,259 e o modelo foi treinado para tarefas agentic de engenharia de software. O Nova 2 Lite não publicou nota de coding no catálogo e não é multimodal de código.

Qual é mais barato na prática?

Depende do perfil de uso. Nova 2 Lite cobra menos na entrada (US$ 0,30 contra US$ 0,40), mas mais na saída (US$ 2,50 contra US$ 2,00). Se você gera muito token, Devstral 2 vence; se consome muito token de entrada, Nova 2 Lite ganha.

Os pesos do Devstral 2 são mesmo abertos?

Sim. O catálogo lista open_weights como true e descreve o modelo como open-source da Mistral AI, com 125 bilhões de parâmetros ativos. O Nova 2 Lite é fechado.

Leia também