FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Devstral 2 cobra seis vezes menos que o Nova Premier — e entrega mais

Comparativo frente a frente entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra que preço nem sempre é o melhor indicador de capacidade.

Redação FalaVIP IA 3 min de leitura
US$ 2por milhão de tokens de saída no Devstral 2
US$ 12,50por milhão de tokens de saída no Nova Premier
19,24 vs 12,72índice de inteligência Artificial Analysis

O número que abre a conversa

Você está olhando o catálogo e vê dois modelos com proposta parecida: tarefa técnica pesada, janela de contexto generosa, fatura no fim do mês. Aí olha o preço de saída e pensa que o mais caro deve ser o melhor. Pois é: dessa vez, não.

O Devstral 2 2512, da Mistral, custa US$ 2 por milhão de tokens de saída. O Nova Premier 1.0, da Amazon, custa US$ 12,50 pelo mesmo volume. Seis vezes mais caro, índice de inteligência menor. Antes de você fechar a aba achando que é pegadinha, veja os números.

Preço de saída (US$ por milhão de tokens)
Devstral 2 25122Nova Premier 1.012,5US$/M
Fonte: OpenRouter

Inteligência e velocidade: o que cada um entrega

No índice de inteligência da Artificial Analysis medido hoje, o Devstral 2 marca 19,24 e o Nova Premier, 12,72. Em codificação, a diferença é ainda maior: 31,26 contra um campo vazio — a Amazon simplesmente não publicou benchmark de coding para esse modelo. Em tarefas agentic, 10,64 para o francês e dado ausente para o americano.

Índice de inteligência (Artificial Analysis)
Devstral 2 251219,2Nova Premier 1.012,7índice
Fonte: Artificial Analysis

Velocidade também não é o argumento da Amazon aqui: o Devstral 2 processa 117 tokens por segundo, o Nova Premier fica em 31,91. Em fluxo de trabalho agentic, onde cada segundo de latência vira hora de máquina, isso pesa.

Devstral 2 2512 × Nova Premier 1.0
CritérioDevstral 2 2512Nova Premier 1.0
Índice de inteligência19.212.7
Entrada US$/M0.42.5
Saída US$/M212.5
Contexto262k1M
Pesos abertossimnão
Velocidade (tok/s)11732
Índice de código31.3
Índice agêntico10.6

Onde cada um faz sentido — e onde não faz

Para codificação agentic e fluxos longos, o Devstral 2 vence em três critérios que importam: preço, velocidade e benchmark declarado. É 123B de parâmetros com pesos abertos, 256K de contexto, e roda em qualquer infraestrutura que aceite o modelo. Se você está construindo um agente que escreve código, refatora PR ou navega repositório, é o candidato óbvio.

Para multimodal nativo, o Nova Premier tem um trunfo que o Devstral 2 não oferece: aceita imagem como entrada. Se o seu pipeline precisa descrever foto, ler print de erro, ou processar PDF com layout, o modelo da Amazon entra na conversa. E tem 1 milhão de tokens de contexto — quatro vezes a janela do francês. Para resumir bases inteiras de documentos, isso muda o jogo.

Para a maioria das aplicações de texto puro, o Nova Premier só se justifica se você precisar especificamente de algo que o Devstral 2 não entrega. Caso contrário, você está pagando seis vezes mais por um modelo com metade do índice de inteligência.

O tabuleiro nesta data

O catálogo tem 313 modelos listados hoje, vindos de 48 criadores. No topo do índice de inteligência estão o MiMo-V2-Flash da Xiaomi (34,02), o o3 da OpenAI (31,10) e o Claude Haiku 4.5 da Anthropic (29,89). O Devstral 2 aparece em quinto, com 19,24 — à frente de modelos bem mais caros. O Nova Premier está fora desse top 5.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 313 modelos disponíveis no catálogo nesta data.

A Mistral é francesa, publica pesos e cobra barato. A Amazon é americana, mantém o modelo proprietário e precifica como produto premium de hyperscaler. Quando você compara os dois, não está comparando só dois modelos: está comparando duas filosofias de monetização.

O que fazer com isso amanhã

Se você está pagando API para tarefas de código ou texto, migre o que dá para migrar e meça a fatura no fim do mês. Se multimodal é requisito não-negociável, mantenha o Nova Premier só para esse fluxo e use o Devstral 2 no resto. E se você roda modelo próprio, baixe os pesos do Devstral 2 e pare de pagar por token.

Em uma frase

Use Devstral 2 para código e texto puro — é mais barato, mais rápido e tem índice de inteligência maior; recorra ao Nova Premier só quando a entrada de imagem ou a janela de 1M de tokens for requisito.

Perguntas frequentes

Devstral 2 2512 é realmente mais barato que o Nova Premier?

Sim, em todas as métricas de preço publicadas. São US$ 0,40 por milhão de tokens de entrada contra US$ 2,50, e US$ 2 contra US$ 12,50 na saída. O cache também é mais barato: US$ 0,04 contra US$ 0,625 por milhão.

Posso rodar o Devstral 2 na minha própria infraestrutura?

Sim. O modelo tem 123B de parâmetros com pesos abertos, então você pode hospedar em GPU própria ou em provedores compatíveis. O Nova Premier, por ser proprietário, só roda via API da Amazon.

Quando o Nova Premier vale a pena mesmo sendo mais caro?

Quando você precisa de entrada de imagem nativa — o Devstral 2 é só texto — ou quando a janela de 1 milhão de tokens é requisito para resumir documentos muito longos em uma única chamada.

Leia também