Devstral 2 cobra seis vezes menos que o Nova Premier — e entrega mais
Comparativo frente a frente entre o modelo aberto da Mistral e o topo de linha multimodal da Amazon mostra que preço nem sempre é o melhor indicador de capacidade.
O número que abre a conversa
Você está olhando o catálogo e vê dois modelos com proposta parecida: tarefa técnica pesada, janela de contexto generosa, fatura no fim do mês. Aí olha o preço de saída e pensa que o mais caro deve ser o melhor. Pois é: dessa vez, não.
O Devstral 2 2512, da Mistral, custa US$ 2 por milhão de tokens de saída. O Nova Premier 1.0, da Amazon, custa US$ 12,50 pelo mesmo volume. Seis vezes mais caro, índice de inteligência menor. Antes de você fechar a aba achando que é pegadinha, veja os números.
Inteligência e velocidade: o que cada um entrega
No índice de inteligência da Artificial Analysis medido hoje, o Devstral 2 marca 19,24 e o Nova Premier, 12,72. Em codificação, a diferença é ainda maior: 31,26 contra um campo vazio — a Amazon simplesmente não publicou benchmark de coding para esse modelo. Em tarefas agentic, 10,64 para o francês e dado ausente para o americano.
Velocidade também não é o argumento da Amazon aqui: o Devstral 2 processa 117 tokens por segundo, o Nova Premier fica em 31,91. Em fluxo de trabalho agentic, onde cada segundo de latência vira hora de máquina, isso pesa.
| Critério | Devstral 2 2512 | Nova Premier 1.0 |
|---|---|---|
| Índice de inteligência | 19.2 | 12.7 |
| Entrada US$/M | 0.4 | 2.5 |
| Saída US$/M | 2 | 12.5 |
| Contexto | 262k | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 117 | 32 |
| Índice de código | 31.3 | — |
| Índice agêntico | 10.6 | — |
Onde cada um faz sentido — e onde não faz
Para codificação agentic e fluxos longos, o Devstral 2 vence em três critérios que importam: preço, velocidade e benchmark declarado. É 123B de parâmetros com pesos abertos, 256K de contexto, e roda em qualquer infraestrutura que aceite o modelo. Se você está construindo um agente que escreve código, refatora PR ou navega repositório, é o candidato óbvio.
Para multimodal nativo, o Nova Premier tem um trunfo que o Devstral 2 não oferece: aceita imagem como entrada. Se o seu pipeline precisa descrever foto, ler print de erro, ou processar PDF com layout, o modelo da Amazon entra na conversa. E tem 1 milhão de tokens de contexto — quatro vezes a janela do francês. Para resumir bases inteiras de documentos, isso muda o jogo.
Para a maioria das aplicações de texto puro, o Nova Premier só se justifica se você precisar especificamente de algo que o Devstral 2 não entrega. Caso contrário, você está pagando seis vezes mais por um modelo com metade do índice de inteligência.
O tabuleiro nesta data
O catálogo tem 313 modelos listados hoje, vindos de 48 criadores. No topo do índice de inteligência estão o MiMo-V2-Flash da Xiaomi (34,02), o o3 da OpenAI (31,10) e o Claude Haiku 4.5 da Anthropic (29,89). O Devstral 2 aparece em quinto, com 19,24 — à frente de modelos bem mais caros. O Nova Premier está fora desse top 5.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
A Mistral é francesa, publica pesos e cobra barato. A Amazon é americana, mantém o modelo proprietário e precifica como produto premium de hyperscaler. Quando você compara os dois, não está comparando só dois modelos: está comparando duas filosofias de monetização.
O que fazer com isso amanhã
Se você está pagando API para tarefas de código ou texto, migre o que dá para migrar e meça a fatura no fim do mês. Se multimodal é requisito não-negociável, mantenha o Nova Premier só para esse fluxo e use o Devstral 2 no resto. E se você roda modelo próprio, baixe os pesos do Devstral 2 e pare de pagar por token.
Use Devstral 2 para código e texto puro — é mais barato, mais rápido e tem índice de inteligência maior; recorra ao Nova Premier só quando a entrada de imagem ou a janela de 1M de tokens for requisito.
Perguntas frequentes
Devstral 2 2512 é realmente mais barato que o Nova Premier?
Sim, em todas as métricas de preço publicadas. São US$ 0,40 por milhão de tokens de entrada contra US$ 2,50, e US$ 2 contra US$ 12,50 na saída. O cache também é mais barato: US$ 0,04 contra US$ 0,625 por milhão.
Posso rodar o Devstral 2 na minha própria infraestrutura?
Sim. O modelo tem 123B de parâmetros com pesos abertos, então você pode hospedar em GPU própria ou em provedores compatíveis. O Nova Premier, por ser proprietário, só roda via API da Amazon.
Quando o Nova Premier vale a pena mesmo sendo mais caro?
Quando você precisa de entrada de imagem nativa — o Devstral 2 é só texto — ou quando a janela de 1 milhão de tokens é requisito para resumir documentos muito longos em uma única chamada.