FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Nova Premier cobra 8,3× mais caro que Mistral Large 3 e perde em inteligência

Contexto de 1 milhão de tokens é o único argumento a favor do modelo da AWS; em quase todo o resto, o francês entrega mais por menos — e ainda é open weights.

Redação FalaVIP IA 3 min de leitura
8,3×preço por milhão de tokens de saída do Nova Premier sobre o Mistral Large 3
15,9 vs 12,7índice de inteligência (Mistral 25% acima do Nova Premier)
1.000.000tokens de contexto do Nova Premier (única vitória sobre os 262.144 do Mistral)

Pense em gastar US$ 12,50 por milhão de tokens de saída quando dá pra gastar US$ 1,50. É isso que o Amazon Nova Premier 1.0 está pedindo comparado ao Mistral Large 3 2512 — oito vezes mais caro por um modelo que ainda mede pior em inteligência, programa pior e responde mais devagar. A AWS só leva numa coisa, e a gente chega lá.

Preço de saída (US$ por milhão de tokens)
Mistral Large 3 25121,5Nova Premier 1.012,5US$/M
Fonte: OpenRouter

A conta que a AWS está te pedindo

O preço de saída é a primeira linha que explode na fatura quando você usa LLM em volume, porque é ali que a maioria dos produtos gasta tokens: respostas, gerações, code completion estendido, raciocínio encadeado. O Nova Premier cobra US$ 12,50 por milhão. O Mistral Large 3 cobra US$ 1,50. Não é ajuste fino — é outra ordem de grandeza.

E não é "ah, mas o da AWS entrega mais qualidade que compensa". Pelo índice de inteligência da Artificial Analysis, que é a régua do catálogo hoje, o Mistral Large 3 marca 15,9 contra 12,7 do Nova Premier. Ou seja: você paga oito vezes mais caro por um modelo que mede 25% pior.

Índice de inteligência (Artificial Analysis)
Mistral Large 3 251215,9Nova Premier 1.012,7índice
Fonte: Artificial Analysis

Onde o Mistral ganha — e não é só no preço

Em quase toda métrica comparável, o francês passa o americano. Coding: 20,1 (Mistral) contra dado não publicado pela Amazon. Agentic: 5,5 contra dado não publicado. Velocidade: 77,4 tokens por segundo contra 31,9. Isso na prática quer dizer que, se você está montando um agente que faz dezenas de chamadas em sequência, o Mistral entrega em menos da metade do tempo e cobra uma fração do preço.

Some a isso o fato de o Mistral Large 3 ser open weights sob Apache 2.0, com 675 bilhões de parâmetros totais e 41 bilhões ativos em arquitetura MoE sparse. Se você quiser, baixa, inspeciona, faz fine-tuning, hospeda onde quiser. O Nova Premier é fechado, e a Amazon nem divulga o número de parâmetros. E tem mais uma: o Mistral aceita entrada de arquivo (PDF, código, planilha), o Nova Premier só texto e imagem.

Mistral Large 3 2512 × Nova Premier 1.0
CritérioMistral Large 3 2512Nova Premier 1.0
Índice de inteligência15.912.7
Entrada US$/M0.52.5
Saída US$/M1.512.5
Contexto262k1M
Pesos abertossimnão
Velocidade (tok/s)7732
Índice de código20.1
Índice agêntico5.5

O único terreno em que a Amazon não perde

Existe uma coisa, e ela é grande: contexto. O Nova Premier aceita 1 milhão de tokens de entrada. O Mistral Large 3 aceita 262 mil. Se o seu caso de uso é enfiar uma codebase inteira, um PDF de 800 páginas ou uma base de conhecimento completa numa única chamada, esse delta de quase quatro vezes não é detalhe — é o que define se o modelo consegue ou não fazer o trabalho sem você ter que chunkar.

Para tudo o que cabe em 262 mil tokens — e cabe muita coisa, um livro de 500 páginas, um codebase de porte médio, várias horas de transcrição — o Mistral é a escolha racional. Para o nicho específico em que 262 mil não basta, o Nova Premier entra na conta, mas você vai pagar caro, abrir mão de velocidade e abrir mão de inteligência. É um trade-off consciente, não um upgrade.

Onde os dois ficam no tabuleiro

Nenhum dos dois está no topo do catálogo hoje. O líder é o Xiaomi MiMo-V2-Flash, com IQ 34,0 e preço de saída de US$ 0,30 por milhão. O segundo é o OpenAI o3, com IQ 31,1 e US$ 8. O Claude Haiku 4.5 vem em terceiro, com IQ 29,9 e US$ 5. O Mistral Large 3 2512 e o Nova Premier 1.0 estão bem abaixo dessa linha — o francês na casa dos 15,9, o americano nos 12,7.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Devstral 2 251219.22
Entre os 315 modelos disponíveis no catálogo nesta data.

O ponto é: o Nova Premier não é competitivo nem em preço nem em IQ. A AWS está pedindo US$ 12,50 por milhão num IQ 12,7 quando tem opção aberta como o Devstral 2 2512 com IQ 19,2 por US$ 2, ou fechada de ponta como o Claude Haiku 4.5 com IQ 29,9 por US$ 5.

Em uma frase

Troque Nova Premier por Mistral Large 3 2512 a menos que seu pipeline realmente dependa de contexto acima de 262 mil tokens — nesse caso, aceite o custo sabendo que é exceção, não padrão.

Perguntas frequentes

Quando vale a pena pagar 8 vezes mais caro no Amazon Nova Premier?

Apenas quando você genuinamente precisa de mais de 262 mil tokens de contexto numa única chamada — por exemplo, para ingestar uma codebase inteira ou um PDF de 800 páginas. Em todo o resto, o Mistral Large 3 2512 entrega mais inteligência, mais velocidade e menor custo por token.

Mistral Large 3 2512 é realmente open source?

Sim. O modelo é distribuído sob licença Apache 2.0, com 675 bilhões de parâmetros totais e 41 bilhões ativos em arquitetura MoE sparse. Você pode baixar, inspecionar, fazer fine-tuning e hospedar onde quiser — algo que o Nova Premier, fechado, não permite.

Qual dos dois é melhor para programação?

O Mistral Large 3, disparado. Ele pontua 20,1 no índice de coding da Artificial Analysis; a Amazon não publicou score equivalente para o Nova Premier. Se o seu produto depende de geração, revisão ou refatoração de código, a comparação nem chega a existir.

Leia também