Nova Premier cobra 8,3× mais caro que Mistral Large 3 e perde em inteligência
Contexto de 1 milhão de tokens é o único argumento a favor do modelo da AWS; em quase todo o resto, o francês entrega mais por menos — e ainda é open weights.
Pense em gastar US$ 12,50 por milhão de tokens de saída quando dá pra gastar US$ 1,50. É isso que o Amazon Nova Premier 1.0 está pedindo comparado ao Mistral Large 3 2512 — oito vezes mais caro por um modelo que ainda mede pior em inteligência, programa pior e responde mais devagar. A AWS só leva numa coisa, e a gente chega lá.
A conta que a AWS está te pedindo
O preço de saída é a primeira linha que explode na fatura quando você usa LLM em volume, porque é ali que a maioria dos produtos gasta tokens: respostas, gerações, code completion estendido, raciocínio encadeado. O Nova Premier cobra US$ 12,50 por milhão. O Mistral Large 3 cobra US$ 1,50. Não é ajuste fino — é outra ordem de grandeza.
E não é "ah, mas o da AWS entrega mais qualidade que compensa". Pelo índice de inteligência da Artificial Analysis, que é a régua do catálogo hoje, o Mistral Large 3 marca 15,9 contra 12,7 do Nova Premier. Ou seja: você paga oito vezes mais caro por um modelo que mede 25% pior.
Onde o Mistral ganha — e não é só no preço
Em quase toda métrica comparável, o francês passa o americano. Coding: 20,1 (Mistral) contra dado não publicado pela Amazon. Agentic: 5,5 contra dado não publicado. Velocidade: 77,4 tokens por segundo contra 31,9. Isso na prática quer dizer que, se você está montando um agente que faz dezenas de chamadas em sequência, o Mistral entrega em menos da metade do tempo e cobra uma fração do preço.
Some a isso o fato de o Mistral Large 3 ser open weights sob Apache 2.0, com 675 bilhões de parâmetros totais e 41 bilhões ativos em arquitetura MoE sparse. Se você quiser, baixa, inspeciona, faz fine-tuning, hospeda onde quiser. O Nova Premier é fechado, e a Amazon nem divulga o número de parâmetros. E tem mais uma: o Mistral aceita entrada de arquivo (PDF, código, planilha), o Nova Premier só texto e imagem.
| Critério | Mistral Large 3 2512 | Nova Premier 1.0 |
|---|---|---|
| Índice de inteligência | 15.9 | 12.7 |
| Entrada US$/M | 0.5 | 2.5 |
| Saída US$/M | 1.5 | 12.5 |
| Contexto | 262k | 1M |
| Pesos abertos | sim | não |
| Velocidade (tok/s) | 77 | 32 |
| Índice de código | 20.1 | — |
| Índice agêntico | 5.5 | — |
O único terreno em que a Amazon não perde
Existe uma coisa, e ela é grande: contexto. O Nova Premier aceita 1 milhão de tokens de entrada. O Mistral Large 3 aceita 262 mil. Se o seu caso de uso é enfiar uma codebase inteira, um PDF de 800 páginas ou uma base de conhecimento completa numa única chamada, esse delta de quase quatro vezes não é detalhe — é o que define se o modelo consegue ou não fazer o trabalho sem você ter que chunkar.
Para tudo o que cabe em 262 mil tokens — e cabe muita coisa, um livro de 500 páginas, um codebase de porte médio, várias horas de transcrição — o Mistral é a escolha racional. Para o nicho específico em que 262 mil não basta, o Nova Premier entra na conta, mas você vai pagar caro, abrir mão de velocidade e abrir mão de inteligência. É um trade-off consciente, não um upgrade.
Onde os dois ficam no tabuleiro
Nenhum dos dois está no topo do catálogo hoje. O líder é o Xiaomi MiMo-V2-Flash, com IQ 34,0 e preço de saída de US$ 0,30 por milhão. O segundo é o OpenAI o3, com IQ 31,1 e US$ 8. O Claude Haiku 4.5 vem em terceiro, com IQ 29,9 e US$ 5. O Mistral Large 3 2512 e o Nova Premier 1.0 estão bem abaixo dessa linha — o francês na casa dos 15,9, o americano nos 12,7.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
O ponto é: o Nova Premier não é competitivo nem em preço nem em IQ. A AWS está pedindo US$ 12,50 por milhão num IQ 12,7 quando tem opção aberta como o Devstral 2 2512 com IQ 19,2 por US$ 2, ou fechada de ponta como o Claude Haiku 4.5 com IQ 29,9 por US$ 5.
Troque Nova Premier por Mistral Large 3 2512 a menos que seu pipeline realmente dependa de contexto acima de 262 mil tokens — nesse caso, aceite o custo sabendo que é exceção, não padrão.
Perguntas frequentes
Quando vale a pena pagar 8 vezes mais caro no Amazon Nova Premier?
Apenas quando você genuinamente precisa de mais de 262 mil tokens de contexto numa única chamada — por exemplo, para ingestar uma codebase inteira ou um PDF de 800 páginas. Em todo o resto, o Mistral Large 3 2512 entrega mais inteligência, mais velocidade e menor custo por token.
Mistral Large 3 2512 é realmente open source?
Sim. O modelo é distribuído sob licença Apache 2.0, com 675 bilhões de parâmetros totais e 41 bilhões ativos em arquitetura MoE sparse. Você pode baixar, inspecionar, fazer fine-tuning e hospedar onde quiser — algo que o Nova Premier, fechado, não permite.
Qual dos dois é melhor para programação?
O Mistral Large 3, disparado. Ele pontua 20,1 no índice de coding da Artificial Analysis; a Amazon não publicou score equivalente para o Nova Premier. Se o seu produto depende de geração, revisão ou refatoração de código, a comparação nem chega a existir.