Nova 2 Lite custa 67% mais que Mistral Large 3 — e perde em raciocínio
Amazon cobra US$ 2,50 por milhão de tokens de saída contra US$ 1,50 do modelo francês, que ainda abre o peso e tem contexto quatro vezes menor. O comparativo que faltava para fechar o ano.
O preço da saída que ninguém comenta
Você viu o lançamento da Amazon no começo de dezembro, viu a tabela de preços, e provavelmente passou direto. Faz sentido: Nova 2 Lite entra no catálogo como mais um "rápido e barato". Só que, quando você coloca o número ao lado do concorrente direto, a história muda.
A Amazon cobra US$ 2,50 por milhão de tokens de saída. A Mistral cobra US$ 1,50 pelo mesmo milhão no Large 3 2512, lançado um dia depois. Em volume, isso é 67% mais caro pagar pela saída no modelo americano — e a diferença só aumenta quando você ativa cache de prompt, recurso que a Amazon não publicou preço nenhum para o Nova 2 Lite.
Inteligência não é tudo, mas aqui decide
O índice de inteligência da Artificial Analysis, medido hoje, coloca o Nova 2 Lite em 19,24 e o Mistral Large 3 2512 em 15,92. Três pontos e meio de vantagem para o modelo da Amazon, em uma escala em que o topo do mercado hoje é 34,02 (MiMo-V2-Flash, da Xiaomi) e o terceiro colocado, Claude Haiku 4.5, marca 29,89.
Traduzindo: estamos falando de dois modelos que vivem na faixa intermediária do catálogo. Nenhum dos dois entra no top 5. A diferença de 3,3 pontos existe, mas ela não coloca o Nova 2 Lite em outro patamar — coloca ele um pouco à frente em raciocínio geral e bem atrás em custo.
| Critério | Nova 2 Lite | Mistral Large 3 2512 |
|---|---|---|
| Índice de inteligência | 19.2 | 15.9 |
| Entrada US$/M | 0.3 | 0.5 |
| Saída US$/M | 2.5 | 1.5 |
| Contexto | 1M | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 153 | 77 |
| Índice de código | — | 20.1 |
| Índice agêntico | — | 5.5 |
Onde cada um ganha de verdade
O Nova 2 Lite tem três trunfos reais. O primeiro é multimodal de verdade: aceita texto, imagem, arquivo e vídeo, e devolve texto. O Mistral Large 3 2512 também é multimodal, mas trava no vídeo — só texto, imagem e arquivo. Se o seu pipeline joga frame de câmera ou clip curto para o modelo, o Nova 2 Lite é o único dos dois que engole. O segundo é a janela de contexto: 1 milhão de tokens contra 262 mil do francês. Em tarefas que precisam de livros inteiros, bases de código longas ou transcrições de call, a Amazon ganha sem discussão. O terceiro é a velocidade: 153 tokens por segundo contra 77 do Mistral, quase o dobro.
O Mistral Large 3 2512 ganha em tudo que envolve conta no fim do mês. É US$ 0,50 por milhão de tokens de entrada contra US$ 0,30 do Nova 2 Lite — então na entrada a Amazon é mais barata, mas a saída, que pesa mais em quase todo workload de produção, custa 67% mais no Nova. Tem cache de prompt a US$ 0,05 por milhão de tokens, recurso que a Amazon não publicou e que, em workloads com system prompt repetido, derruba o custo efetivo para uma fração do preço de tabela. E abre o peso: 675 bilhões de parâmetros totais com 41 bilhões ativos, sob Apache 2.0. Você pode hospedar, ajustar, fazer fine-tune, sem pagar royalty de API enquanto o tráfego justificar.
Quando cada um faz sentido
Você roda um agente que processa vídeo, atende usuário em tempo real e depende de contexto gigante? Nova 2 Lite. Você tem workload de texto puro, prompt grande que repete toda hora, e quer manter a fatura sob controle? Mistral Large 3 2512. Você quer rodar local, ajustar com seus dados ou escapar de fornecedor único? Mistral Large 3 2512, sem pensar duas vezes.
O tabuleiro em que eles entram
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Os dois modelos estrearam no mesmo intervalo de 48 horas, em dezembro de 2025, e foram parar num catálogo com 313 modelos listados hoje e 48 criadores diferentes. No topo por inteligência, o Xiaomi MiMo-V2-Flash lidera com 34,02 e cobra US$ 0,30 por milhão de saída — ou seja, mais barato que os dois, e com nota bem acima. O Claude Haiku 4.5, da Anthropic, marca 29,89 por US$ 5 de saída. O o3, da OpenAI, cobra US$ 8 por milhão de tokens de saída e fica em 31,09 de inteligência. Ou seja: Nova 2 Lite e Mistral Large 3 2512 não disputam o topo — disputam a faixa de quem quer pagar pouco sem abrir mão de multimodal ou de peso aberto.
O que fazer com isso hoje
Se você está escolhendo entre os dois agora, a conta é simples. Coloque no spreadsheet o seu volume real de tokens de saída e multiplique por 2,50 (Nova) ou por 1,50 (Mistral). Some o custo de cache se o seu prompt repete — US$ 0,05 por milhão no Mistral é o que derruba a conta em chatbots, RAG e agentes com instruções longas. Se multimodal com vídeo e contexto de 1 milhão de tokens não é requisito, o francês ganha no preço e ainda libera você da amarração de fornecedor. Se vídeo entra no pipeline, a Amazon é a única dos dois que resolve.
Para texto puro com prompt repetido, Mistral Large 3 2512 custa menos, tem cache de prompt publicado e libera o peso; para vídeo, contexto de 1M e velocidade bruta, Nova 2 Lite é o caminho.
Perguntas frequentes
Qual é mais barato, Nova 2 Lite ou Mistral Large 3 2512?
O Mistral Large 3 2512 é mais barato na saída (US$ 1,50 contra US$ 2,50 por milhão de tokens) e ainda publica cache de prompt a US$ 0,05 por milhão. O Nova 2 Lite só ganha na entrada (US$ 0,30 contra US$ 0,50 por milhão).
O Mistral Large 3 2512 é open weights?
Sim. É distribuído sob Apache 2.0, com 675 bilhões de parâmetros totais e 41 bilhões ativos em arquitetura sparse mixture-of-experts. Dá para hospedar, fazer fine-tune e ajustar sem pagar royalty de API.
Qual dos dois aceita vídeo?
Apenas o Nova 2 Lite. O Mistral Large 3 2512 trabalha com texto, imagem e arquivo, mas não engole vídeo. Em pipelines com frame de câmera ou clip curto, o modelo da Amazon é o único dos dois que resolve.