Nova 2 Lite custa 12× mais que Ministral 3 14B na saída
Amazon e Mistral lançaram modelos pequenos no mesmo dia, em dezembro; um deles cobra caro pelo token, o outro cobra barato pelo token — e a conta muda tudo.
O lançamento que ninguém notou
Em 2 de dezembro de 2025, Amazon e Mistral colocaram no catálogo dois modelos pequenos no mesmo dia. Nenhum dos dois veio com keynote, nenhum dos dois virou trending. Mas se você olha a fatura da API todo mês, eles merecem atenção — porque a diferença de preço entre eles é absurda, e a diferença de inteligência nem tanto.
| Critério | Nova 2 Lite | Ministral 3 14B 2512 |
|---|---|---|
| Índice de inteligência | 19.2 | 11.2 |
| Entrada US$/M | 0.3 | 0.2 |
| Saída US$/M | 2.5 | 0.2 |
| Contexto | 1M | 262k |
| Pesos abertos | não | sim |
| Velocidade (tok/s) | 153 | 107 |
| Índice de código | — | 14.4 |
| Índice agêntico | — | 2.2 |
O que cada um faz de verdade
O Nova 2 Lite é o modelo "rápido e barato" da Amazon para o dia a dia. Ele recebe texto, imagem, arquivo e vídeo e devolve texto. É um modelo de raciocínio — ou seja, gasta tokens pensando antes de responder — e roda a cerca de 153 tokens por segundo no benchmark. O contexto vai a 1 milhão de tokens, o que é generoso. O índice de inteligência Artificial Analysis marca 19,24.
O Ministral 3 14B é o maior da família Ministral 3 da Mistral. Também é multimodal — texto e imagem para texto — mas o contexto é menor, 262 mil tokens. Não é modelo de raciocínio, então responde direto. Tem 14 bilhões de parâmetros, todos ativos, e os pesos são abertos. Velocidade medida: 107 tokens por segundo. Índice de inteligência: 11,24.
A conta que ninguém quer olhar
Aqui é onde a conversa muda de tom. O Nova 2 Lite cobra US$ 0,30 por milhão de tokens de entrada e US$ 2,50 por milhão de tokens de saída. O Ministral 3 14B cobra US$ 0,20 de entrada, US$ 0,20 de saída — e ainda oferece cache de leitura a US$ 0,02 por milhão, um décimo do preço de entrada.
Traduzindo: para cada milhão de tokens que o seu sistema cospe de volta, o Nova 2 Lite custa 12,5 vezes mais que o Ministral. Em um workload que gera, digamos, 50 milhões de tokens de saída por mês, são US$ 125 contra US$ 10. A diferença é o preço de um almoço.
Onde cada um ganha
Você não troca um pelo outro sem pensar. O Nova 2 Lite ganha em três cenários muito específicos:
- Você precisa processar vídeo. O Ministral 3 14B não lê vídeo — só imagem e texto. Se o seu pipeline recebe clipes ou frames de vídeo, o Nova 2 Lite é uma das poucas opções pequenas que faz isso.
- Você precisa de contexto de 1 milhão de tokens. O Ministral trava em 262 mil. Para resumir livros inteiros ou despejar um codebase gigante numa única chamada, a janela maior da Amazon muda o jogo.
- Você quer raciocínio explícito. O Nova 2 Lite é marcado como modelo de raciocínio; o Ministral 3 14B não é. Em tarefas que se beneficiam de cadeia de pensamento, o差距 de 8 pontos no índice de inteligência pesa.
O Ministral 3 14B ganha em quase todo o resto:
- Custo é o fator decisivo. Quando o trabalho é classificação, extração, resumo curto, geração de JSON ou qualquer chamada de alto volume, pagar US$ 0,20 em vez de US$ 2,50 por milhão de tokens de saída é a diferença entre um projeto viável e um projeto que come a margem.
- Cache de leitura barato. Os US$ 0,02 por milhão para leitura em cache são um presente para qualquer sistema que repete prompts longos — RAG com contexto fixo, agentes que injetam o mesmo system prompt, chatbots com histórico longo.
- Pesos abertos. O Ministral 3 14B é open weights. Se você quer rodar on-prem, fazer fine-tuning ou auditar o modelo, a Mistral entrega; a Amazon não.
Onde eles se sentam no tabuleiro
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Devstral 2 2512 | 19.2 | 2 |
Olhando o topo do catálogo nesta data, o Xiaomi MiMo-V2-Flash lidera o índice de inteligência com 34,02 cobrando US$ 0,30 por milhão de saída. O OpenAI o3 vem logo atrás com 31,09 a US$ 8. O Claude Haiku 4.5 da Anthropic marca 29,89 a US$ 5. Os dois modelos desta comparação estão bem abaixo disso — Nova 2 Lite em 19,24 e Ministral 3 14B em 11,24. São modelos de trabalho, não modelos de topo de gama.
A implicação prática
Se a sua fila de chamadas cabe em 262 mil tokens, não precisa de vídeo e o orçamento aperta: Ministral 3 14B, sem pensar duas vezes. Se algum desses três limites aparece no seu fluxo — vídeo, contexto de 1M, raciocínio explícito — aí o Nova 2 Lite entra, mas só aí, e você já sabe que vai pagar por isso na fatura.
Para 90% dos workloads de alto volume, o Ministral 3 14B a US$ 0,20/M de saída é a escolha racional; o Nova 2 Lite só compensa quando vídeo, contexto de 1M ou raciocínio explícito são bloqueios reais.
Perguntas frequentes
Qual a diferença de preço entre Nova 2 Lite e Ministral 3 14B?
Na saída, o Nova 2 Lite cobra US$ 2,50 por milhão de tokens contra US$ 0,20 do Ministral 3 14B — 12,5 vezes mais. Na entrada, a diferença é menor: US$ 0,30 contra US$ 0,20. O Ministral ainda oferece cache de leitura a US$ 0,02 por milhão.
O Nova 2 Lite processa vídeo e o Ministral 3 14B não?
Correto. O Nova 2 Lite aceita texto, imagem, arquivo e vídeo como entrada e devolve texto. O Ministral 3 14B trabalha apenas com texto e imagem. Para pipelines que recebem vídeo, essa é a diferença que decide.
Qual dos dois tem melhor índice de inteligência?
Pelo índice Artificial Analysis medido nesta data, o Nova 2 Lite marca 19,24 e o Ministral 3 14B marca 11,24. Os dois ficam abaixo do top 5 do catálogo, que é liderado pelo Xiaomi MiMo-V2-Flash com 34,02.