FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Dois modelos perdem nota no catálogo e a conta não muda

Nova 2.0 Pro Preview e Mistral Large 3 tiveram o IQ reavaliado para baixo pelo Artificial Analysis — o que mexe com quem já tinha escolhido por capacidade, não por preço.

Redação FalaVIP IA 3 min de leitura
-2,066 pontosqueda do Nova 2.0 Pro Preview (de 16,422 para 14,356)
-0,258 pontosqueda do Mistral Large 3 (de 16,188 para 15,93)
US$ 3,4375por milhão de tokens de saída do Nova 2.0 Pro Preview

A régua se mexeu debaixo de quem já tinha escolhido. Hoje o Artificial Analysis revisou para baixo as notas de IQ de dois modelos do catálogo, e a diferença entre o que estava no papel e o que está agora é pequena em números absolutos, mas suficiente para bagunçar qualquer comparação que você montou semana passada.

O que caiu e quanto

São duas reavaliações na mesma data, 24 de junho de 2026. A primeira é a do Nova 2.0 Pro Preview (Non-reasoning), que foi de 16,422 para 14,356 — uma perda de 2,066 pontos de IQ. A segunda é a do Mistral Large 3, que foi de 16,188 para 15,93 — perda bem mais modesta, de 0,258 ponto.

Em termos relativos, o Nova 2.0 Pro Preview perdeu cerca de 12,6% da nota anterior. O Mistral Large 3 perdeu 1,6%. O primeiro é um caso de mudança relevante; o segundo é quase um ajuste fino. Mas os dois estão na mesma faixa de IQ, abaixo dos 20 pontos, longe do topo do catálogo.

Notas revisadas pelo Artificial Analysis
ModeloAntesDepoisDiferença
Nova 2.0 Pro Preview (Non-re16.414.4-2.1
Mistral Large 316.215.9-0.3

Onde eles ficam no tabuleiro

Para situar a queda, vale olhar quem está na frente hoje. O topo do catálogo tem o Anthropic Claude Fable 5 com IQ 62,073 e preço de US$ 50 por milhão de tokens de saída. Logo abaixo, o Z.ai GLM 5.2 com IQ 52,641 e US$ 3,036 — a melhor relação capacidade/preço entre os modelos fortes. O Google Gemini 3.1 Pro Preview aparece com IQ 47,738, e o Google Gemini 3.5 Flash com 46,673. O OpenAI GPT-5.3-Codex fecha o top 5 com 45,512.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 477 modelos disponíveis no catálogo nesta data.

Nova 2.0 Pro Preview e Mistral Large 3 estão a mais de 30 pontos de distância desse grupo. Eles não competem por capacidade — competem por preço e por nicho. O Mistral Large 3 cobra US$ 0,75 por milhão de tokens de saída, valor que não foi alterado pela reavaliação. O Nova 2.0 Pro Preview cobra US$ 3,4375 — mais caro que o Mistral, mais barato que o Claude Fable 5, mas numa faixa de IQ que não se compara nem com o Gemini 3.5 Flash nem com o DeepSeek V4 Pro 0423 (45,268 por US$ 1,74).

O que a nota mudou de verdade

Aqui está o ponto que costuma passar batido: reavaliar IQ não muda o preço nem o comportamento do modelo em produção. O que muda é a régua que você usa para decidir. Se você montou uma planilha em junho dizendo "Mistral Large 3 está em 16,188 e o concorrente X está em 16,1, então são equivalentes", essa planilha perdeu a base. O Mistral agora está em 15,93 — a diferença com o concorrente dobrou de largura.

Para o Nova 2.0 Pro Preview, a queda é mais dura. Quem comprou a ideia de "16 pontos de IQ por US$ 3,44" está olhando hoje para 14,356 pelo mesmo preço. É o tipo de movimento que faz um CTO repensar uma rota de fallback.

Para quem isso importa — e para quem não

Se você usa Nova 2.0 Pro Preview ou Mistral Large 3 em produção e a escolha foi feita por capacidade, vale rodar os mesmos prompts de novo e comparar com a alternativa mais barata na mesma faixa. Para o Mistral, a US$ 0,75 por milhão de tokens de saída, ainda é difícil bater no quesito preço — a nota caiu, mas o custo-benefício segue forte. Para o Nova, a US$ 3,4375 com IQ abaixo de 15, a conversa muda.

Se você não usa nenhum dos dois, a reavaliação não te afeta diretamente — mas afeta qualquer ranking que você consultou nos últimos dias. E se você está comparando modelos na casa dos 15 a 17 pontos de IQ, qualquer planilha antiga precisa de atualização antes de virar decisão.

O que fazer agora

Pegue os dois modelos que você tinha como referência na faixa dos 15 pontos e refaça a comparação com os dados de hoje. O catálogo tem mais de 477 modelos listados e 62 criadores diferentes; a chance de existir algo melhor na mesma faixa de preço é real. E da próxima vez que alguém te mostrar um IQ, pergunta a data da medição — a régua muda mais do que o release deixa transparecer.

Em uma frase

Reavalie qualquer comparação que cite IQ do Nova 2.0 Pro Preview ou do Mistral Large 3 feita antes de 24 de junho de 2026 — a nota mudou, o preço não.

Perguntas frequentes

O que mudou exatamente nas notas do Nova 2.0 Pro Preview e do Mistral Large 3?

O Nova 2.0 Pro Preview caiu de 16,422 para 14,356 (perda de 2,066 pontos). O Mistral Large 3 caiu de 16,188 para 15,93 (perda de 0,258 ponto). Os preços de tabela não foram alterados.

A reavaliação de IQ muda o preço do modelo?

Não. O preço por milhão de tokens de saída continua o mesmo: US$ 3,4375 para o Nova 2.0 Pro Preview e US$ 0,75 para o Mistral Large 3. O que muda é a régua de comparação, não a fatura.

Esses dois modelos ainda valem a pena depois da queda?

Depende do critério. O Mistral Large 3 segue competitivo pelo preço (US$ 0,75 por milhão de tokens de saída), mesmo com a nota revisada. O Nova 2.0 Pro Preview, a US$ 3,4375 com IQ abaixo de 15, perde吸引力 frente a alternativas como o DeepSeek V4 Pro 0423, que tem IQ 45,268 por US$ 1,74.

Leia também