FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Agnes 2.5 Pro Alpha entra a US$ 0,56 por milhão, mas com QI 38,79

A nova entrada do índice da Artificial Analysis custa menos da metade do modelo mais barato acima de QI 45 — e a nota de intelligence mostra o tamanho do trade-off.

Redação FalaVIP IA 3 min de leitura
US$ 0,5625por milhão de tokens de saída, preço da Agnes 2.5 Pro Alpha
IQ 38,79nota de inteligência da Agnes 2.5 Pro Alpha no índice da Artificial Analysis
US$ 1,20por milhão de tokens, preço dos modelos mais baratos acima de QI 45 (MiniMax M3 e GPT-5.6 Luna)

Você viu o preço de US$ 0,5625 por milhão de tokens de saída e quase botou no carrinho. Faz sentido — é menos da metade do modelo mais barato que o índice Artificial Analysis considera "acima de QI 45". Mas o número que vem junto, IQ 38,79, é o que deveria te fazer parar e reler o dashboard.

A Agnes 2.5 Pro Alpha estreou hoje no catálogo da Artificial Analysis, que agora soma mais de 520 modelos vindos de 66 criadores. O preço é convidativo. O desempenho, nem tanto: a nota de inteligência fica 6,6 pontos abaixo do corte de 45 que separa os modelos "úteis para tarefa séria" dos que mal passam nesse filtro. É o tipo de gap que, na prática, vira chamada de API a mais para corrigir alucinação, ou então refazer o prompt três vezes até sair algo aproveitável. O barato, aqui, não é barato — só está precificado baixo.

Onde ela cai na régua

Olha o topo do índice nesta data: Claude Opus 5 lidera com IQ 63,05 a US$ 25 por milhão de tokens de saída. Logo atrás vem Claude Fable 5, da própria Anthropic, com IQ 62,07 mas custando o dobro — US$ 50. A OpenAI emplaca GPT-5.6 Sol na terceira posição a US$ 10 por milhão e fecha o top 5 com GPT-5.6 Terra a US$ 12. A chinesa MoonshotAI entra em quarto com Kimi K3, IQ 59,70 a US$ 15.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
GPT-5.6 Terra56.612
Entre os 521 modelos disponíveis no catálogo nesta data.

A Agnes 2.5 Pro Alpha entra abaixo de todos esses — e também abaixo do trio que forma a prateleira "barata e capaz": MiniMax M3 (IQ 45,40 a US$ 1,20), GPT-5.6 Luna (IQ 52,32 a US$ 1,20) e DeepSeek V4 Pro 0423 (IQ 45,27 a US$ 1,74). Em outras palavras, ela é mais barata que esses três, sim, mas em troca entrega um salto de capability que não cabe numa linha de release.

O que significa "barato" neste catálogo

Quando a Anthropic diz que o Fable 5 é uma opção para o usuário que busca o melhor em raciocínio, o preço de US$ 50 por milhão é a conta. Quando uma fornecedora joga US$ 0,5625 no banner, a conta é outra — e em geral é a conta de quem vai usar o modelo para classificar, resumir texto curto, extrair entidade de documento bagunçado. Tarefa onde "bom o suficiente" paga a conta.

Pense assim: é como comparar um carro popular com um que tem menos da metade do motor. Se o que você quer é ir da padaria ao trabalho, ambos servem. Se a ideia é pegar estrada com carga, a economia no combustível vira prejuízo no primeiro reboque.

Para quem vale, e para quem não muda nada

A Agnes 2.5 Pro Alpha faz sentido no seu stack se você roda prompts em lote com tolerância alta a erro — classificação de ticket, extração de campo de formulário, geração de variação de copy onde o revisor humano entra depois. Para prototipagem rápida, onde o importante é iterar e não publicar, também serve.

Não faz sentido se o seu produto depende de raciocínio encadeado, código de produção sem revisão pesada ou qualquer fluxo onde um erro de fato custa dinheiro real. Para esses casos, o salto de US$ 0,56 para US$ 1,20 (GPT-5.6 Luna ou MiniMax M3) ou US$ 1,74 (DeepSeek V4 Pro) compra entre 6 e 14 pontos de IQ — e esse é o tipo de upgrade que se paga nas primeiras horas de uso.

O sinal de fundo

Em trinta dias, 44 modelos novos entraram no índice. O catálogo de mais de 520 modelos não é sinal de fartura — é sinal de saturação. Cada novo lançamento precisa responder à pergunta: "o que esse modelo faz que os outros do catálogo não fazem, ou fazem mais barato?" A Agnes 2.5 Pro Alpha responde com preço. Se isso é o suficiente para você, é um problema resolvido. Se não é, ela é só mais um nome na prateleira de baixo.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Agnes 2.5 Pro Alpha38.80.56
Em uma frase

Para classificação em lote, extração simples e prototipagem, o preço da Agnes 2.5 Pro Alpha compensa; para qualquer fluxo que vá para produção sem revisão pesada, gastar US$ 1,20 por milhão em MiniMax M3 ou GPT-5.6 Luna compra entre 6 e 14 pontos de IQ — upgrade que se paga em poucas horas de uso.

Perguntas frequentes

O que é a Agnes 2.5 Pro Alpha?

É um modelo que estreou no índice da Artificial Analysis em 24 de julho de 2026, com nota de inteligência 38,79 e preço de US$ 0,5625 por milhão de tokens de saída. O índice não informa o criador na listagem pública do dia da estreia.

Vale a pena usar um modelo com IQ abaixo de 45?

Depende do caso. Para classificação em lote, extração simples de campo e prototipagem rápida, o preço baixo pode compensar. Para raciocínio encadeado, código de produção ou tarefas com custo de erro alto, o salto de US$ 0,56 para US$ 1,20 (MiniMax M3 ou GPT-5.6 Luna) costuma se pagar em menos iterações.

Quanto custa a Agnes 2.5 Pro Alpha em comparação com os modelos mais baratos acima de QI 45?

A Agnes cobra US$ 0,5625 por milhão de tokens de saída. Os três mais baratos acima de QI 45 custam US$ 1,20 (MiniMax M3 e GPT-5.6 Luna) e US$ 1,74 (DeepSeek V4 Pro 0423) — entre duas e três vezes o preço da Agnes.

Leia também

Benchmarks

Quatro modelos do catálogo tiveram a nota de benchmark revisada; um deles caiu quase 26%,Quatro notas de benchmark foram revisadas em um dia: o que muda na sua escolha,Quatro modelos reavaliados: Trinity Large Thinking perdeu 6,3 pontos de IQ,Reavaliação do dia derruba nota do Trinity Large Thinking em quase 26%,Quatro modelos reavaliados pelo Artificial Analysis em 22 de julho de 2026,Trinity Large Thinking cai de 24,5 para 18,2 na reavaliação do Artificial Analysis,Quatro notas de benchmark revisadas: Trinity Large Thinking foi o que mais caiu,Reavaliação do Artificial Analysis mexe em quatro modelos do catálogo,Quatro modelos tiveram a régua de benchmark movida pelo Artificial Analysis,Quatro reavaliações do Artificial Analysis em um só dia: o que muda na sua pilha

Trinity Large Thinking perdeu quase 26% da nota em uma só revisão; Gemma 4 E4B e DeepSeek V4 Flash também foram recalibrados.

Benchmarks

GLM-5.3-Flash estreia com 57,4 de IQ custando 105x menos que o topo

Seis modelos entraram no índice da Artificial Analysis hoje. O destaque é da Z.ai, que colocou um flash quase no top 5 por menos de um quarto de dólar por milhão de tokens de saída.

Benchmarks

Cinco modelos estreiam no índice, e o mais barato deles custa US$ 11,25

GPT-5.5 Instant e quatro variantes do K2 entram hoje na régua do Artificial Analysis, todas abaixo da marca de IQ 30.

Preços

OpenAI corta Sol pela metade e dobra Terra no mesmo dia

Movimento oposto dentro da mesma família deixa quem usa GPT-5.6 com escolha difícil entre preço e capacidade.