FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Cinco SKUs do Sonnet 5 Adaptive Reasoning cobram US$ 6/M, só um tem nota

O índice do Artificial Analysis só cravou IQ para a variante Max Effort — 53,35, abaixo do Sonnet 5 padrão (55,26) que custa US$ 10/M.

Redação FalaVIP IA 3 min de leitura
US$ 6por milhão de tokens de saída nas cinco variantes
53,35IQ do Max Effort, única nota publicada entre os novos
US$ 3,04por milhão do Z.ai GLM 5.2, com IQ 52,64

Cinco SKUs do Claude Sonnet 5 Adaptive Reasoning entraram hoje no índice do Artificial Analysis marcados a US$ 6 por milhão de tokens de saída. Só um tem IQ publicado: a variante Max Effort, com 53,35 — abaixo dos 55,26 do Sonnet 5 padrão, que custa US$ 10/M. Os outros quatro (Low, Medium, High e Xhigh) entraram listados, sem nota.

A proposta do Adaptive Reasoning é ajustar, por chamada, quanto o modelo "pensa" antes de responder. Pense em um termostato na parede: a temperatura do ambiente é a mesma o dia inteiro, mas em algumas horas você liga o compressor no máximo e em outras deixa ele em modo econômico. Aqui o que muda é o esforço de raciocínio dentro do mesmo token de saída.

Onde o Max Effort cai na régua

O Sonnet 5 Max Effort, com 53,35 de IQ, entra entre o Z.ai GLM 5.2 (52,64) e o próprio Claude Sonnet 5 padrão (55,26, US$ 10/M). Acima de tudo continua o Claude Fable 5 da própria Anthropic, com 62,07 e tabela de US$ 50/M. Mais abaixo aparecem Gemini 3.1 Pro Preview (47,74, US$ 12/M) e Gemini 3.5 Flash (46,67, US$ 9/M).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Claude Sonnet 555.310
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
Entre os 480 modelos disponíveis no catálogo nesta data.

O detalhe que incomoda é direto: o Max Effort ficou abaixo do Sonnet 5 padrão. Você está pagando US$ 6 em vez de US$ 10 por milhão e levando, no benchmark, quase dois pontos de IQ a menos. A fatura melhora, a régua piora — ao menos na medição que temos hoje.

O preço que iguala cinco SKUs

A decisão da Anthropic de cobrar o mesmo pelas cinco variantes inverte a lógica usual. Em geral, mais inteligência custa mais: Fable 5 cobra US$ 50/M, Sonnet 5 padrão US$ 10/M, Gemini 3.1 Pro Preview US$ 12/M. A Anthropic está cobrando US$ 6/M em todos os níveis e empurrando o custo extra para o tempo de inferência do lado do provedor — Max Effort gasta mais GPU por requisição, mas o cliente paga o mesmo token.

O índice ainda não separa preço por esforço. Os quatro SKUs sem IQ publicado também estão marcados a US$ 6/M. Isso muda quando as próximas medições chegarem — e tende a mudar, porque a régua costuma cobrar caro de quem pular do Low direto pro Max.

A concorrência que o release da Anthropic não citou

Se você está acima da linha de IQ 45 e quer a melhor conta, a régua desta terça tem três alternativas por menos da metade do preço do Max Effort:

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Claude Sonnet 5 (Adaptive Re53.46.00
Claude Sonnet 5 (Adaptive Re6.00
Claude Sonnet 5 (Adaptive Re6.00
Claude Sonnet 5 (Adaptive Re6.00
Claude Sonnet 5 (Adaptive Re6.00
  • MiniMax M3: IQ 45,40, US$ 1,20 por milhão.
  • DeepSeek V4 Pro 0423: IQ 45,27, US$ 1,74 por milhão.
  • Z.ai GLM 5.2: IQ 52,64, US$ 3,04 por milhão.

O Sonnet 5 Max Effort, em 53,35, está 0,7 ponto acima do GLM 5.2 e cobra o dobro. Se o seu caso de uso não exige o ecossistema Anthropic nem algum selo regulatório que só ela entrega, a régua é fria: o GLM 5.2 entrega 99% da inteligência medida por metade do dólar.

Para quem muda, para quem não muda

Vale colocar essas cinco variantes na fila de testes se:

  • você já roda Sonnet 5 padrão e quer ver se Max Effort a US$ 6 dá conta da mesma carga de raciocínio longo — pode cortar até 40% da fatura em chamadas onde você pede cadeia de pensamento.
  • você precisa do mesmo modelo em latências diferentes — Low Effort provavelmente substitui chamadas rápidas de classificação e extração onde hoje você já nem liga o caminho longo.
  • seu sistema tem custo variável por chamada e dá para chavear Max Effort só quando a tarefa for complexa.

Não muda quase nada se:

  • você já roda Claude Fable 5 e usa Anthropic pelo topo — o Max Effort, em 53,35, é outra classe de produto.
  • você fatura abaixo de US$ 3/M em MiniMax M3, DeepSeek V4 Pro ou GLM 5.2 — esses SKUs a US$ 6 ficam mais caros para a mesma faixa de IQ 45-52.
  • você queria Low, Medium, High ou Xhigh com régua na mão — sem IQ publicado, é voto de confiança cego.

O índice do Artificial Analysis fechou o dia com 480 modelos ativos de 62 criadores e atualizou 26 deles nos últimos 30 dias. O Adaptive Reasoning chega para somar, mas a régua tem dono: até a próxima medição, o Sonnet 5 Max Effort a US$ 6/M é uma aposta de 53,35 pontos que custa o dobro do GLM 5.2.

Em uma frase

Se você já paga US$ 10/M no Sonnet 5 padrão, teste o Max Effort (US$ 6/M) nas chamadas longas; se fatura abaixo de US$ 3/M em GLM 5.2 ou similar, ignore essa estreia — a régua não muda seu cenário.

Perguntas frequentes

O que é o Claude Sonnet 5 Adaptive Reasoning?

É uma versão do Sonnet 5 da Anthropic lançada em cinco SKUs (Low, Medium, High, Xhigh e Max Effort) que ajustam, por chamada, quanto o modelo gasta em raciocínio. Todos cobram o mesmo preço de tabela (US$ 6 por milhão de tokens de saída); o que muda é o custo de inferência do lado da Anthropic.

Vale trocar o Sonnet 5 padrão pelo Adaptive Reasoning Max Effort?

Depende do tipo de chamada. Se você roda Sonnet 5 padrão a US$ 10/M e usa cadeia de pensamento em parte do tráfego, o Max Effort pode entregar inteligência próxima (53,35 contra 55,26 no índice) por 40% menos. Se a maior parte das chamadas é simples, o ganho de régua não compensa a troca.

Qual modelo entrega mais inteligência por real gasto acima de IQ 45?

Hoje, na régua do Artificial Analysis, o Z.ai GLM 5.2 lidera: IQ 52,64 a US$ 3,04 por milhão. Logo abaixo vêm MiniMax M3 (45,40 a US$ 1,20) e DeepSeek V4 Pro 0423 (45,27 a US$ 1,74) — todos mais baratos que o Sonnet 5 Max Effort.

Leia também