Opus 5 toma o topo em dataviz; Fable 5 recua em agents fullstack
Anthropic ganha em uma arena e perde em outra no mesmo dia de atualização do ranking de uso real por categoria. Grok, GLM e Kimi também mexem no tabuleiro.
A Anthropic abriu a semana com uma vitória e uma derrota no mesmo dia — e a combinação diz mais do que qualquer um dos dois resultados isolados. Claude Opus 5 subiu da segunda para a primeira posição em models-dataviz, tomando a liderança que era de outro modelo. Ao mesmo tempo, Claude Fable 5 caiu da segunda para a quarta posição em agents-fullstack, uma das arenas mais disputadas do catálogo.
O detalhe que incomoda é o preço. Opus 5 cobra US$ 25 por milhão de tokens de saída; Fable 5 cobra US$ 50 — o dobro. Em outras palavras: o modelo da família Claude que lidera a arena de visualização de dados cobra metade do que o irmão cobra em outra arena onde ele próprio está recuando.
A nova liderança em dataviz
Opus 5 aparece com IQ 63.053 no snapshot de hoje — o mais alto entre os mais de 549 modelos do catálogo, à frente do próprio Fable 5 (62.073), do GPT-5.6 Sol (60.93) e do Grok 4.6 (60.923). Quem trabalha com geração de gráficos, painéis e visualizações interativas tem agora uma referência concreta: Opus 5 é o que está sendo escolhido em produção por outros desenvolvedores nessa arena específica. O benchmark geral aponta na mesma direção, mas aqui a decisão é dos usuários, não dos testadores.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
Fable 5 perde fôlego em agents fullstack
A queda de Fable 5 em agents-fullstack é o contraponto. Pagar US$ 50 por milhão de tokens de saída para um modelo que está recuando de segundo para quarto lugar em uma arena onde o trabalho é fazer a IA operar ferramentas, chamar APIs e manter contexto longo é um sinal de alerta — não de alarme. Estamos olhando uso real, preferências de quem está pagando a fatura. O segundo lugar passou a ser ocupado por outro modelo; o terceiro e o quarto também mudaram.
| Arena | Modelo | Posição antes | Posição depois |
|---|---|---|---|
| models-uicomponent | Grok 4.6 | 2º | 3º |
| models-asciiart | Grok 4.5 | 6º | 5º |
| models-website | Muse Spark 1.2 | 2º | 3º |
| agents-fullstack | Claude Opus 4.8 | 5º | 7º |
| models-svg | Claude Fable 5 | 3º | 2º |
| models-uicomponent | Claude Opus 5 | 3º | 2º |
| agents-fullstack | Grok 4.5 | 4º | 6º |
| agents-fullstack | Grok 4.6 | 3º | 5º |
| models-codecategories | GLM 5.2 | 6º | 5º |
| models-codecategories | Grok 4.6 | 5º | 6º |
Grok 4.6 em dois campos
O SpaceXAI Grok 4.6 teve um dia misto. Saiu do segundo lugar em agents-mobileapps e em models-uicomponent — ambos movimentos de 2 para 3, trocando o pódio pelo degrau imediatamente abaixo. Mas em models-3d caiu de 5 para 7, dois degraus abaixo. A leitura honesta: Grok 4.6 está sendo preferido para interfaces e apps móveis, mas está perdendo terreno para geração 3D. A US$ 6 por milhão de tokens de saída, segue entre os mais baratos do topo por IQ.
O irmão mais velho, Grok 4.5, subiu da terceira para a segunda posição em agents-godotgamedev — desenvolvimento de jogos com a engine Godot. O catálogo não publicou o preço dele neste snapshot; detalhe curioso: o modelo mais antigo da família reconquistou terreno em uma arena de nicho.
GLM 5.2 e Kimi K3
A GLM 5.2 também mexeu no tabuleiro. Subiu da sexta para a quinta posição em models-3d e em models-codecategories no mesmo dia — dois movimentos paralelos de quem está consolidando presença em áreas técnicas onde antes era coadjuvante.
Do outro lado, Kimi K3 (MoonshotAI) caiu da segunda para a terceira posição em models-svg. Pequeno recuo, mas tira o modelo do pódio em uma arena específica.
Para quem isso muda alguma coisa
Se você gera gráficos, dashboards ou visualizações de dados: Claude Opus 5 é a escolha dominante no uso real hoje. O preço de US$ 25 por milhão de tokens de saída é alto, mas é o que está pagando o pato da preferência. Se seu produto é agent fullstack — IA que opera ferramentas e APIs — Fable 5 deixou de ser a referência; vale testar quem tomou as posições 1, 2 e 3 antes de assinar.
Para 3D e categorias de código, a GLM 5.2 está virando a aposta de quem busca consistência em áreas técnicas. Para Godot e jogos, o Grok 4.5 voltou ao pódio. Para SVG e ícones vetoriais, Kimi K3 perdeu o segundo lugar.
A lição geral é a de sempre, mas com um número a mais hoje: o ranking geral de IQ não prevê quem lidera cada arena. Em 15 de agosto de 2026, com mais de 549 modelos listados no catálogo vindos de 68 criadores diferentes e 44 lançamentos nos últimos 30 dias, a distância entre o melhor benchmark e o mais usado em produção continua crescendo — e a fatura do mês segue sendo o termômetro mais honesto que existe.
Dataviz hoje é Opus 5; agents fullstack, vale testar os novos top 3 antes de continuar pagando US$ 50 por milhão no Fable 5.
Perguntas frequentes
Qual é o melhor modelo para gerar gráficos e dashboards em agosto de 2026?
Pelo ranking de uso real, Claude Opus 5 tomou a primeira posição na arena models-dataviz em 15 de agosto de 2026. É também o modelo com maior IQ do catálogo (63.053) no snapshot de hoje, custando US$ 25 por milhão de tokens de saída.
Por que Claude Fable 5 caiu em agents-fullstack?
Fable 5 saiu da segunda para a quarta posição em agents-fullstack no mesmo dia em que Opus 5 subiu ao topo em dataviz. Fable 5 custa US$ 50 por milhão de tokens de saída — o dobro do Opus 5 — e a queda sugere migração dos usuários para alternativas mais baratas na arena de agentes.
Como decidir entre Claude Opus 5 e Claude Fable 5?
Depende da arena. Opus 5 lidera dataviz a US$ 25 por milhão; Fable 5, mais caro a US$ 50, está perdendo terreno em agents-fullstack. Para agents, vale testar quem tomou as três primeiras posições antes de assinar Fable 5.