Kimi K3 assume liderança em dataviz e tira o trono do segundo colocado
Ranking de uso real mostra a chinesa MoonshotAI desbancando concorrentes em visualização de dados — enquanto Grok 4.6 oscila em pistas diferentes.
Você não compra benchmark, compra o que as pessoas efetivamente chamam de API. E nesta segunda-feira, o ranking de uso real trocou de dono na arena de dataviz: o Kimi K3, da chinesa MoonshotAI, saltou da segunda para a primeira posição, tomando o lugar de quem estava na frente até ontem.
O que mudou hoje
Olhando as movimentações do dia, o movimento mais relevante não é o único. São dez trocas de posição espalhadas por cinco arenas diferentes, e elas contam uma história em camadas.
Na arena models-dataviz, o Kimi K3 passou de 2º para 1º. É a única arena em que houve troca de líder nesta data — os outros rankings mantiveram o topo, mas redistribuíram o meio.
| Arena | Modelo | Posição antes | Posição depois |
|---|---|---|---|
| models-dataviz | Claude Opus 5 | 1º | 2º |
| models-uicomponent | Grok 4.6 | 3º | 5º |
| models-gamedev | Grok 4.6 | 5º | 4º |
| agents-mobileapps | Claude Opus 4.6 | 2º | 3º |
| models-gamedev | Muse Spark 1.2 | 4º | 5º |
| agents-mobileapps | Grok 4.5 | 5º | 6º |
| models-dataviz | Kimi K3 | 2º | 1º |
| models-asciiart | Gemini 3.1 Pro Preview | 4º | 5º |
| agents-mobileapps | Grok 4.6 | 3º | 2º |
| agents-androidnative | Claude Opus 4.7 | 5º | 4º |
Em agents-mobileapps, o Grok 4.6 subiu de 3º para 2º, enquanto o Claude Fable 5 caiu de 6º para 5º. Mesma arena, modelos brigando por faixas diferentes do pódio.
Em models-uicomponent, o Grok 4.6 despencou de 3º para 5º — duas posições em um único dia. É a queda mais expressiva entre todas as movimentações listadas. Já o Muse Spark 1.2 subiu de 5º para 4º na mesma arena.
Em models-asciiart, o Grok 4.5 caiu de 5º para 7º, e o Muse Spark 1.1 desceu de 2º para 3º — uma dança que abre espaço para o Claude Opus 4.7, que subiu de 3º para 4º.
Por fim, em agents-androidnative, o Claude Opus 4.7 também subiu, de 5º para 4º. É o único modelo da Anthropic em movimento nesta data — Opus 5 e Fable 5 aparecem no topo de inteligência, mas não mexem em ranking de uso hoje.
Kimi K3: o que está por trás do salto
Vale a pena parar no Kimi K3, porque é o único caso de troca de liderança. O modelo tem IQ 59,7 segundo o snapshot atual do catálogo — está em quinto lugar em inteligência geral, atrás de Claude Opus 5, Claude Fable 5, GPT-5.6 Sol e Grok 4.6. Não é o mais inteligente do catálogo. Mas custa US$ 15 por milhão de tokens de saída, contra US$ 25 do Opus 5 e US$ 50 do Fable 5.
Em dataviz, especificamente, esse equilíbrio de preço e capacidade parece ter virado a preferência dos usuários. Vale lembrar: ranking de uso mede o que as pessoas efetivamente chamam via API, não o que lidera em teste padronizado. É a diferença entre o carro que ganha a corrida e o carro que mais sai da concessionária.
Para quem isso importa — e para quem não
Importa se você está montando pipeline de geração de gráficos, dashboards ou qualquer visualização de dados automatizada. A escolha deixou de ser óbvia: até aqui, o topo de dataviz provavelmente era ocupado por um modelo americano premium. Agora tem uma alternativa chinesa custando 40% menos por token de saída que o Opus 5.
Também importa se você está olhando para o Grok 4.6. O modelo da xAI tem comportamento oposto em pistas diferentes: subiu em mobile apps, mas caiu em componentes de UI. Não é um veredito sobre qualidade — é sinal de que o modelo está sendo escolhido para tarefas específicas, não de forma uniforme.
Para quem está feliz com Opus 5 ou Fable 5 em tarefas de texto puro, nada muda. Eles não aparecem nos movimentos de hoje. Continuam no topo de inteligência e mantêm seus lugares nos rankings onde já eram fortes.
O tabuleiro nesta data
O catálogo tem mais de 549 modelos ainda listados, vindos de 68 criadores diferentes. Nos últimos 30 dias, 40 modelos foram lançados. O topo de inteligência segue dominado pela Anthropic (Opus 5 e Fable 5), seguida de OpenAI (GPT-5.6 Sol), xAI (Grok 4.6) e, em quinto, a chinesa MoonshotAI com o Kimi K3.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
A lição do dia não é "o chinês venceu". É que, em arenas específicas, o uso real responde a uma equação de preço e capacidade que nem sempre coincide com o topo do benchmark. E que essa equação muda todo dia.
Se você está decidindo modelo agora, vale rodar um teste curto de dataviz com Kimi K3 antes de renovar contrato — o sinal de hoje sugere que a comunidade de usuários já fez essa comparação e escolheu. Se você está em outra arena, espere o próximo movimento antes de mexer.
Quem gera dataviz via API deveria testar Kimi K3 antes do próximo ciclo de cobrança — a comunidade de usuários já migrou a preferência nesta segunda.
Perguntas frequentes
O que é a arena models-dataviz?
É uma das categorias de uso real tracked pelo catálogo: ranqueia os modelos mais chamados via API especificamente para tarefas de visualização de dados, como geração de gráficos e dashboards automatizados.
Por que o Kimi K3 subiu mesmo sem ser o mais inteligente?
Ranking de uso mede o que as pessoas chamam via API, não desempenho em benchmark. O Kimi K3 combina IQ 59,7 com preço de US$ 15 por milhão de tokens de saída — uma equação que fez a comunidade de dataviz migrar a preferência.
O Grok 4.6 está pior que antes?
Não necessariamente. Ele subiu em agents-mobileapps (3º para 2º) e caiu em models-uicomponent (3º para 5º). O comportamento sugere uso mais segmentado por tipo de tarefa, não uma piora generalizada.