FalaVIP IA quinta-feira, 03 de setembro de 2026
Mercado

Kimi K3 assume liderança em dataviz e tira o trono do segundo colocado

Ranking de uso real mostra a chinesa MoonshotAI desbancando concorrentes em visualização de dados — enquanto Grok 4.6 oscila em pistas diferentes.

Redação FalaVIP IA 3 min de leitura
549modelos ainda listados no catálogo
68criadores diferentes no catálogo
US$ 15por milhão de tokens de saída do Kimi K3

Você não compra benchmark, compra o que as pessoas efetivamente chamam de API. E nesta segunda-feira, o ranking de uso real trocou de dono na arena de dataviz: o Kimi K3, da chinesa MoonshotAI, saltou da segunda para a primeira posição, tomando o lugar de quem estava na frente até ontem.

O que mudou hoje

Olhando as movimentações do dia, o movimento mais relevante não é o único. São dez trocas de posição espalhadas por cinco arenas diferentes, e elas contam uma história em camadas.

Na arena models-dataviz, o Kimi K3 passou de 2º para 1º. É a única arena em que houve troca de líder nesta data — os outros rankings mantiveram o topo, mas redistribuíram o meio.

Movimentações no ranking de uso
ArenaModeloPosição antesPosição depois
models-datavizClaude Opus 5
models-uicomponentGrok 4.6
models-gamedevGrok 4.6
agents-mobileappsClaude Opus 4.6
models-gamedevMuse Spark 1.2
agents-mobileappsGrok 4.5
models-datavizKimi K3
models-asciiartGemini 3.1 Pro Preview
agents-mobileappsGrok 4.6
agents-androidnativeClaude Opus 4.7
Ranking de uso real do OpenRouter por categoria de tarefa.

Em agents-mobileapps, o Grok 4.6 subiu de 3º para 2º, enquanto o Claude Fable 5 caiu de 6º para 5º. Mesma arena, modelos brigando por faixas diferentes do pódio.

Em models-uicomponent, o Grok 4.6 despencou de 3º para 5º — duas posições em um único dia. É a queda mais expressiva entre todas as movimentações listadas. Já o Muse Spark 1.2 subiu de 5º para 4º na mesma arena.

Em models-asciiart, o Grok 4.5 caiu de 5º para 7º, e o Muse Spark 1.1 desceu de 2º para 3º — uma dança que abre espaço para o Claude Opus 4.7, que subiu de 3º para 4º.

Por fim, em agents-androidnative, o Claude Opus 4.7 também subiu, de 5º para 4º. É o único modelo da Anthropic em movimento nesta data — Opus 5 e Fable 5 aparecem no topo de inteligência, mas não mexem em ranking de uso hoje.

Kimi K3: o que está por trás do salto

Vale a pena parar no Kimi K3, porque é o único caso de troca de liderança. O modelo tem IQ 59,7 segundo o snapshot atual do catálogo — está em quinto lugar em inteligência geral, atrás de Claude Opus 5, Claude Fable 5, GPT-5.6 Sol e Grok 4.6. Não é o mais inteligente do catálogo. Mas custa US$ 15 por milhão de tokens de saída, contra US$ 25 do Opus 5 e US$ 50 do Fable 5.

Em dataviz, especificamente, esse equilíbrio de preço e capacidade parece ter virado a preferência dos usuários. Vale lembrar: ranking de uso mede o que as pessoas efetivamente chamam via API, não o que lidera em teste padronizado. É a diferença entre o carro que ganha a corrida e o carro que mais sai da concessionária.

Para quem isso importa — e para quem não

Importa se você está montando pipeline de geração de gráficos, dashboards ou qualquer visualização de dados automatizada. A escolha deixou de ser óbvia: até aqui, o topo de dataviz provavelmente era ocupado por um modelo americano premium. Agora tem uma alternativa chinesa custando 40% menos por token de saída que o Opus 5.

Também importa se você está olhando para o Grok 4.6. O modelo da xAI tem comportamento oposto em pistas diferentes: subiu em mobile apps, mas caiu em componentes de UI. Não é um veredito sobre qualidade — é sinal de que o modelo está sendo escolhido para tarefas específicas, não de forma uniforme.

Para quem está feliz com Opus 5 ou Fable 5 em tarefas de texto puro, nada muda. Eles não aparecem nos movimentos de hoje. Continuam no topo de inteligência e mantêm seus lugares nos rankings onde já eram fortes.

O tabuleiro nesta data

O catálogo tem mais de 549 modelos ainda listados, vindos de 68 criadores diferentes. Nos últimos 30 dias, 40 modelos foram lançados. O topo de inteligência segue dominado pela Anthropic (Opus 5 e Fable 5), seguida de OpenAI (GPT-5.6 Sol), xAI (Grok 4.6) e, em quinto, a chinesa MoonshotAI com o Kimi K3.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 549 modelos disponíveis no catálogo nesta data.

A lição do dia não é "o chinês venceu". É que, em arenas específicas, o uso real responde a uma equação de preço e capacidade que nem sempre coincide com o topo do benchmark. E que essa equação muda todo dia.

Se você está decidindo modelo agora, vale rodar um teste curto de dataviz com Kimi K3 antes de renovar contrato — o sinal de hoje sugere que a comunidade de usuários já fez essa comparação e escolheu. Se você está em outra arena, espere o próximo movimento antes de mexer.

Em uma frase

Quem gera dataviz via API deveria testar Kimi K3 antes do próximo ciclo de cobrança — a comunidade de usuários já migrou a preferência nesta segunda.

Perguntas frequentes

O que é a arena models-dataviz?

É uma das categorias de uso real tracked pelo catálogo: ranqueia os modelos mais chamados via API especificamente para tarefas de visualização de dados, como geração de gráficos e dashboards automatizados.

Por que o Kimi K3 subiu mesmo sem ser o mais inteligente?

Ranking de uso mede o que as pessoas chamam via API, não desempenho em benchmark. O Kimi K3 combina IQ 59,7 com preço de US$ 15 por milhão de tokens de saída — uma equação que fez a comunidade de dataviz migrar a preferência.

O Grok 4.6 está pior que antes?

Não necessariamente. Ele subiu em agents-mobileapps (3º para 2º) e caiu em models-uicomponent (3º para 5º). O comportamento sugere uso mais segmentado por tipo de tarefa, não uma piora generalizada.

Leia também