FalaVIP IA quinta-feira, 03 de setembro de 2026
Benchmarks

Grok 4.6 entra em três sabores no índice e cobra US$ 3 em todos

Versões xhigh, medium e low estreiam no Artificial Analysis com notas de inteligência entre 51 e 60; Qwen3.8 27B e o compacto LFM2.5-2.6B completam a leva.

Redação FalaVIP IA 3 min de leitura
US$ 3,00por milhão de tokens de saída em qualquer versão do Grok 4.6
60,014IQ do Grok 4.6 (xhigh), a 4ª nota mais alta do índice
10,987IQ do LFM2.5-2.6B, o modelo mais barato da leva

Seis modelos entraram hoje no índice do Artificial Analysis, e a história não é a estreia de um novo campeão — é a estréia de um mesmo modelo repetido três vezes na régua, cobrando o mesmo preço nos três lugares.

Três Grok pelo preço de um

O Grok 4.6 aparece em três variantes: xhigh, medium e low. O que muda é a nota de inteligência; o que não muda é a conta. Os três custam US$ 3 por milhão de tokens de saída.

Modelos que estrearam no índice
ModeloÍndice de inteligênciaPreço combinado US$/M
Grok 4.6 (xhigh)60.03.00
Grok 4.6 (medium)59.03.00
Grok 4.6 (low)51.73.00
Qwen3.8 27B (medium)44.51.13
Qwen3.8 27B (low)42.91.13
LFM2.5-2.6B11.00.00

A versão xhigh cravou IQ 60,014 — a quarta maior nota do índice hoje, atrás de Claude Opus 5 (63,053), Claude Fable 5 (62,073) e GPT-5.6 Sol (60,93). A medium ficou em 59,006, encostando no top 5 do catálogo. A low despencou para 51,68 — ainda acima da média, mas já longe do pódio.

Traduzindo o marketing: a xAI não está vendendo três modelos diferentes, está vendendo o mesmo modelo em três regimes de esforço computacional pelo mesmo preço. Para o desenvolvedor, isso significa que o "xhigh" não é um upgrade — é uma configuração que cabe no mesmo orçamento da "low".

Qwen3.8 27B: o meio-termo chinês

A Alibaba/Qwen entra com duas variantes do Qwen3.8 27B, medium e low, ambas a US$ 1,125 por milhão de tokens de saída. A medium marcou IQ 44,454; a low, 42,868.

Índice de inteligência das estreias
Grok 4.6 (xhigh)60Grok 4.6 (medium)59Grok 4.6 (low)51,7Qwen3.8 27B (medium)44,5Qwen3.8 27B (low)42,9LFM2.5-2.6B11índice

Para um modelo de 27 bilhões de parâmetros, esses números colocam o Qwen3.8 numa faixa intermediária do índice — útil para tarefas que não precisam de raciocínio pesado, mas distante do top 5. O preço, porém, é quase três vezes menor que o do Grok 4.6. É a conta que decide.

LFM2.5-2.6B: o chão do índice

O LFM2.5-2.6B é o ponto mais curioso da leva. O catálogo não publicou preço de saída — aparece como zero nos dados, o que provavelmente indica publicação não divulgada ou modelo gratuito/distribuído sob outra lógica. A nota de IQ é 10,987, a mais baixa entre os seis estreantes e uma das menores do catálogo de 557 modelos.

Não é um modelo para competir com Claude Opus 5; é um modelo para rodar onde Claude Opus 5 não roda — dispositivo de borda, prototipagem rápida, volume massivo de chamadas simples. Para quem precisa de "algo que responda em milissegundos e não estoure a fatura", ele existe. Para quem precisa de raciocínio, não.

Onde isso te coloca no tabuleiro

O topo do índice hoje continua intocado pelas estreias: Claude Opus 5 lidera com IQ 63,053 a US$ 25 por milhão de tokens de saída; Claude Fable 5 vem em segundo com IQ 62,073 a US$ 50; GPT-5.6 Sol fecha o pódio com IQ 60,93 a US$ 10.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 557 modelos disponíveis no catálogo nesta data.

A referência de custo-benefício segue sendo o DeepSeek V4 Flash 0731: IQ 51,767 por US$ 0,18 por milhão de tokens de saída. Em outras palavras, dá para comprar quase 17 milhões de tokens de DeepSeek pelo preço de 1 milhão de Grok 4.6 xhigh — com nota de inteligência 8 pontos menor, mas suficiente para a maioria das aplicações de produção.

Para quem vale cada um

  • Grok 4.6 xhigh (IQ 60, US$ 3): vale se você quer uma das quatro melhores notas do índice e topa pagar 17 vezes mais que o DeepSeek para chegar lá.
  • Grok 4.6 medium (IQ 59, US$ 3): vale se você quer top 6 do índice pelo mesmo preço da versão xhigh — não há motivo para pagar xhigh se medium resolve.
  • Grok 4.6 low (IQ 51, US$ 3): não vale pelo preço; com IQ 51 você consegue o mesmo do DeepSeek por uma fração.
  • Qwen3.8 27B medium (IQ 44, US$ 1,125): vale se você precisa de algo intermediário e quer pagar metade do Grok.
  • Qwen3.8 27B low (IQ 42, US$ 1,125): vale menos que a medium pelo mesmo preço — não faz sentido.
  • LFM2.5-2.6B (IQ 10, preço não publicado): vale se o seu caso de uso é volume extremo e baixa exigência.

A implicação prática: se você está rodando o Grok 4.6 na versão xhigh e a medium resolve seu caso, você está queimando dinheiro sem ganho. Se está na low, está pagando caro de um jeito que o DeepSeek resolve mais barato.

Em uma frase

Se for usar Grok 4.6, escolha medium em vez de xhigh pelo mesmo preço; se a low já resolve, troque por DeepSeek V4 Flash e corte a fatura.

Perguntas frequentes

Qual a diferença entre Grok 4.6 xhigh, medium e low?

É o mesmo modelo rodando em três níveis de esforço computacional. O preço é idêntico (US$ 3 por milhão de tokens de saída); o que muda é a nota de inteligência — 60,014 na xhigh, 59,006 na medium e 51,68 na low.

O Grok 4.6 xhigh é o melhor modelo do índice?

Não. Ele é o quarto colocado, com IQ 60,014, atrás de Claude Opus 5 (63,053), Claude Fable 5 (62,073) e GPT-5.6 Sol (60,93).

Leia também