FalaVIP IA sexta-feira, 04 de setembro de 2026
Benchmarks

GPT-6 Astra chega a 61,2, mas custa US$ 20

O novo modelo entra entre os melhores resultados do Artificial Analysis, mas não lidera o ranking. Para quem paga a API, a diferença de preço frente a alternativas mais baratas é o ponto central.

Redação FalaVIP IA 3 min de leitura
61,2pontuação de IQ do GPT-6 Astra (max)
US$ 20preço associado à configuração no Artificial Analysis
65,7pontuação do líder Claude Fable 5.1 (max)

O GPT-6 Astra estreou no Artificial Analysis com pontuação de 61,2 no índice de IQ, mas o preço associado à configuração é de US$ 20 por milhão de tokens. A entrada coloca o modelo no grupo de ponta, não no primeiro lugar: o Claude Fable 5.1 (max) lidera com 65,7, enquanto o Muse Spark 1.3 (max) aparece com 62,1.

Para você que escolhe modelo para produção, a notícia não é simplesmente “um novo líder chegou”. O Astra oferece um resultado alto no benchmark, mas cobra o mesmo valor listado para todas as configurações avaliadas no índice. A comparação de custo-benefício, portanto, começa desfavorável diante de modelos que chegam perto — ou, em alguns casos, ultrapassam — sua pontuação por uma fração do preço.

O que o benchmark mostra

O Artificial Analysis registrou cinco configurações do GPT-6 Astra. O modo max marcou 61,2; xhigh, 61; high, 60,3; medium, 59,2; low, 56,7; e a versão Non-reasoning, 55,3. Todas aparecem com preço de US$ 20 no índice.

Isso cria uma diferença importante entre desempenho máximo e desempenho operacional. Se você selecionar low ou medium para reduzir latência, consumo computacional ou tempo de resposta, o índice ainda mostra uma queda de pontuação. O preço associado, porém, não muda entre as configurações listadas.

O resultado máximo do Astra supera o Muse Spark 1.3 xhigh, que marcou 60,8, e todas as configurações registradas do Gemini 3.8 Flash, cujo melhor resultado foi 58,7. Ainda assim, o Muse Spark 1.3 max, com 62,1, fica à frente do Astra.

A conta no OpenRouter muda a leitura

Os preços do OpenRouter colocam a comparação em outra escala. O Muse Spark 1.3 custa US$ 1,25 por milhão de tokens de entrada e US$ 4,25 por milhão de tokens de saída. O Gemini 3.8 Flash custa US$ 0,75 na entrada e US$ 3,75 na saída.

Esses valores não são apresentados da mesma forma que o preço associado às estreias no Artificial Analysis. Por isso, não dá para tratar os US$ 20 do Astra como se fossem automaticamente uma tarifa de entrada ou de saída no OpenRouter. O que os dados permitem afirmar é que o Astra aparece no índice com custo fixo de US$ 20, enquanto os concorrentes têm tarifas de API detalhadas no OpenRouter e bem menores nos modelos recém-lançados.

O Gemini também oferece uma opção batch por US$ 0,375 por milhão de tokens de entrada e US$ 1,875 por milhão de tokens de saída. O Muse Spark 1.3 Contributor aparece por US$ 0,10 na entrada e US$ 0,20 na saída, mas não tem pontuação de IQ registrada. Não é uma comparação direta de inteligência; é uma alternativa de custo para cargas em que o benchmark não está disponível.

O topo ainda é mais caro — ou não

O Claude Fable 5.1 lidera o ranking do Artificial Analysis com 65,7 e preço associado de US$ 20. A ficha do modelo no OpenRouter lista US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, além de janela de contexto de 1.000.000 de tokens.

O Claude Opus 5 aparece com 63,1 no Artificial Analysis e preço associado de US$ 10. No OpenRouter, sua tarifa é de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. Esses números mostram por que o Astra não deve ser avaliado apenas pela posição no ranking: a tarifa real depende do provedor, da direção dos tokens e do fluxo usado pela aplicação.

Para quem o Astra faz sentido

O GPT-6 Astra interessa a equipes que precisam testar desempenho de topo e aceitam pagar US$ 20 na configuração de referência do benchmark. Também pode entrar na avaliação de produtos em que alguns pontos de IQ justificam custo maior, desde que o resultado apareça nos testes internos com as tarefas reais da empresa.

Para quem opera alto volume, faz classificação, extração, atendimento ou automações sensíveis à fatura, a estreia muda menos. Muse Spark 1.3, Gemini 3.8 Flash e opções batch oferecem preços de API mais claros e menores no OpenRouter. Modelos listados entre os melhores em custo-benefício pelo Artificial Analysis, como GLM-5.3-Flash, com IQ de 57,5 e preço associado de US$ 0,238, também entram na disputa.

A decisão prática é comparar o custo por tarefa concluída, não o lugar isolado no ranking. Antes de trocar o modelo em produção, rode o seu conjunto de prompts no Astra e confronte o ganho de qualidade com a tarifa que chegará à fatura.

Em uma frase

O GPT-6 Astra merece entrar no teste de modelos avançados, mas o preço de US$ 20 só se justifica se o ganho sobre alternativas mais baratas aparecer na sua carga real.

Perguntas frequentes

Qual foi a pontuação do GPT-6 Astra no Artificial Analysis?

A configuração GPT-6 Astra (max) marcou 61,2 no índice de IQ do Artificial Analysis. A versão xhigh marcou 61, enquanto high ficou em 60,3.

Quanto custa o GPT-6 Astra?

O GPT-6 Astra aparece com preço associado de US$ 20 no Artificial Analysis, em todas as configurações registradas. Os dados disponíveis não detalham uma tarifa de entrada e saída do Astra no OpenRouter.

O GPT-6 Astra é o modelo mais inteligente do ranking?

Não. O Claude Fable 5.1 (max) lidera com 65,7, e o Muse Spark 1.3 (max) aparece com 62,1. O Astra entra entre os melhores resultados, mas não ocupa o primeiro lugar.

Leia também

Preços

Kimi K2.5 cai 25%, mas DeepSeek V4 Pro encarece

O OpenRouter registra cortes para Kimi K2.5 e Llama 4 Maverick, enquanto o Apodex 1.1 estreia no índice com IQ 44. O movimento do DeepSeek mostra que o preço do dia pode esconder uma sequência instável.

Benchmarks

Quatro modelos do catálogo tiveram a nota de benchmark revisada; um deles caiu quase 26%,Quatro notas de benchmark foram revisadas em um dia: o que muda na sua escolha,Quatro modelos reavaliados: Trinity Large Thinking perdeu 6,3 pontos de IQ,Reavaliação do dia derruba nota do Trinity Large Thinking em quase 26%,Quatro modelos reavaliados pelo Artificial Analysis em 22 de julho de 2026,Trinity Large Thinking cai de 24,5 para 18,2 na reavaliação do Artificial Analysis,Quatro notas de benchmark revisadas: Trinity Large Thinking foi o que mais caiu,Reavaliação do Artificial Analysis mexe em quatro modelos do catálogo,Quatro modelos tiveram a régua de benchmark movida pelo Artificial Analysis,Quatro reavaliações do Artificial Analysis em um só dia: o que muda na sua pilha

Trinity Large Thinking perdeu quase 26% da nota em uma só revisão; Gemma 4 E4B e DeepSeek V4 Flash também foram recalibrados.

Lançamentos

Duas IAs de 1 milhão de tokens chegam, mas a conta diverge

Meta Muse Spark 1.3 e Google Gemini 3.8 Flash ampliam a oferta de modelos com contexto longo. O Google começa em US$ 0,75 por milhão de tokens de entrada, enquanto a Meta entrega índices ligeiramente superiores em alguns testes por preço maior.

Preços

DeepSeek registra altas de até 100% e reversões de preço

Registros de tarifas no OpenRouter mostram movimentos em direções opostas para os mesmos modelos em 2 dias. Para quem usa API em produção, o risco está menos no preço anunciado e mais na instabilidade do planejamento.