GPT-6 Astra estreia com 1,05 milhão de tokens, mas custa caro
O novo modelo da OpenAI chega com janela de contexto gigantesca e operação batch pela metade do preço. Nos índices, porém, a estreia aparece com notas diferentes — e o preço de benchmark não coincide com o catálogo de API.
Se você usa um modelo em produção, o número que mais importa na estreia do GPT-6 Astra não é a nota de inteligência: é o preço de saída. O modelo custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída no OpenRouter. A versão batch reduz os valores para US$ 5 e US$ 25, respectivamente.
A OpenAI lançou o GPT-6 Astra e o GPT-6 Astra Pro em 4 de setembro. Os dois aparecem no OpenRouter com a mesma tabela de preços e a mesma janela de contexto de 1,05 milhão de tokens. A apresentação oficial “GPT-6 Astra with Ben Davis” foi publicada pela OpenAI no YouTube.
O espaço em enxame não aparece como desconto na conta
A ideia central da estreia técnica é a execução paralela: dividir uma tarefa entre agentes ou processos e coordenar o resultado em uma arquitetura multiagente. Para quem constrói software, isso pode ser mais importante do que uma melhora marginal em perguntas de benchmark.
Mas a conta não fica automaticamente menor porque a execução é paralela. Se uma tarefa dispara várias chamadas, cada chamada consome tokens. O catálogo do OpenRouter não apresenta um preço separado para “enxame”, agentes paralelos ou coordenação multiagente. O que existe é uma tarifa convencional e uma alternativa batch, com preço pela metade.
Também não há, nas fichas consultadas, uma nota preenchida para capacidade agêntica, programação ou velocidade de tokens do GPT-6 Astra. Isso limita a conclusão: a arquitetura pode ser relevante para fluxos com muitas etapas, mas os dados disponíveis não medem quantos agentes o modelo sustenta, quanto tempo economiza ou qual é o custo total de uma execução distribuída.
Janela de 1,05 milhão muda o desenho do produto
A janela de contexto coloca o Astra em uma faixa voltada a cargas longas. Você pode manter mais documentação, histórico de tarefas ou material de análise em uma mesma interação, sem dividir tudo em chamadas menores tão cedo.
Esse ganho é especialmente útil para sistemas que trabalham com bases extensas, revisão de código, planejamento de tarefas e coordenação de ferramentas. Ainda assim, contexto amplo não é sinônimo de custo baixo. A entrada custa US$ 10 por milhão de tokens no modelo principal, enquanto a saída custa cinco vezes mais.
O cache aparece a US$ 1 por milhão de tokens no GPT-6 Astra e no Astra Pro. No batch, o cache custa US$ 0,50 por milhão. Para quem repete instruções longas, o cache pode pesar mais na arquitetura financeira do que a diferença entre os modelos, mas a economia real depende do padrão de reutilização.
A nota de inteligência depende do índice
O Artificial Analysis registrou seis configurações do GPT-6 Astra na estreia. A versão max marcou 61,2, seguida pela xhigh, com 61, e pela high, com 60,3. As configurações medium, low e non-reasoning ficaram em 59,2, 56,7 e 55,3.
Há uma divergência importante dentro dos próprios registros. Na lista de estreias do Artificial Analysis, o Astra max aparece com 61,2. Já no topo de inteligência, o mesmo nome aparece com 54,7, atrás do Claude Fable 5.1, com 56,8. O Astra xhigh também cai de 61 para 54,3 nessa outra visão.
Portanto, não dá para transformar a primeira nota em uma afirmação simples de liderança. Os índices usam recortes diferentes, e o leitor precisa saber qual ranking está sendo citado antes de comparar modelos.
Também há uma divergência de preço: o Artificial Analysis lista as configurações avaliadas a US$ 20 por milhão, enquanto o OpenRouter mostra US$ 10 para entrada e US$ 50 para saída. Não são grandezas equivalentes. O preço de benchmark não informa sozinho quanto uma aplicação pagará por entrada e saída.
Para quem vale e para quem não muda nada
O Astra faz sentido para você se o produto depende de tarefas longas, planejamento em múltiplas etapas ou coordenação de agentes e aceita pagar por uma saída premium. O batch é mais adequado para processamento assíncrono, quando a resposta não precisa voltar imediatamente.
Para um chatbot curto, classificação simples ou geração de texto em grande volume, a estreia muda pouco. O catálogo também lista alternativas bem mais baratas, como o Qwen3.5 Plus, com entrada entre US$ 0,26 e US$ 0,30 por milhão e saída entre US$ 1,56 e US$ 1,80, além de modelos com melhor relação entre nota e preço no Artificial Analysis.
A consequência prática é direta: antes de trocar para o GPT-6 Astra, estime quantas chamadas paralelas cada tarefa fará e separe o custo de entrada do custo de saída. A arquitetura multiagente pode acelerar seu produto, mas, sem controle de fan-out e sem uso de batch quando possível, também pode acelerar a fatura.
Use o GPT-6 Astra para fluxos longos e multiagente com orçamento controlado; para tarefas curtas, o preço de saída de US$ 50 por milhão torna a troca difícil de justificar.
Perguntas frequentes
Quanto custa o GPT-6 Astra no OpenRouter?
O GPT-6 Astra custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A versão batch custa US$ 5 na entrada e US$ 25 na saída.
Qual é a janela de contexto do GPT-6 Astra?
A janela de contexto é de 1,05 milhão de tokens no GPT-6 Astra e no GPT-6 Astra Pro. As versões batch mantêm a mesma capacidade.
O GPT-6 Astra é o modelo mais inteligente?
Depende do índice consultado. O Artificial Analysis registra 61,2 para a configuração max na lista de estreias, mas mostra 54,7 para ela no topo de inteligência, abaixo do Claude Fable 5.1, com 56,8.
Fontes
- GPT-6 Astra with Ben Davis OpenAI (oficial) · vídeo