FalaVIP IA o que os modelos custam,
medido todo dia
Mercado

Cursor em disputa: a conta do GPT-6 Astra chega a US$ 50

A restrição atribuída ao editor de código pode redistribuir chamadas entre provedores, mas os dados de preços mostram uma barreira clara: o novo modelo da OpenAI custa muito mais que alternativas disponíveis.

Redação FalaVIP IA 4 min de leitura
US$ 50por milhão de tokens de saída do GPT-6 Astra
1,05 milhãode tokens na janela de contexto do GPT-6 Astra
US$ 0por milhão de tokens de entrada e saída do Ling 3.0 Flash Sante gratuito

Se você usa modelos em um editor de código, a disputa de distribuição pode importar tanto quanto a qualidade do modelo. Mas a conta disponível em 5 de setembro mostra uma tensão: o GPT-6 Astra, lançado pela OpenAI em 4 de setembro, custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída no OpenRouter. A versão batch reduz os valores para US$ 5 e US$ 25, respectivamente.

Isso cria espaço para que um editor como o Cursor direcione parte das chamadas a outros provedores. O ponto decisivo não é apenas quem tem o melhor modelo. É quanto custa manter agentes lendo repositórios, executando tarefas e produzindo respostas longas durante todo o mês.

A discussão foi levantada por Paula Bernardes no vídeo "Using Technology Is Starting to Mean Choosing Who You Rely On". Os dados disponíveis, porém, não confirmam os detalhes sobre uma aquisição do Cursor nem sobre um bloqueio de modelos da OpenAI. O que eles mostram é a estrutura econômica que torna esse redirecionamento plausível.

OpenAI oferece capacidade, mas cobra pelo volume

O GPT-6 Astra e o GPT-6 Astra Pro aparecem no OpenRouter com a mesma tabela: US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. Ambos têm janela de contexto de 1,05 milhão de tokens.

Para uma aplicação que apenas responde perguntas curtas, essa diferença pode não dominar a fatura. Em um agente de programação, porém, a saída tende a crescer: há planos, explicações, correções, comandos e revisões. Nesse cenário, cada milhão de tokens gerados pesa mais que o contexto máximo anunciado.

O modo batch corta os preços pela metade. O GPT-6 Astra Batch e o Astra Pro Batch custam US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. A economia só ajuda se o fluxo aceitar processamento em lote. Uma sessão interativa dentro do editor não pode simplesmente ser tratada como uma tarefa assíncrona.

O Artificial Analysis registrou a estreia de variantes do Astra com notas de inteligência entre 55,3 e 61,2, todas associadas a um preço de referência de US$ 20 por milhão de tokens no índice. Essa apresentação não substitui a tabela do OpenRouter: uma fonte exibe preço de referência do benchmark, enquanto a outra separa entrada e saída.

O tráfego tem alternativas fora da OpenAI

O catálogo do OpenRouter lista 580 modelos de 70 criadores. Esse número muda a negociação para quem opera um editor ou uma plataforma de desenvolvimento: restringir um provedor não significa ficar sem opções.

O Qwen3.5 Plus aparece com janela de contexto de 1 milhão de tokens. Uma versão custa US$ 0,26 por milhão de tokens de entrada e US$ 1,56 por milhão de tokens de saída. Outra custa US$ 0,30 e US$ 1,80. Os valores são muito inferiores aos do Astra, embora os dados disponíveis não permitam concluir que os modelos entreguem a mesma qualidade em programação ou uso agêntico.

Também há uma opção gratuita listada: o Ling 3.0 Flash Sante, da inclusionAI, com entrada e saída a US$ 0 e contexto de 262.144 tokens. O preço elimina a barreira financeira direta, mas não informa, por si só, latência, limites, estabilidade ou desempenho no código.

Para o responsável pela fatura, essa variedade favorece roteamento por tarefa. Um modelo caro pode ficar reservado para mudanças difíceis. Outro, mais barato, pode atender classificação, resumo de arquivos e etapas preliminares. A escolha passa a ser uma decisão de arquitetura, não apenas de preferência por marca.

O mercado também ficou menos previsível

Em 4 de setembro, o preço listado para o DeepSeek V4 Flash Vision Exp apareceu em uma alteração de US$ 0,66 para US$ 1,32 por milhão de tokens. O DeepSeek V3.1 passou de US$ 0,95 para US$ 1,65. O V4 Pro 0813 também teve registro de alta, de US$ 1,98 para US$ 3,346.

Os mesmos dados registram movimentos de queda para outros preços do catálogo, inclusive reduções do V4 Pro e do V4 Flash. Isso sugere que o custo de trocar de provedor não pode ser calculado uma vez e esquecido. A tabela pode mudar enquanto o produto ainda está sendo integrado.

Para quem escolhe modelo em uma empresa pequena, a consequência é prática: mantenha limites de gasto, registre tokens por rota e evite acoplar o editor a um único identificador. O bloqueio de um provedor, se confirmado, seria um evento de distribuição. A exposição à fatura, no entanto, já aparece sem depender dele.

Para quem isso vale — e para quem não muda nada

A mudança interessa diretamente a quem usa agentes de código em produção, paga por tokens de saída e consegue alternar entre provedores. Também vale para plataformas que intermediam chamadas e precisam decidir quais modelos ficam disponíveis para os usuários.

Para quem usa apenas o ChatGPT ou mantém um fluxo pequeno, sem API e sem editor conectado a modelos externos, o efeito é limitado. O lançamento do Astra também não prova que ele seja a melhor escolha para programação: o Artificial Analysis tem notas de código e uso agêntico indisponíveis para esse modelo nos dados consultados.

A implicação prática é simples: trate qualquer restrição de distribuição como motivo para testar rotas alternativas agora, mas só aprove o GPT-6 Astra depois de comparar o custo da saída com o volume real de tokens do seu editor.

Em uma frase

Se o seu editor gera muito texto, teste roteamento entre provedores antes de adotar o GPT-6 Astra, porque US$ 50 por milhão de tokens de saída pode dominar a fatura.

Perguntas frequentes

Quanto custa o GPT-6 Astra na API?

No OpenRouter, o GPT-6 Astra custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A versão batch custa US$ 5 e US$ 25, respectivamente.

O GPT-6 Astra tem contexto de quanto?

A janela de contexto listada no OpenRouter é de 1,05 milhão de tokens. O GPT-6 Astra Pro aparece com o mesmo limite.

Há alternativas mais baratas para um editor de código?

O Qwen3.5 Plus aparece no OpenRouter com preços entre US$ 0,26 e US$ 0,30 por milhão de tokens de entrada, e entre US$ 1,56 e US$ 1,80 por milhão de tokens de saída, dependendo da versão. O catálogo também lista o Ling 3.0 Flash Sante com entrada e saída gratuitas, mas não há dados de desempenho de código para comparar os modelos.

Fontes

Leia também