FalaVIP IA o que os modelos custam,
medido todo dia
Lançamentos

OpenAI lança quatro modelos de 1,05 milhão de tokens

A família Astra, Sol, Terra e Luna chega ao OpenRouter com entrada entre US$ 0,20 e US$ 10 por milhão de tokens. A janela é enorme, mas a saída pode custar até US$ 50 por milhão.

Redação FalaVIP IA 4 min de leitura
1,05 milhãode tokens de contexto em cada modelo
US$ 0,20por milhão de tokens de entrada no GPT Luna
US$ 50por milhão de tokens de saída no GPT Astra

A nova família da OpenAI chega com uma janela de contexto de 1,05 milhão de tokens nos quatro modelos — mas a conta muda bastante conforme o modelo escolhido. No OpenRouter, o GPT Luna começa em US$ 0,20 por milhão de tokens de entrada, enquanto o GPT Astra cobra US$ 10. Na saída, a faixa vai de US$ 1,20 a US$ 50 por milhão.

Os quatro modelos foram listados em 11 de setembro: GPT Astra Latest, GPT Sol Latest, GPT Terra Latest e GPT Luna Latest. O que muda para quem paga a API é menos misterioso do que o marketing sugere: todos aceitam o mesmo volume máximo de contexto, mas não têm o mesmo preço nem, pelos dados disponíveis, uma avaliação de inteligência que permita tratá-los como equivalentes.

A tabela que define a escolha

Os preços praticados no OpenRouter formam uma escada clara:

  • GPT Astra: US$ 10 por milhão de tokens de entrada e US$ 50 de saída;
  • GPT Sol: US$ 2 de entrada e US$ 10 de saída;
  • GPT Terra: US$ 2 de entrada e US$ 12 de saída;
  • GPT Luna: US$ 0,20 de entrada e US$ 1,20 de saída.

A janela de 1,05 milhão de tokens é igual nos quatro casos. Portanto, pagar cinco vezes mais pela entrada em relação ao Sol não compra uma janela maior no Astra. O preço premium aparece também na geração: a saída do Astra custa cinco vezes mais que a do Sol e mais de quarenta vezes mais que a do Luna.

Para uma aplicação que envia documentos extensos e gera respostas curtas, o custo de entrada domina. Para agentes que produzem muito código, relatórios ou chamadas intermediárias, a saída pode virar o principal item da fatura. Nesse segundo caso, escolher o Astra sem medir o volume gerado é uma decisão cara.

A janela de contexto não é novidade isolada

A OpenAI passa a ter quatro opções acima do GPT-5.2, que aparece no catálogo do OpenRouter com 400 mil tokens de contexto. Mas a marca de 1,05 milhão não é exclusiva desta família. O GPT-5.4 também tem 1,05 milhão de tokens, enquanto Claude Opus 4.8, da Anthropic, e Gemini 3.8 Flash, do Google, chegam a 1 milhão e 1,048576 milhão de tokens, respectivamente.

A comparação de preço favorece modelos diferentes conforme o uso. O Claude Opus 4.8 custa US$ 5 por milhão de entrada e US$ 25 de saída. O Gemini 3.8 Flash custa US$ 0,75 de entrada e US$ 3,75 de saída. Os preços listados no OpenRouter mostram, assim, que o Luna entra agressivamente pelo custo, enquanto o Astra fica acima do Claude Opus 4.8 na entrada e na saída.

Isso não significa que os modelos tenham desempenho equivalente. Contexto é capacidade de receber informação; não é uma nota de qualidade, precisão ou capacidade de raciocínio.

O que ainda não dá para concluir

Os índices do Artificial Analysis fornecidos para o dia não trazem notas de inteligência, código ou desempenho agêntico para os quatro lançamentos. Também aparecem no índice variantes chamadas GPT-6 Astra, com pontuações de inteligência entre 52,5 e 52,8, mas esses registros não são os mesmos IDs dos modelos listados no OpenRouter. Não há base para atribuir essas notas ao GPT Astra Latest.

Essa ausência importa para quem está escolhendo um modelo de produção. A tabela de preços permite estimar a fatura e a janela permite avaliar se um fluxo cabe em uma única chamada. Ela não responde se o modelo mantém qualidade ao recuperar informação de um contexto tão longo, se escreve código confiável ou se executa tarefas em várias etapas.

Para quem cada modelo faz sentido

O Luna é o candidato mais direto para ingestão de documentos, triagem e consultas em que o custo pesa mais do que a geração sofisticada. Ainda assim, US$ 1,20 por milhão de tokens de saída pode acumular em aplicações que produzem respostas longas.

O Sol oferece um meio-termo de preço e mantém a mesma janela. O Terra cobra a mesma entrada, mas US$ 12 por milhão na saída; faz sentido considerá-lo apenas se os testes internos mostrarem vantagem suficiente na qualidade gerada.

O Astra é para cargas em que desempenho superior, se confirmado em testes, justifique pagar US$ 50 por milhão de saída. Para uma API com volume alto e respostas extensas, a janela de contexto sozinha não paga essa diferença.

Se você já usa Claude Opus 4.8, Gemini 3.8 Flash ou GPT-5.4, a chegada da família não elimina automaticamente essas opções. A mudança é mais relevante para quem precisava de contexto acima de 400 mil tokens ou quer uma alternativa com quatro degraus de preço. Para quem trabalha com prompts curtos, a nova janela provavelmente não muda a arquitetura nem a fatura.

Em uma frase

Escolha pelo volume real de entrada e saída: a janela de 1,05 milhão é igual nos quatro modelos, mas a geração no Astra custa US$ 50 por milhão de tokens.

Perguntas frequentes

Quanto custa usar os novos modelos da OpenAI na API?

No OpenRouter, a entrada custa US$ 0,20 por milhão de tokens no GPT Luna, US$ 2 no Sol e no Terra e US$ 10 no Astra. A saída custa US$ 1,20, US$ 10, US$ 12 e US$ 50, respectivamente.

Todos os novos modelos têm a mesma janela de contexto?

Sim. GPT Astra, GPT Sol, GPT Terra e GPT Luna aparecem com 1,05 milhão de tokens de contexto no OpenRouter. A janela é igual, mas os preços de entrada e saída são diferentes.

O GPT Astra Latest já tem nota de inteligência no Artificial Analysis?

Não nos dados disponíveis para esses quatro lançamentos. O Artificial Analysis lista variantes chamadas GPT-6 Astra, mas elas não correspondem aos mesmos IDs do GPT Astra Latest no OpenRouter.

Leia também