FalaVIP IA o que os modelos custam,
medido todo dia
Preços

GPT-Live 1 chega à API, mas o preço de voz não aparece

A OpenAI anuncia voz em tempo real a US$ 0,05 por minuto, mas esse valor não aparece nos preços do OpenRouter. Para quem paga a API, a separação entre voz e raciocínio ainda deixa a conta incompleta.

Redação FalaVIP IA 3 min de leitura
US$ 0,05por minuto de voz, segundo o anúncio da OpenAI
US$ 10por milhão de tokens de entrada do GPT Fable 5.1 no OpenRouter
US$ 50por milhão de tokens de saída do GPT Fable 5.1 no OpenRouter

O número que interessa para quem coloca um atendente de voz em produção é US$ 0,05 por minuto. Esse é o preço anunciado para o GPT-Live 1, modelo voltado a conversas em tempo real e comunicação full-duplex pela API.

Mas existe um problema para fechar a conta: esse valor não aparece no catálogo de preços do OpenRouter usado como referência nesta análise. O GPT-Live 1 também não está entre os seis lançamentos listados em 11 de setembro de 2026. Portanto, o anúncio estabelece uma referência comercial, mas ainda não permite conferir o custo efetivo em uma tabela de API independente.

Segundo a OpenAI, no anúncio oficial, o GPT-Live 1 pode assumir a camada de voz de uma aplicação. Isso muda o desenho do produto: áudio, interrupções e troca simultânea de fala ficam associados a uma tarifa por tempo de conversa, enquanto o raciocínio pode continuar em outro modelo.

O que os US$ 0,05 compram — e o que não compram

O preço por minuto não deve ser lido como custo total de uma conversa inteligente. Ele representa a camada de voz anunciada. Se a aplicação precisar interpretar contexto, consultar documentos, chamar ferramentas ou executar uma tarefa, haverá também o custo do modelo usado no back-end de raciocínio.

Essa distinção é a parte mais importante para o orçamento. Uma sessão de voz pode parecer barata quando medida apenas por duração. A fatura muda quando cada turno também envia histórico, instruções e resultados de ferramentas para um modelo de texto.

O OpenRouter dá uma escala para esse segundo componente. O Claude Fable 5.1 aparece a US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída, com janela de contexto de 1.000.000 de tokens. Esses valores não são o preço do GPT-Live 1 nem substituem uma tabela oficial da OpenAI; servem apenas para mostrar por que voz e raciocínio precisam ser contabilizados separadamente.

A conta ainda não está fechada

Os preços praticados no OpenRouter mostram vários modelos com cobrança por token, não por minuto. O Gemini 2.0 Flash, por exemplo, custa US$ 0,10 por milhão de tokens de entrada e US$ 0,40 por milhão de tokens de saída. O DeepSeek V4.1 Flash aparece a US$ 0,15 e US$ 0,60, respectivamente.

Nenhum desses valores pode ser somado automaticamente aos US$ 0,05 do GPT-Live 1. Faltam informações operacionais para transformar a tarifa de voz em uma previsão confiável: como o minuto é medido, se há cobrança por áudio enviado e recebido, como pausas são tratadas e qual é a unidade de cobrança quando a conversa é interrompida.

Para um CTO, essa ausência é mais relevante do que a promessa de uma tarifa simples. Sem a definição do medidor, não dá para comparar uma chamada curta com uma sessão longa, nem projetar o custo de milhares de atendimentos com segurança.

Para quem a novidade vale

O anúncio interessa diretamente a quem constrói recepção automatizada, suporte por telefone, tutores de conversação ou interfaces de voz com resposta imediata. Nesses casos, a cobrança por minuto pode facilitar a previsão da camada de áudio e reduzir a necessidade de montar uma cadeia separada de reconhecimento de fala, modelo de texto e síntese.

Também vale para equipes que já têm um back-end de raciocínio e querem trocar apenas a interface. A arquitetura pode manter o modelo responsável por buscar dados e tomar decisões, enquanto o GPT-Live 1 cuida da interação falada.

Para quem usa apenas chat de texto, a mudança não altera a conta. Também não há benefício comprovado para aplicações que precisam principalmente de código, análise longa ou tarefas agênticas: os dados do Artificial Analysis fornecidos para os lançamentos do dia não trazem notas de inteligência, código ou desempenho agêntico para o GPT-Live 1.

O que conferir antes de migrar

A primeira tarefa é separar três linhas no orçamento: minutos de áudio, tokens de entrada do raciocínio e tokens de saída do raciocínio. Depois, é preciso confirmar se o preço anunciado cobre a sessão completa ou apenas uma direção do fluxo de voz.

O catálogo do OpenRouter registra 594 modelos de 70 criadores, mas não registra o GPT-Live 1 entre os modelos apresentados nesta data. Isso não prova que a API da OpenAI não esteja disponível; mostra apenas que o preço de US$ 0,05 por minuto ainda não pode ser conferido nessa fonte.

Se você usa voz em produção, trate US$ 0,05 como preço anunciado da interface, não como custo final por atendimento. A decisão de migração deve esperar a definição de cobrança e uma simulação que inclua o modelo de raciocínio.

Em uma frase

O GPT-Live 1 pode simplificar a camada de voz, mas você ainda precisa somar e confirmar o custo do raciocínio antes de calcular a fatura.

Perguntas frequentes

Quanto custa o GPT-Live 1 por minuto?

A OpenAI anuncia o valor de US$ 0,05 por minuto para a voz do GPT-Live 1. Esse preço não aparece no catálogo do OpenRouter usado na conferência, então ainda não há validação independente nem custo total de uma conversa.

O preço do GPT-Live 1 inclui o raciocínio da IA?

Não há informação nos dados disponíveis que permita afirmar isso. A proposta separa a camada de voz do back-end de raciocínio, portanto tokens de entrada, saída, ferramentas e contexto podem gerar cobrança adicional.

Quem usa chat de texto terá redução de preço?

Não. O GPT-Live 1 é apresentado para conversação de voz em tempo real, enquanto aplicações somente de texto continuam sujeitas aos preços por token do modelo escolhido.

Fontes

Leia também