FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

GPT-5.1 custa US$ 10 por milhão e ainda não tem nota de inteligência

Cinco dias após o lançamento, o modelo topo de linha da OpenAI segue sem índice publicado no catálogo — e cobra US$ 2 a mais por milhão de saída do que o o3, que lidera a régua.

Redação FalaVIP IA 3 min de leitura
US$ 10por milhão de tokens de saída do GPT-5.1
US$ 8por milhão de tokens de saída do o3 (mesma casa)
US$ 0,125por milhão de tokens no cache de leitura

Cinco dias depois, a nota ainda não apareceu

GPT-5.1 foi lançado em 13 de novembro. Hoje, 18 de novembro, o catálogo — que reúne mais de 276 modelos de 42 criadores — ainda não publicou índice de inteligência, código ou agentic para ele. Não quer dizer que o modelo é ruim; quer dizer que, na régua que o mercado está usando para comparar, ele está sem medição pública. Enquanto isso, o o3 da própria OpenAI segue no topo da tabela com IQ 31,096 e custa US$ 8 por milhão de tokens de saída. Você está olhando para o modelo mais caro da família sem nota, ao lado do modelo mais inteligente da mesma casa saindo US$ 2 mais barato por milhão.

Para apertar a leitura, o catálogo registrou 16 modelos novos nos últimos 30 dias. O GPT-5.1 não é o único lançamento recente — e ainda assim é o único topo de linha sem régua publicada.

O argumento que sobra sem régua publicada

O release da OpenAI fala em "raciocínio adaptativo, melhor aderência a instruções e estilo conversacional mais natural". Traduzindo: o GPT-5.1 decide sozinho quanto pensar antes de responder, segue melhor o que você pediu e escreve com menos cara de robô. Para multimodal — texto, imagem e arquivo entrando, só texto saindo — ele é a referência atual na família GPT-5; o o3 não traz o mesmo pacote de entradas declarado. E a janela de contexto é de 400 mil tokens, o dobro do que muita alternativa entrega hoje.

Ficha técnica — GPT-5.1
CampoValor
Identificadoropenai/gpt-5.1
Criadoropenai
Preço de entradaUS$ 1.25 / M tokens
Preço de saídaUS$ 10.00 / M tokens
Janela de contexto400k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.125 / M (90% de desconto)

Em resumo: você paga US$ 2 a mais por milhão na saída em troca de multimodal nativo, contexto maior e um modo de raciocínio que ajusta profundidade automaticamente. O resto do ganho é "conversacional" — difícil de medir em planilha.

O tabuleiro em 18 de novembro

A conta é direta. No topo da régua hoje:

  • OpenAI o3: IQ 31,096, US$ 8/M saída — o mais inteligente, sem multimodal declarada.
  • Anthropic Claude Haiku 4.5: IQ 29,892, US$ 5/M saída — metade do preço do GPT-5.1, vindo dos EUA.
  • OpenAI gpt-oss-120b: IQ 24,126, US$ 0,17/M saída — outra ordem de grandeza, open weights.
  • OpenAI gpt-oss-20b: IQ 15,225, US$ 0,13/M saída — o piso da régua.
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 276 modelos disponíveis no catálogo nesta data.

Se o critério é "o mais inteligente pelo menor preço", GPT-5.1 perde para o3 e para Claude Haiku 4.5. Se o critério é "multimodal + contexto gigante + raciocínio adaptativo dentro do ecossistema OpenAI", ele entra. Para tarefas de texto puro sem contexto longo, ele não tem argumento de peso sobre o3.

O detalhe que muda a conta de verdade

Um número que passa batido no anúncio: o cache de leitura custa US$ 0,125 por milhão de tokens — dez vezes mais barato que a entrada normal (US$ 1,25). Se você tem system prompt pesado ou base de conhecimento fixa entrando em toda chamada, o custo efetivo despenca. Em workloads de agente ou RAG com prompt cacheado, o GPT-5.1 começa a fazer mais sentido do que o US$ 10/M sugere no papel.

É o tipo de economia que só aparece em produção, não em matéria de capa.

Para quem vale — e para quem não muda nada

Vale a pena testar se você já está no ecossistema OpenAI e precisa de multimodal nativo com contexto longo, roda agentes que se beneficiam de raciocínio adaptativo, ou tem prompts repetitivos que vão turbinar o cache de leitura. Não muda nada se você quer a melhor nota pelo menor preço — o3 ganha, e Haiku 4.5 custa metade —, busca custo mínimo em tarefas simples — gpt-oss-20b sai por US$ 0,13/M —, ou não precisa de multimodal nem de 400 mil contexto.

Se multimodal com contexto longo é seu caso, rode um piloto curto de uma semana e meça latência e qualidade nas suas tarefas reais. A nota de inteligência do catálogo deve aparecer em algum momento e confirmar ou quebrar essa leitura. Até lá, a única vantagem concreta e verificável do GPT-5.1 sobre o o3 é multimodal nativo + 400 mil contexto + cache agressivo. Se você não usa nada disso, gaste os US$ 2 a menos por milhão em outra linha da fatura.

Em uma frase

Sem nota de inteligência publicada, o argumento do GPT-5.1 sobre o o3 se resume a multimodal nativo, contexto de 400 mil tokens e cache agressivo — se você não usa nada disso, o o3 entrega raciocínio equivalente por US$ 2 a menos por milhão.

Perguntas frequentes

GPT-5.1 é melhor que o o3?

Em inteligência bruta medida pelo catálogo hoje, o o3 lidera com IQ 31,096. Em multimodal nativo, contexto de 400 mil tokens e raciocínio adaptativo declarado, o GPT-5.1 entrega o que o o3 não promete no mesmo pacote. Como o catálogo ainda não publicou índice de IQ para o GPT-5.1, não dá para cravar a régua de capacidade hoje.

Quanto custa usar o GPT-5.1 na prática?

US$ 1,25 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,125 por milhão no cache de leitura — dez vezes mais barato que a entrada normal. Em workloads com system prompt fixo reaproveitado, o custo efetivo cai bastante e pode mudar a economia a favor do GPT-5.1.

Vale trocar o Claude Haiku 4.5 pelo GPT-5.1?

Só se você precisa do ecossistema OpenAI com multimodal nativo e contexto de 400 mil tokens. Em preço por inteligência, o Haiku 4.5 (IQ 29,892) custa metade e fica perto do topo. Para tarefas de texto puro, ele segue como alternativa mais barata que o GPT-5.1.

Leia também