GPT-5.1 custa US$ 10 por milhão e ainda não tem nota de inteligência
Cinco dias após o lançamento, o modelo topo de linha da OpenAI segue sem índice publicado no catálogo — e cobra US$ 2 a mais por milhão de saída do que o o3, que lidera a régua.
Cinco dias depois, a nota ainda não apareceu
GPT-5.1 foi lançado em 13 de novembro. Hoje, 18 de novembro, o catálogo — que reúne mais de 276 modelos de 42 criadores — ainda não publicou índice de inteligência, código ou agentic para ele. Não quer dizer que o modelo é ruim; quer dizer que, na régua que o mercado está usando para comparar, ele está sem medição pública. Enquanto isso, o o3 da própria OpenAI segue no topo da tabela com IQ 31,096 e custa US$ 8 por milhão de tokens de saída. Você está olhando para o modelo mais caro da família sem nota, ao lado do modelo mais inteligente da mesma casa saindo US$ 2 mais barato por milhão.
Para apertar a leitura, o catálogo registrou 16 modelos novos nos últimos 30 dias. O GPT-5.1 não é o único lançamento recente — e ainda assim é o único topo de linha sem régua publicada.
O argumento que sobra sem régua publicada
O release da OpenAI fala em "raciocínio adaptativo, melhor aderência a instruções e estilo conversacional mais natural". Traduzindo: o GPT-5.1 decide sozinho quanto pensar antes de responder, segue melhor o que você pediu e escreve com menos cara de robô. Para multimodal — texto, imagem e arquivo entrando, só texto saindo — ele é a referência atual na família GPT-5; o o3 não traz o mesmo pacote de entradas declarado. E a janela de contexto é de 400 mil tokens, o dobro do que muita alternativa entrega hoje.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5.1 |
| Criador | openai |
| Preço de entrada | US$ 1.25 / M tokens |
| Preço de saída | US$ 10.00 / M tokens |
| Janela de contexto | 400k |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.125 / M (90% de desconto) |
Em resumo: você paga US$ 2 a mais por milhão na saída em troca de multimodal nativo, contexto maior e um modo de raciocínio que ajusta profundidade automaticamente. O resto do ganho é "conversacional" — difícil de medir em planilha.
O tabuleiro em 18 de novembro
A conta é direta. No topo da régua hoje:
- OpenAI o3: IQ 31,096, US$ 8/M saída — o mais inteligente, sem multimodal declarada.
- Anthropic Claude Haiku 4.5: IQ 29,892, US$ 5/M saída — metade do preço do GPT-5.1, vindo dos EUA.
- OpenAI gpt-oss-120b: IQ 24,126, US$ 0,17/M saída — outra ordem de grandeza, open weights.
- OpenAI gpt-oss-20b: IQ 15,225, US$ 0,13/M saída — o piso da régua.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Se o critério é "o mais inteligente pelo menor preço", GPT-5.1 perde para o3 e para Claude Haiku 4.5. Se o critério é "multimodal + contexto gigante + raciocínio adaptativo dentro do ecossistema OpenAI", ele entra. Para tarefas de texto puro sem contexto longo, ele não tem argumento de peso sobre o3.
O detalhe que muda a conta de verdade
Um número que passa batido no anúncio: o cache de leitura custa US$ 0,125 por milhão de tokens — dez vezes mais barato que a entrada normal (US$ 1,25). Se você tem system prompt pesado ou base de conhecimento fixa entrando em toda chamada, o custo efetivo despenca. Em workloads de agente ou RAG com prompt cacheado, o GPT-5.1 começa a fazer mais sentido do que o US$ 10/M sugere no papel.
É o tipo de economia que só aparece em produção, não em matéria de capa.
Para quem vale — e para quem não muda nada
Vale a pena testar se você já está no ecossistema OpenAI e precisa de multimodal nativo com contexto longo, roda agentes que se beneficiam de raciocínio adaptativo, ou tem prompts repetitivos que vão turbinar o cache de leitura. Não muda nada se você quer a melhor nota pelo menor preço — o3 ganha, e Haiku 4.5 custa metade —, busca custo mínimo em tarefas simples — gpt-oss-20b sai por US$ 0,13/M —, ou não precisa de multimodal nem de 400 mil contexto.
Se multimodal com contexto longo é seu caso, rode um piloto curto de uma semana e meça latência e qualidade nas suas tarefas reais. A nota de inteligência do catálogo deve aparecer em algum momento e confirmar ou quebrar essa leitura. Até lá, a única vantagem concreta e verificável do GPT-5.1 sobre o o3 é multimodal nativo + 400 mil contexto + cache agressivo. Se você não usa nada disso, gaste os US$ 2 a menos por milhão em outra linha da fatura.
Sem nota de inteligência publicada, o argumento do GPT-5.1 sobre o o3 se resume a multimodal nativo, contexto de 400 mil tokens e cache agressivo — se você não usa nada disso, o o3 entrega raciocínio equivalente por US$ 2 a menos por milhão.
Perguntas frequentes
GPT-5.1 é melhor que o o3?
Em inteligência bruta medida pelo catálogo hoje, o o3 lidera com IQ 31,096. Em multimodal nativo, contexto de 400 mil tokens e raciocínio adaptativo declarado, o GPT-5.1 entrega o que o o3 não promete no mesmo pacote. Como o catálogo ainda não publicou índice de IQ para o GPT-5.1, não dá para cravar a régua de capacidade hoje.
Quanto custa usar o GPT-5.1 na prática?
US$ 1,25 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,125 por milhão no cache de leitura — dez vezes mais barato que a entrada normal. Em workloads com system prompt fixo reaproveitado, o custo efetivo cai bastante e pode mudar a economia a favor do GPT-5.1.
Vale trocar o Claude Haiku 4.5 pelo GPT-5.1?
Só se você precisa do ecossistema OpenAI com multimodal nativo e contexto de 400 mil tokens. Em preço por inteligência, o Haiku 4.5 (IQ 29,892) custa metade e fica perto do topo. Para tarefas de texto puro, ele segue como alternativa mais barata que o GPT-5.1.