GPT-5.1 Chat cobra US$ 10 por milhão de saída: vale o troco contra o3?
Três dias após o lançamento, o Instant da nova família da OpenAI ainda não tem índice de inteligência publicado — e isso muda quem deveria cogitá-lo.
Você abriu o painel da OpenAI nesta semana, viu o nome novo e foi direto olhar a tabela de preços. A pergunta é simples: o GPT-5.1 Chat entra na sua pilha ou é só mais uma linha no catálogo?
Três dias, e ainda sem nota de inteligência
O GPT-5.1 Chat foi listado em 13 de novembro de 2025 — três dias antes desta análise — e o catálogo que serve de referência ainda não publicou índice de inteligência, coding, agentic ou blended para ele. Os campos estão em branco, não zerados. Em tradução direta: ninguém que olha para o catálogo hoje consegue colocar esse modelo lado a lado com o3 num gráfico de IQ.
A OpenAI chama o GPT-5.1 Chat de "Instant", o membro leve da família 5.1, otimizado para baixa latência em chat. O release promete que ele decide quando "pensar" antes de responder, usando raciocínio adaptativo. Marketing redondo. O que importa para quem paga API é: quanto custa, em que tarefa ele brilha, e contra o quê ele concorre.
O preço: contexto é a isca, saída é onde a conta explode
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-5.1-chat |
| Criador | openai |
| Preço de entrada | US$ 1.25 / M tokens |
| Preço de saída | US$ 10.00 / M tokens |
| Janela de contexto | 128k |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.130 / M (90% de desconto) |
A estrutura é a mesma família conhecida: US$ 1,25 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída, US$ 0,13 por milhão de tokens em cache de entrada. O cache é o detalhe que costuma passar batido: se o seu sistema reaproveita prompts longos, é a única parte dessa tabela em que o GPT-5.1 Chat fica genuinamente barato — cerca de 10 vezes mais barato que a entrada "quente".
Onde a conta infla é na saída. US$ 10 por milhão é o preço cheio da categoria premium da OpenAI. Para comparar com o tabuleiro:
- OpenAI o3, o topo do índice hoje, sai por US$ 8 o milhão de tokens de saída — e entrega IQ 31,096.
- Claude Haiku 4.5, da Anthropic, sai por US$ 5 o milhão, com IQ 29,892.
- O GPT-oss-120b, modelo aberto da própria OpenAI, sai por US$ 0,17 o milhão. Cem vezes mais barato.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
Então a conta que o release não entrega é esta: o GPT-5.1 Chat custa 25% a mais que o o3 na saída, sem índice publicado que diga se ele é melhor, igual ou pior em raciocínio. E custa o dobro do Haiku 4.5, que tem nota medida.
Para quem o GPT-5.1 Chat faz sentido
Vale a pena testar em três situações concretas. Primeiro, se o seu produto depende de latência curta em chat e você já está no ecossistema OpenAI — a família Instant foi desenhada para isso e o ajuste de raciocínio adaptativo pode evitar idas e vindas caras ao o3. Segundo, se você consome muito contexto cacheado: a 13 centavos por milhão, dá para manter bases de prompt inteiras reaproveitadas sem repuxar a fatura. Terceiro, se você quer multimodalidade nativa (texto + imagem + arquivo -> texto) dentro de uma única chamada barata da OpenAI.
Para quem ele não muda nada
Se o seu gargalo é custo de saída em alto volume — geração de relatórios longos, resumos extensos, pipelines que cuspitam tokens — o Haiku 4.5 continua sendo a referência de custo-benefício medida, e o gpt-oss-120b é a opção de centavos para cargas que toleram um modelo aberto. Se você precisa do melhor raciocínio absoluto, o o3 segue sendo o topo do catálogo no momento, com nota publicada e preço menor por token de saída.
E tem um quarto caso, mais incômodo: se você não roda benchmark interno, esperar uma semana até o catálogo publicar IQ, coding e agentic do GPT-5.1 Chat é a decisão racional. Adotar modelo sem nota medida, pagando US$ 10 o milhão de saída, é apostar no escuro.
A implicação prática
Antes de trocar, meça latência e custo do seu fluxo atual em três tarefas reais — uma curta, uma com cache pesado, uma com saída longa. Se o GPT-5.1 Chat ganhar nas três, migre. Se empatar em uma e perder em outra, espere a nota de inteligência aparecer e reavalie.
Só vale migrar para o GPT-5.1 Chat se latência ou multimodalidade no ecossistema OpenAI forem gargalo real; em custo de saída, Haiku 4.5 e gpt-oss-120b seguem imbatíveis até o índice de inteligência do 5.1 sair.
Perguntas frequentes
Quanto custa o GPT-5.1 Chat na API?
US$ 1,25 por milhão de tokens de entrada, US$ 10 por milhão de tokens de saída e US$ 0,13 por milhão de tokens em cache de entrada. O modelo não tem camada gratuita anunciada no catálogo.
GPT-5.1 Chat é melhor que o o3?
O catálogo ainda não publicou índice de inteligência, coding ou agentic para o GPT-5.1 Chat. Hoje não dá para afirmar superioridade — só dá para comparar preço, e o o3 sai 20% mais barato por token de saída.
Qual a diferença entre GPT-5.1 Chat e Claude Haiku 4.5?
Haiku 4.5 custa US$ 5 por milhão de tokens de saída (metade do 5.1 Chat) e tem IQ medido de 29,892. O 5.1 Chat entrega multimodalidade nativa texto+imagem+arquivo e cache de entrada agressivo, mas sem nota publicada ainda.