OpenAI lança modelo de segurança 26x mais barato que o3
gpt-oss-safeguard-20b chega como classificador especializado a US$ 0,30 por milhão de tokens de saída, mas o catálogo não publica nota de inteligência geral para ele
A conta não fecha à primeira vista. A OpenAI colocou no catálogo hoje o gpt-oss-safeguard-20b cobrando US$ 0,30 por milhão de tokens de saída — mais que o dobro do gpt-oss-20b comum, que sai por US$ 0,13. Foi o 23º modelo lançado nos últimos 30 dias num catálogo que já passa de 266 opções, mas este tem um detalhe que os outros não trazem no nome: é um classificador de segurança, não um modelo geral.
O que ele faz (e o que não faz)
O gpt-oss-safeguard-20b é um modelo de raciocínio voltado para segurança, construído sobre o gpt-oss-20b. São 21 bilhões de parâmetros em arquitetura Mixture-of-Experts, open-weight, com 131 mil tokens de contexto. A descrição oficial é direta: classificação de conteúdo, filtragem de LLM e trust & safety.
Traduzindo: ele não foi feito para escrever redação, resumir PDF ou gerar código. Foi feito para responder perguntas do tipo "esse texto viola minha política?" com latência menor que um modelo de fronteira. E aqui aparece o ponto que o release não grita — o catálogo não publica nota de inteligência geral para ele. Não é descuido; é porque o benchmark de inteligência geral não é a métrica que importa aqui. O que importa é precisão em classificação.
Preço na mesa: onde ele se encaixa
Comparado com os modelos que muita gente usa hoje para moderação — muitas vezes pagando caro de propósito — o safeguard cai numa faixa própria:
- gpt-oss-safeguard-20b: US$ 0,30/M saída
- gpt-oss-120b (irmão maior, uso geral): US$ 0,17/M saída
- Claude Haiku 4.5 (Anthropic): US$ 5/M saída
- o3 (OpenAI): US$ 8/M saída
O safeguard custa quase o dobro do gpt-oss-120b. Mas custa 16 vezes menos que o Claude Haiku 4.5 e 26 vezes menos que o o3 para a mesma tarefa de classificação. Se sua plataforma roda moderação usando um modelo de fronteira, o custo por decisão despenca — desde que a precisão sustente.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| gpt-oss-safeguard-20b (o novo) | — | 0.075 | 0.3 | 131k |
| o3 | 31.1 | 2 | 8 | 200k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
Para quem vale — e para quem não muda nada
Vale para quem roda pipeline de moderação em volume: redes sociais, marketplaces, plataformas com conteúdo gerado por usuário, qualquer produto que classifica milhares de mensagens por hora e está pagando preço de modelo geral para isso.
Não muda nada para quem quer um modelo geral mais barato — nesse caso, o gpt-oss-120b segue sendo a opção da própria OpenAI, com IQ 24,1 contra os 31,1 do o3 no topo do ranking atual. E não muda nada para quem já tem um classificador fine-tuned rodando em casa; o ganho de trocar depende de quão específico é o seu domínio.
O que fazer com isso hoje
Se você está pagando Claude Haiku ou o3 para moderar conteúdo, o teste é simples: pegue uma amostra de 1.000 casos que seu classificador atual já decidiu, passe pelo safeguard e compare precisão e custo por decisão. O preço de saída sugere economia brutal — mas a pergunta certa é se a precisão sustenta o que sua política exige.
| Campo | Valor |
|---|---|
| Identificador | openai/gpt-oss-safeguard-20b |
| Criador | openai |
| Preço de entrada | US$ 0.075 / M tokens |
| Preço de saída | US$ 0.300 / M tokens |
| Janela de contexto | 131k |
| Modalidade | text->text |
| Leitura de cache | US$ 0.037 / M (50% de desconto) |
Uma nota sobre os "21B": o catálogo não separa parâmetros totais de ativos no MoE. Para quem planeja self-hosting, vale checar a memória necessária antes de comprar GPU — 21B é o tamanho total, não o que roda por inferência.
Se sua plataforma roda moderação com modelo de fronteira, teste o gpt-oss-safeguard-20b como classificador dedicado: o custo por decisão cai ordens de grandeza, mas valide a precisão antes de trocar em produção.
Perguntas frequentes
Para que serve o gpt-oss-safeguard-20b?
É um modelo de raciocínio especializado em segurança, construído sobre o gpt-oss-20b. Serve para classificação de conteúdo, filtragem de LLM e tarefas de trust & safety — não é um modelo geral para escrita ou código.
Quanto custa em relação ao o3 e ao Claude Haiku 4.5?
Cobra US$ 0,30 por milhão de tokens de saída, contra US$ 8 do o3 e US$ 5 do Claude Haiku 4.5. Isso representa 26x e 16x mais barato, respectivamente, para tarefas de classificação.
O gpt-oss-safeguard-20b tem nota de inteligência geral?
Não. O catálogo não publica índice de inteligência geral para ele, o que faz sentido: a métrica relevante aqui é precisão em classificação de segurança, não desempenho em benchmarks generalistas.