FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Fable 5.1 custa US$ 50 na saída e desafia a conta da API

A Anthropic estreia modelos com raciocínio adaptativo e desempenho forte em código. Mas a redução de cache de até 45% não está comprovada pelos preços listados no OpenRouter, enquanto o Opus 5 ainda exige cautela na comparação.

Redação FalaVIP IA 3 min de leitura
US$ 50por milhão de tokens de saída do Fable 5.1
US$ 0,25por milhão de tokens em cache do Fable 5.1
81,603índice de código do Fable 5.1 no Artificial Analysis

Se você usa um modelo em produção, a conta começa pela saída: o Claude Fable 5.1 custa US$ 50 por milhão de tokens gerados no OpenRouter. A entrada custa US$ 10 por milhão, e o cache custa US$ 0,25 por milhão. O preço é alto o bastante para mudar a arquitetura de qualquer aplicação que gere respostas longas ou execute várias etapas de raciocínio.

A Anthropic também coloca o Claude Opus 5 na disputa. No índice do Artificial Analysis, ele aparece com nota de inteligência de 63,1 e preço de referência de US$ 10 por milhão. O número não substitui uma tabela completa de entrada, saída e cache: para o Opus 5, esses valores detalhados não aparecem nas fichas disponíveis para comparação.

O que mudou no raciocínio

A família Fable 5.1 chega com configurações de esforço adaptativo. A versão Max Effort marca 65,7 no índice de inteligência do Artificial Analysis, enquanto as opções Xhigh, High, Medium e Low registram 64,8, 62,5, 60,5 e 58,1, respectivamente.

Isso traduz uma mudança prática: você pode reservar mais esforço para tarefas difíceis e reduzir a intensidade em solicitações simples. O recurso pode evitar que toda chamada opere no nível mais caro de raciocínio. Ainda assim, o preço por token continua sendo o fator dominante quando a aplicação gera muito texto.

O Fable 5.1 também alcança 81,603 no índice de código e 61,339 no índice agêntico do Artificial Analysis. A combinação favorece fluxos de programação, revisão de código e tarefas com várias etapas. Não significa, porém, que toda chamada deva ser direcionada ao Fable: para classificação, extração e respostas curtas, a diferença de qualidade pode não compensar a tarifa.

Cache barato, mas não até 45%

A promessa de redução de até 45% no custo de cache não fecha com o que está explicitamente listado no OpenRouter. O preço padrão do cache do Fable 5.1 é US$ 0,25 por milhão de tokens. Na modalidade batch, ele cai para US$ 0,125, uma redução de 50% em relação ao preço padrão.

Essa comparação é entre modalidades diferentes. Ela não prova que o cache do lançamento ficou 45% mais barato que o de uma geração anterior. Também não há, nas fichas disponíveis, um preço de cache do Opus 5 que permita confirmar uma redução semelhante.

O batch reduz ainda a entrada do Fable de US$ 10 para US$ 5 por milhão e a saída de US$ 50 para US$ 25 por milhão. Para processamento assíncrono, isso pode fazer diferença. Para uma API conversacional, em que o usuário espera resposta imediata, o desconto não resolve sozinho o custo do modelo principal.

O Opus 5 entra abaixo do Fable

O Opus 5 aparece com nota de inteligência de 63,1 no Artificial Analysis, abaixo dos 65,7 do Fable 5.1 Max Effort. No mesmo índice, o Opus 5 tem preço de referência de US$ 10 por milhão, metade do valor atribuído ao Fable 5.1 nessa comparação.

Isso torna o Opus 5 a alternativa mais importante dentro da própria linha Anthropic para quem precisa controlar o orçamento. Mas a comparação precisa ser feita com a métrica certa: o valor de US$ 10 não informa, sozinho, se é entrada, saída ou uma referência agregada. No OpenRouter, o Fable tem uma estrutura explícita de US$ 10 na entrada e US$ 50 na saída.

A conversa sobre os lançamentos foi impulsionada pelos vídeos de ViktorKav, Inteligência Mil Grau sobre Fable, Inteligência Mil Grau sobre Opus, Inteligência Mil Grau sobre Claude Opus 5 e Vini — AI Coders Academy. Os títulos destacam desempenho e preço, mas os índices e tarifas mostram uma decisão menos simples.

Para quem vale

O Fable 5.1 faz sentido se você precisa de desempenho elevado em código, raciocínio adaptativo e contexto de até um milhão de tokens. Também pode ser justificável em agentes nos quais uma resposta errada custa mais do que o processamento adicional.

Para quem paga uma fatura apertada, a história é diferente. O Artificial Analysis lista opções de custo-benefício como o GLM-5.3-Flash, com nota de inteligência de 57,5 e preço de US$ 0,238 por milhão, e o Qwen3.8-Flash-Next, com nota de 55,8 e preço de US$ 0,23. Eles não aparecem no mesmo patamar de inteligência do Fable, mas podem ser mais adequados para tarefas rotineiras.

A implicação prática é direta: use o Fable 5.1 apenas onde a qualidade adicional paga a diferença, coloque o Opus 5 em testes controlados e trate o cache como otimização de infraestrutura — não como justificativa para ignorar o custo de US$ 50 por milhão de tokens de saída.

Em uma frase

Se a aplicação gera muito texto, o cache ajuda, mas o Fable 5.1 só cabe na produção com roteamento, limites de saída e uso seletivo por tarefa.

Perguntas frequentes

Quanto custa o Claude Fable 5.1 na API?

No OpenRouter, o Fable 5.1 custa US$ 10 por milhão de tokens de entrada, US$ 50 por milhão de saída e US$ 0,25 por milhão em cache. A modalidade batch reduz esses valores para US$ 5, US$ 25 e US$ 0,125, respectivamente.

O Claude Opus 5 é mais barato que o Fable 5.1?

O Artificial Analysis lista preço de referência de US$ 10 por milhão para o Opus 5 e US$ 20 para o Fable 5.1 no índice. Essa comparação não detalha entrada, saída e cache do Opus, portanto não substitui uma simulação com o padrão de uso da sua API.

O Fable 5.1 é melhor para programação?

Ele registra índice de código de 81,603 no Artificial Analysis, além de nota de inteligência de 65,7 na configuração Max Effort. O ganho pode justificar o preço em tarefas críticas, mas não necessariamente em chamadas simples ou de alto volume.

Fontes

Leia também