Claude Fable 5.1 chega com 1 milhão de tokens, mas saída custa US$ 50
O novo modelo da Anthropic mira programação e agentes com contexto massivo. A opção batch reduz a tarifa pela metade, mas não transforma o Fable 5.1 em uma alternativa barata para respostas longas.
A conta começa no número menos conveniente do anúncio: o Claude Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. O contexto chega a 1 milhão de tokens, mas cada resposta extensa pode pesar muito mais na fatura do que o texto enviado.
O lançamento da Anthropic acontece em 1º de setembro de 2026. A modalidade batch reduz as tarifas para US$ 5 na entrada e US$ 25 na saída, mantendo a mesma janela de contexto. Para quem consegue processar tarefas sem resposta imediata, essa é a diferença que muda a conta. Para aplicações interativas, o preço cheio continua valendo.
O que mudou de fato
O Fable 5.1 combina uma janela de contexto de 1 milhão de tokens com uma nota de 81,603 em coding e 61,339 em tarefas agênticas, segundo o Artificial Analysis. O catálogo não informa uma nota de inteligência geral para esse modelo. Isso impede tratá-lo como líder absoluto em raciocínio apenas a partir dos resultados de programação.
O número de coding é relevante para quem mantém bases de código grandes, revisa muitos arquivos em uma única solicitação ou usa o modelo para alterar sistemas com dependências espalhadas. A janela massiva também pode reduzir a necessidade de quebrar documentos e repositórios em vários pedidos.
Mas contexto não é sinônimo de consumo obrigatório. Se a aplicação envia apenas instruções curtas e poucos documentos, a capacidade de aceitar 1 milhão de tokens não reduz o preço por chamada. Você continua pagando pela quantidade de tokens processados e gerados.
O anúncio oficial da Anthropic pode ser consultado em Introducing Claude Fable 5.1.
A tarifa batch é o ponto mais prático
No OpenRouter, o Fable 5.1 batch aparece com preço de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. O cache custa US$ 0,125 por milhão de tokens nessa modalidade, contra US$ 0,25 no modelo padrão.
A redução de 50% favorece tarefas como classificação em lote, migração de código, geração de documentação e análise de arquivos que não exigem retorno instantâneo. Também cria uma rota para testar o modelo sem assumir imediatamente a tarifa cheia de saída.
A ressalva é operacional: batch não serve para toda experiência de produto. Se o usuário espera uma resposta durante a interação, a economia não se aplica da mesma forma. Antes de trocar o modelo, vale separar no fluxo o que é atendimento em tempo real e o que pode entrar em uma fila.
Contexto maior, preço maior que o GPT-5.1
A comparação com o GPT-5.1 mostra onde o Fable 5.1 se posiciona. No OpenRouter, o GPT-5.1 custa US$ 1,25 por milhão de tokens de entrada e US$ 10 de saída, com contexto de 400 mil tokens. O Claude Fable 5.1 oferece uma janela maior, mas cobra muito mais pela entrada e pela saída.
Isso muda a escolha. Se o seu sistema precisa apenas de respostas convencionais, o GPT-5.1 tem uma estrutura de preço mais leve nos dados listados. Se precisa manter um volume enorme de contexto em uma mesma solicitação, a capacidade do Fable 5.1 pode justificar o custo adicional — desde que o ganho reduza retrabalho, chamadas fragmentadas ou intervenção humana.
Não há pesos abertos para o Fable 5.1. A adoção, portanto, depende do acesso via API e dos provedores compatíveis, não de uma implantação própria do modelo.
AWS Bedrock amplia a opção de produção
A AWS anuncia disponibilidade imediata do Claude Fable 5.1 no Bedrock em Introducing Claude Fable 5.1 on AWS. Para equipes que já operam na nuvem da AWS, isso reduz a necessidade de criar uma nova camada de integração e facilita manter governança, faturamento e infraestrutura no mesmo ambiente.
Essa disponibilidade não altera a tarifa listada no OpenRouter. São canais de acesso diferentes, e a decisão precisa considerar o preço efetivamente aplicado no provedor usado pela sua aplicação.
Para quem vale e para quem não muda nada
O lançamento interessa a você se trabalha com repositórios extensos, documentos muito longos, automações agênticas ou tarefas assíncronas que podem usar batch. A nota de coding de 81,603 reforça o caso de uso em engenharia de software, enquanto o contexto de 1 milhão de tokens pode simplificar fluxos que hoje exigem divisão de arquivos.
Para chat curto, classificação simples, resumo de entradas pequenas ou produtos extremamente sensíveis a custo, a novidade muda pouco. Nesses cenários, pagar US$ 50 por milhão de tokens de saída pode ser difícil de justificar, mesmo quando o modelo entrega respostas melhores.
A consequência para a arquitetura é direta: reserve o Fable 5.1 para tarefas em que contexto e qualidade de código têm valor mensurável, use batch sempre que a latência permitir e não confunda uma janela maior com uma conta menor.
Se você usa esse modelo em produção, trate o Claude Fable 5.1 como uma ferramenta premium para código e contexto longo — e coloque as tarefas assíncronas no batch antes de liberar o preço cheio.
Perguntas frequentes
Quanto custa o Claude Fable 5.1 na API?
No OpenRouter, o modelo padrão custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A modalidade batch custa US$ 5 na entrada e US$ 25 na saída.
O Claude Fable 5.1 tem contexto de 1 milhão de tokens?
Sim. Tanto o modelo padrão quanto a versão batch aparecem com janela de contexto de 1 milhão de tokens no OpenRouter.
O Claude Fable 5.1 está disponível na AWS Bedrock?
Sim. A AWS informa disponibilidade imediata do modelo no Bedrock. A tarifa divulgada no OpenRouter, porém, não deve ser tratada automaticamente como o preço final em outro provedor.
Fontes
- Introducing Claude Fable 5.1 Anthropic (oficial) · vídeo
- Introducing Claude Fable 5.1 on AWS AWS — Machine Learning · anúncio oficial