FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Claude Fable 5.1 chega com 1 milhão de tokens, mas saída custa US$ 50

O novo modelo da Anthropic mira programação e agentes com contexto massivo. A opção batch reduz a tarifa pela metade, mas não transforma o Fable 5.1 em uma alternativa barata para respostas longas.

Redação FalaVIP IA 4 min de leitura
1 milhãode tokens na janela de contexto
US$ 50por milhão de tokens de saída
81,603na nota de coding do Artificial Analysis

A conta começa no número menos conveniente do anúncio: o Claude Fable 5.1 custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. O contexto chega a 1 milhão de tokens, mas cada resposta extensa pode pesar muito mais na fatura do que o texto enviado.

O lançamento da Anthropic acontece em 1º de setembro de 2026. A modalidade batch reduz as tarifas para US$ 5 na entrada e US$ 25 na saída, mantendo a mesma janela de contexto. Para quem consegue processar tarefas sem resposta imediata, essa é a diferença que muda a conta. Para aplicações interativas, o preço cheio continua valendo.

O que mudou de fato

O Fable 5.1 combina uma janela de contexto de 1 milhão de tokens com uma nota de 81,603 em coding e 61,339 em tarefas agênticas, segundo o Artificial Analysis. O catálogo não informa uma nota de inteligência geral para esse modelo. Isso impede tratá-lo como líder absoluto em raciocínio apenas a partir dos resultados de programação.

O número de coding é relevante para quem mantém bases de código grandes, revisa muitos arquivos em uma única solicitação ou usa o modelo para alterar sistemas com dependências espalhadas. A janela massiva também pode reduzir a necessidade de quebrar documentos e repositórios em vários pedidos.

Mas contexto não é sinônimo de consumo obrigatório. Se a aplicação envia apenas instruções curtas e poucos documentos, a capacidade de aceitar 1 milhão de tokens não reduz o preço por chamada. Você continua pagando pela quantidade de tokens processados e gerados.

O anúncio oficial da Anthropic pode ser consultado em Introducing Claude Fable 5.1.

A tarifa batch é o ponto mais prático

No OpenRouter, o Fable 5.1 batch aparece com preço de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. O cache custa US$ 0,125 por milhão de tokens nessa modalidade, contra US$ 0,25 no modelo padrão.

A redução de 50% favorece tarefas como classificação em lote, migração de código, geração de documentação e análise de arquivos que não exigem retorno instantâneo. Também cria uma rota para testar o modelo sem assumir imediatamente a tarifa cheia de saída.

A ressalva é operacional: batch não serve para toda experiência de produto. Se o usuário espera uma resposta durante a interação, a economia não se aplica da mesma forma. Antes de trocar o modelo, vale separar no fluxo o que é atendimento em tempo real e o que pode entrar em uma fila.

Contexto maior, preço maior que o GPT-5.1

A comparação com o GPT-5.1 mostra onde o Fable 5.1 se posiciona. No OpenRouter, o GPT-5.1 custa US$ 1,25 por milhão de tokens de entrada e US$ 10 de saída, com contexto de 400 mil tokens. O Claude Fable 5.1 oferece uma janela maior, mas cobra muito mais pela entrada e pela saída.

Isso muda a escolha. Se o seu sistema precisa apenas de respostas convencionais, o GPT-5.1 tem uma estrutura de preço mais leve nos dados listados. Se precisa manter um volume enorme de contexto em uma mesma solicitação, a capacidade do Fable 5.1 pode justificar o custo adicional — desde que o ganho reduza retrabalho, chamadas fragmentadas ou intervenção humana.

Não há pesos abertos para o Fable 5.1. A adoção, portanto, depende do acesso via API e dos provedores compatíveis, não de uma implantação própria do modelo.

AWS Bedrock amplia a opção de produção

A AWS anuncia disponibilidade imediata do Claude Fable 5.1 no Bedrock em Introducing Claude Fable 5.1 on AWS. Para equipes que já operam na nuvem da AWS, isso reduz a necessidade de criar uma nova camada de integração e facilita manter governança, faturamento e infraestrutura no mesmo ambiente.

Essa disponibilidade não altera a tarifa listada no OpenRouter. São canais de acesso diferentes, e a decisão precisa considerar o preço efetivamente aplicado no provedor usado pela sua aplicação.

Para quem vale e para quem não muda nada

O lançamento interessa a você se trabalha com repositórios extensos, documentos muito longos, automações agênticas ou tarefas assíncronas que podem usar batch. A nota de coding de 81,603 reforça o caso de uso em engenharia de software, enquanto o contexto de 1 milhão de tokens pode simplificar fluxos que hoje exigem divisão de arquivos.

Para chat curto, classificação simples, resumo de entradas pequenas ou produtos extremamente sensíveis a custo, a novidade muda pouco. Nesses cenários, pagar US$ 50 por milhão de tokens de saída pode ser difícil de justificar, mesmo quando o modelo entrega respostas melhores.

A consequência para a arquitetura é direta: reserve o Fable 5.1 para tarefas em que contexto e qualidade de código têm valor mensurável, use batch sempre que a latência permitir e não confunda uma janela maior com uma conta menor.

Em uma frase

Se você usa esse modelo em produção, trate o Claude Fable 5.1 como uma ferramenta premium para código e contexto longo — e coloque as tarefas assíncronas no batch antes de liberar o preço cheio.

Perguntas frequentes

Quanto custa o Claude Fable 5.1 na API?

No OpenRouter, o modelo padrão custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de tokens de saída. A modalidade batch custa US$ 5 na entrada e US$ 25 na saída.

O Claude Fable 5.1 tem contexto de 1 milhão de tokens?

Sim. Tanto o modelo padrão quanto a versão batch aparecem com janela de contexto de 1 milhão de tokens no OpenRouter.

O Claude Fable 5.1 está disponível na AWS Bedrock?

Sim. A AWS informa disponibilidade imediata do modelo no Bedrock. A tarifa divulgada no OpenRouter, porém, não deve ser tratada automaticamente como o preço final em outro provedor.

Fontes

Leia também