FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Claude Fable 5 em modo batch custa cinco vezes menos que o Claude Fable 5 normal

A Anthropic cortou o preço do topo do ranking para quem aceita esperar — e isso muda o cálculo de qual modelo colocar em produção.

Redação FalaVIP IA 3 min de leitura
US$ 25por milhão de tokens de saída no modo batch
US$ 5por milhão de tokens de entrada no modo batch
US$ 0,50por milhão de tokens de cache no modo batch

Você provavelmente viu o número do Claude Fable 5 — 62,073 no índice de inteligência, o topo absoluto do catálogo de 475 modelos — e pensou em chamar o CFO antes de testar. Agora existe um caminho diferente, e ele passa por uma fila.

O que é o modo batch, na prática

Pense no batch como o frete econômico de um e-commerce: você junta a encomenda, despacha, e aceita que ela chegue em horas em vez de minutos. A API aceita um lote de requisições, processa em até 24 horas e devolve tudo de uma vez. Em troca, a Anthropic cobra uma fração do preço. No caso do Fable 5, a conta fica assim: US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída, e US$ 0,50 por milhão de tokens em cache — valores publicados no catálogo. O detalhe que pouca gente nota é o cache a meio dólar: se você reaproveita contexto entre chamadas, o custo de input efetivo despenca.

Ficha técnica — Claude Fable 5 (batch)
CampoValor
Identificadoranthropic/claude-fable-5:batch
Criadoranthropic
Preço de entradaUS$ 5.00 / M tokens
Preço de saídaUS$ 25.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.500 / M (90% de desconto)

Quanto custa de verdade, em uma conta real

Imagine um trabalho típico de agente de código: 500 mil tokens de entrada, 200 mil de saída, com metade da entrada vinda de cache. Sem batch, a fatura seria de aproximadamente US$ 17,50 — US$ 12,50 de input cheio, US$ 2,50 de cache e US$ 10 de output. No batch, com o desconto aplicado, o mesmo volume sai por US$ 7,50 — uma economia de 57%. É o tipo de diferença que muda a viabilidade de um produto inteiro, não só de um teste.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Onde o Fable 5 batch se encaixa no tabuleiro

O Fable 5 lidera o ranking de inteligência com folga — o segundo colocado, o GLM 5.2 da Z.ai, marca 52,641 e custa US$ 3,036 por milhão de tokens de saída, já no modo padrão. Em outras palavras: o Fable 5 batch, a US$ 25 por milhão de saída, cobra o mesmo que o GLM 5.2 padrão — só que entrega um salto de quase dez pontos no índice. Para tarefas onde a qualidade do raciocínio importa e a latência não, a equação é difícil de ignorar.

Do outro lado, o modelo mais barato acima de IQ 45 continua sendo o MiniMax M3, a US$ 1,20 por milhão de tokens de saída. São quase quatro vezes mais barato que o Fable 5 batch, mas com um índice de inteligência 45,397 — quase 17 pontos atrás. Quando o orçamento aperta e a tarefa é de menor risco, o M3 ainda é a escolha racional.

Para quem vale a pena

Vale para você se roda pipelines noturnos de geração de código, processamento de documentos em lote, classificação de grandes volumes de tickets, ou qualquer workload em que esperar algumas horas não é problema. Times que já usam o Fable 5 síncrono podem deslocar parte do tráfego para o batch e cortar a fatura pela metade sem trocar de modelo.

Para quem NÃO muda nada

Não muda nada se você precisa de resposta em tempo real — chat ao vivo, autocomplete, agentes interativos. A fila de até 24 horas mata esses casos de uso. Também não muda nada se o seu gargalo é a qualidade do modelo mais barato, e não o preço: o Fable 5 batch continua sendo o Fable 5, com a mesma conta de tokens e a mesma propensão a alucinar quando o contexto é ambíguo. E se você roda volumes pequenos, a economia em dólares pode não pagar o trabalho de reestruturar o pipeline para enviar lotes.

O que fazer com isso hoje

Pegue as chamadas mais pesadas e menos urgentes do seu produto — as que rodam de madrugada, as que processam filas, as que alimentam relatórios — e migre para o endpoint batch do Fable 5. Meça latência real versus economia real. Se o SLA permitir 24 horas e a economia passar de 50%, você acabou de encontrar margem que estava escondida na fatura.

Em uma frase

Mova workloads não urgentes para o batch do Fable 5 e corte a fatura pela metade mantendo o modelo mais inteligente do catálogo.

Perguntas frequentes

Quanto custa o Claude Fable 5 no modo batch?

US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída e US$ 0,50 por milhão de tokens em cache, segundo os dados publicados no catálogo. É cerca de metade do preço do endpoint síncrono.

Qual a diferença entre Claude Fable 5 e Claude Fable 5 batch?

O modelo é o mesmo — Fable 5, topo do ranking de inteligência com índice 62,073. A diferença é operacional: o batch aceita requisições em lote, processa em até 24 horas e cobra um preço menor por token.

Quando NÃO vale a pena usar o Fable 5 batch?

Quando você precisa de resposta em tempo real, como chat, autocomplete ou agentes interativos — a fila de até 24 horas inviabiliza esses casos. Para volumes pequenos, a economia em dólares pode não compensar o trabalho de reestruturar o pipeline.

Leia também