FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

A 62 pontos de IQ, Claude Fable 5 cobra US$ 50 por milhão de saída

O modelo mais inteligente do catálogo estreia com preço de topo e deixa claro quando a conta não compensa

Redação FalaVIP IA 4 min de leitura
US$ 50por milhão de tokens de saída
62,073índice de inteligência do catálogo
US$ 1por milhão de tokens em cache

Você está olhando o índice de inteligência do catálogo e o topo está a 62 pontos. O dono da marca é a Anthropic, o modelo é o Claude Fable 5, lançado ontem, e a conta de saída é de US$ 50 por milhão de tokens. É o dobro do que a OpenAI cobra pelo GPT-5.3-Codex, que aparece em quarto lugar no ranking com 45,5 pontos. A pergunta que paga a sua API é simples: vale pagar caro para estar 16 pontos acima de quem faz quase a mesma coisa por metade do preço?

O que o Fable 5 traz de diferente

O lançamento foi no dia 9 de junho de 2026, então o modelo tem 24 horas de mercado. A Anthropic o posiciona como peça da linha Mythos, voltada para trabalho autônomo de conhecimento e código, com suporte a raciocínio, entrada de texto, imagem e arquivo, e saída apenas em texto. A janela de contexto é de 1 milhão de tokens, o que evita o quebra-cabeça de dividir documentos grandes em vários pedaços.

A ficha técnica resume o que importa para a fatura:

Ficha técnica — Claude Fable 5
CampoValor
Identificadoranthropic/claude-fable-5
Criadoranthropic
Preço de entradaUS$ 10.00 / M tokens
Preço de saídaUS$ 50.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 1.00 / M (90% de desconto)
Índice de inteligência (AA)62.1
Índice de código76.5
Índice agêntico56.6
Pesosfechados
Velocidade de saída65 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Em benchmarks pontuais, o Fable 5 marca 76,5 em coding e 56,6 em agentic. O número de coding é o mais alto do catálogo hoje, mas o de agentic fica na mesma faixa dos concorrentes de topo. Ou seja: o ganho real está em gerar e revisar código, não em rodar agentes longos sem supervisão.

Quem está em cima, quem está embaixo

Para entender o tamanho do fosso, vale olhar o topo do ranking nesta data:

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
Entre os 465 modelos disponíveis no catálogo nesta data.

A distância entre o Fable 5 e o segundo colocado, o Gemini 3.1 Pro Preview, é de quase 15 pontos de IQ. É o maior salto entre as duas primeiras posições do catálogo. Depois disso, a fila anda apertada: Gemini 3.5 Flash, GPT-5.3-Codex e MiniMax M3 estão todos entre 45 e 47. A briga de verdade por aqui é por centavos, não por capacidade.

E é aí que entra o detalhe que muda a conta. O Fable 5 cobra US$ 50 por milhão de tokens de saída. O MiniMax M3, quinto colocado, cobra US$ 1,20 pelo mesmo milhão. São 41 vezes mais barato para entregar um resultado que, no índice agregado, fica 17 pontos atrás. Para a maioria dos fluxos de produção, essa diferença não aparece no produto final — aparece na fatura.

Quando o Fable 5 vale o preço

Pense nele como um carro de Fórmula 1 no meio de uma frota de carros de rua. Você não coloca Fórmula 1 para fazer entrega. Você coloca para a volta rápida.

O Fable 5 faz sentido em três cenários. Primeiro, tarefas de código nas quais o índice de 76,5 em coding é o gargalo e cada token de revisão economiza horas de engenharia. Segundo, prompts longos de 500 mil tokens ou mais, onde a janela de 1M evita o custo de fragmentação e o retrabalho de coerência entre pedaços. Terceiro, jobs de raciocínio em que o orçamento de erro é baixo e o de tempo é alto — análise jurídica, modelagem financeira, pesquisa técnica profunda.

Quando ele não vale

Para qualquer coisa que rode em volume — sumarização de atendimento, classificação de tickets, geração de copy em massa, embeddings semânticos via LLM — o Fable 5 é dinheiro queimado. O Gemini 3.5 Flash, com IQ 46,7 e saída a US$ 9 por milhão, entrega resultado próximo a uma fração do custo. O DeepSeek V4 Pro, com IQ 45,3 e saída a US$ 1,74, é ainda mais barato e fica na mesma faixa de capacidade.

Também não vale se você está comparando com o GPT-5.3-Codex para tarefas de código puro: o Codex cobra US$ 14 por milhão de saída, o Fable 5 cobra US$ 50, e a diferença em coding pode não justificar o triplo do gasto dependendo da sua stack.

O detalhe do cache que ninguém comenta

Um número que merece atenção: tokens em cache custam US$ 1 por milhão no Fable 5. Se o seu fluxo repete um system prompt longo a cada chamada, esse valor derruba o custo médio efetivo em muito. É a diferença entre pagar US$ 50 por milhão de saída e pagar bem menos, contanto que o prefixo seja reaproveitado. Quem roteiriza prompts longos deveria testar isso antes de descartar o modelo pelo preço de tabela.

No fim das contas, o Fable 5 não é para todo call site. É para o call site em que o erro custa caro e a velocidade de raciocínio entra no caminho crítico. Para o resto, o catálogo tem opções a US$ 1,20 que chegam perto.

Em uma frase

Reserve o Claude Fable 5 para tarefas de código e raciocínio pesado com janela longa; para volume, fique com Gemini 3.5 Flash ou DeepSeek V4 Pro e economize 80% a 95% da fatura.

Perguntas frequentes

Quanto custa o Claude Fable 5 na API?

Cobra US$ 10 por milhão de tokens de entrada, US$ 50 por milhão de tokens de saída e US$ 1 por milhão de tokens em cache, segundo os dados do catálogo em 10 de junho de 2026.

O Claude Fable 5 é o modelo mais inteligente do catálogo?

Sim. Lidera o índice de inteligência do catálogo com 62,073 pontos, cerca de 15 pontos acima do segundo colocado, o Gemini 3.1 Pro Preview.

Quando o Claude Fable 5 não vale o preço?

Em fluxos de alto volume como sumarização, classificação e geração de texto em massa, onde modelos como Gemini 3.5 Flash e DeepSeek V4 Pro entregam resultado próximo por uma fração do custo.

Leia também