Claude Fable 5 chega a US$ 50 por milhão de saída e destrava 62 de IQ
Anthropic põe a família inteira no ar hoje; o flagship custa 4x o Gemini 3.5 Flash e entrega o dobro de inteligência no índice atual.
A conta que ninguém quer abrir
A Anthropic soltou hoje a família Claude Fable 5 e o número que vai te interessar não está no release — está na fatura. O flagship cobra US$ 50 por milhão de tokens de saída e US$ 10 por milhão de entrada, com cache de leitura a US$ 1. Em comparação direta, o Gemini 3.5 Flash, que também é multimodal e roda em janela grande, sai por US$ 9 de saída. São pouco mais de cinco vezes mais barato por token. A diferença existe, e é grande; mas o que a Anthropic está vendendo é outra coisa.
O que o índice de inteligência diz hoje
No recorte atual da Artificial Analysis, o Claude Fable 5 marca 62,073 — o topo isolado do catálogo, que tem 465 modelos listados hoje vindos de 61 criadores. O segundo colocado, Gemini 3.1 Pro Preview, está em 47,738. A diferença é de quase 15 pontos num índice que costuma andar de poucos em poucos pontos entre concorrentes diretos. Em coding, o Fable 5 marca 76,491; em agentic, 56,595. É um perfil pensado para trabalho autônomo de conhecimento e código, não para bate-pronto.
Traduzindo o marketing em conta de API
Quando o release diz "Mythos-class" e "autonomous knowledge work", o que cai no seu dashboard é isso: 1 milhão de tokens de contexto, raciocínio ligado por padrão, multimodal (texto, imagem e arquivo entram; só texto sai) e velocidade medida em 65,05 tokens por segundo. Não é o modelo mais rápido do mercado, mas está longe de ser lento. A versão :batch corta o preço pela metade — US$ 25 de saída, US$ 5 de entrada — para quem pode esperar a janela assíncrona processar.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-fable-5 |
| Criador | anthropic |
| Preço de entrada | US$ 10.00 / M tokens |
| Preço de saída | US$ 50.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 1.00 / M (90% de desconto) |
| Índice de inteligência (AA) | 62.1 |
| Índice de código | 76.5 |
| Índice agêntico | 56.6 |
| Pesos | fechados |
| Velocidade de saída | 65 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Para quem vale, e para quem não muda nada
Se o seu gargalo é qualidade bruta em tarefas longas — refatoração pesada, agente rodando por horas, análise de documento gigante — o Fable 5 entra na shortlist. É o modelo de fronteira mais caro do dia, mas entrega o índice mais alto do catálogo. Se o seu gargalo é custo por requisição num produto com milhares de chamadas, o MiniMax M3 continua sendo o melhor negócio acima de IQ 45: US$ 1,20 por milhão de saída e 45,397 de índice. O DeepSeek V4 Pro vem logo atrás, a US$ 1,74. Para esses casos, pagar 25 a 40 vezes mais por token não compra o triplo de inteligência — compra, talvez, 35% a mais, e só em benchmarks que medem raciocínio denso.
Onde ele se encaixa no tabuleiro
A Anthropic é americana, de peso fechado (sem open weights), e chega para brigar diretamente com o Gemini 3.1 Pro Preview e o GPT-5.3-Codex — ambos abaixo dos 48 de IQ e com saída entre US$ 12 e US$ 14. Em outras palavras: o Fable 5 cobra cerca de 3,5x mais que o GPT-5.3-Codex e 4x mais que o Gemini 3.5 Flash por token de saída. A pergunta não é se ele é melhor — é, no índice atual, ele é — mas se essa diferença cabe na sua margem.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Fable 5 (o novo) | 62.1 | 10 | 50 | 1M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| Gemini 3.5 Flash | 46.7 | 1.5 | 9 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
A linha completa de hoje
A Anthropic não lançou só o flagship. A versão :batch é a mesma janela de 1M de contexto com tarifa reduzida. Para quem está integrando, vale testar primeiro a fila assíncrona: metade do custo, mesma capacidade, só não serve para latência baixa.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Fable 5 (batch) | 5 | 25 | 1M |
O que fazer com isso amanhã
Se você já roda Claude Sonnet ou Opus em produção, migre uma amostra do tráfego real para o Fable 5 e meça custo por tarefa concluída, não por token. Em agente, a diferença de capability costuma compensar o preço; em chat curto, quase nunca. E se o orçamento é o que manda, mantenha o Fable 5 para o topo do funil e deixe o MiniMax M3 ou o DeepSeek V4 Pro no resto do pipeline.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Fable 5 | 62.1 | 50 |
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiniMax M3 | 45.4 | 1.2 |
Roteie por tarefa: Fable 5 onde a capability pesa mais que o custo por token; MiniMax M3 ou DeepSeek V4 Pro no resto do pipeline para manter a conta sob controle.
Perguntas frequentes
Quanto custa o Claude Fable 5 por milhão de tokens?
US$ 10 por milhão de entrada e US$ 50 por milhão de saída no modo padrão. Na versão batch, cai para US$ 5 de entrada e US$ 25 de saída. Cache de leitura sai por US$ 1 por milhão.
O Claude Fable 5 é o modelo mais inteligente do catálogo hoje?
Sim, pelo índice atual da Artificial Analysis: 62,073, contra 47,738 do segundo colocado (Gemini 3.1 Pro Preview). É o topo isolado entre 465 modelos listados.
Vale trocar o Gemini 3.5 Flash pelo Claude Fable 5?
Depende do uso. O Fable 5 custa cerca de 4x mais por token de saída e entrega um salto grande em raciocínio e coding. Para agentes longos e tarefas de fronteira, pode compensar; para chat de alto volume, quase nunca.