Anthropic cobra 6x por velocidade no Opus 4.7 Fast
A variante rápida do modelo mais caro da casa custa US$ 150 por milhão de tokens de saída — e chega sem nota de inteligência no catálogo.
A conta da Anthropic subiu hoje. A casa abriu o catálogo com Claude Opus 4.7 (Fast), uma variante do Opus 4.7 que entrega a mesma capacidade e cobra seis vezes mais caro por token de saída — US$ 150 por milhão, contra os US$ 25 do modelo padrão. É a primeira vez que a Anthropic coloca um "modo rápido" como SKU separado, e o preço deixa claro que velocidade, aqui, é produto premium.
O que exatamente ficou 6x mais caro
O pacote é simples de explicar e doloroso de pagar. Entrada: US$ 30 por milhão de tokens. Saída: US$ 150. Cache de leitura: US$ 3 por milhão. Janela de contexto: 1 milhão de tokens. Modalidade: texto, imagem e arquivo gerando texto. O "Fast" está na velocidade de inferência, não no que o modelo sabe fazer — a descrição no catálogo é literal: capacidades idênticas ao Opus 4.7, só com saída mais rápida e cobrança multiplicada.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.7-fast |
| Criador | anthropic |
| Preço de entrada | US$ 30.00 / M tokens |
| Preço de saída | US$ 150.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 3.00 / M (90% de desconto) |
Para quem não usa Opus no dia a dia, o número parece abstrato. Traduzindo: um job que gere 100 mil tokens de saída no Gemini 3.1 Pro Preview custa US$ 1,20. No Opus 4.7 Fast, custa US$ 15. No DeepSeek V4 Pro, US$ 0,17. A diferença entre o mais barato e o mais caro do topo do mercado hoje é de quase 90x no token de saída.
Onde o Fast se encaixa no tabuleiro
Olhando o topo do catálogo hoje, a fotografia é esta:
Gemini 3.1 Pro Preview lidera em índice de inteligência (47,7) e cobra US$ 12 por milhão de saída. GPT-5.3-Codex vem logo atrás em IQ (45,5) e sai a US$ 14. DeepSeek V4 Pro entrega 45,3 de IQ por US$ 1,74 — disparado o melhor negócio entre os modelos acima de 45 pontos. O Opus 4.7 Fast entra sem nota de inteligência no catálogo e cobra US$ 150.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
| MiMo-V2.5 | 38.0 | 0.28 |
Em outras palavras: você está pagando o preço mais alto do mercado por um modelo cujo desempenho bruto ainda não foi medido publicamente no índice da casa, e que compete diretamente com o DeepSeek V4 Pro — que custa 86 vezes menos por token de saída e tem IQ medido.
Para quem vale a pena
Tem um caso de uso real aqui, e não é o de todo mundo. Se você tem um pipeline agentic que fica esperando o modelo terminar — geração de código em loop, tool calls encadeadas, extração em lote — cada segundo de latência custa dinheiro em infraestrutura ociosa. Multiplicar a velocidade de saída pode valer o prêmio de 6x, desde que o ganho de throughput cubra o custo extra.
Para quem está usando Opus 4.7 padrão para chat, redação, análise ou RAG, não muda nada. O modelo padrão continua existindo no catálogo (a referência está na descrição do Fast) e a relação custo-benefício segue a mesma. A nova SKU só faz sentido se latência for o gargalo, não qualidade nem preço.
Para quem está comparando Anthropic com Google, OpenAI ou DeepSeek sem vínculo emocional com a casa, a conta fica ainda mais dura: você paga caro para ter velocidade, mas entrega bruta de inteligência e preço estão contra você.
O detalhe que ninguém comenta
O lançamento chega sem nota de IQ, sem benchmark de coding, sem dado de agentic e sem país de origem no catálogo. Em maio de 2026, com 53 modelos novos nos últimos 30 dias e 443 no total, isso é informação faltando onde normalmente aparece. A Anthropic está apostando que "mais rápido" é argumento de venda suficiente — e cobra de acordo.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Opus 4.7 (Fast) (o novo) | — | 30 | 150 | 1M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
A pergunta que fica é se o mercado aceita. O Gemini 3.1 Pro Preview já entrega o melhor IQ do catálogo a US$ 12 de saída. O DeepSeek V4 Pro destrói qualquer cálculo de custo-benefício acima de 45 de IQ. Para o Opus 4.7 Fast encontrar cliente, vai precisar de um gargalo de latência que justifique US$ 150 por milhão — e de uma medição independente que prove que a velocidade não comeu capacidade no caminho.
Só vale trocar para o Opus 4.7 Fast se latência for o gargalo do seu pipeline e o ganho de throughput cobrir o prêmio de 6x; para o resto, o DeepSeek V4 Pro segue sendo o melhor IQ por dólar e o Gemini 3.1 Pro Preview o topo absoluto em inteligência.
Perguntas frequentes
Quanto custa o Claude Opus 4.7 Fast?
US$ 30 por milhão de tokens de entrada e US$ 150 por milhão de tokens de saída, com cache de leitura a US$ 3 por milhão. É seis vezes o preço do Opus 4.7 padrão no token de saída.
O Opus 4.7 Fast é melhor que o Gemini 3.1 Pro Preview?
O catálogo não publicou índice de inteligência para o Opus 4.7 Fast até agora. O Gemini 3.1 Pro Preview lidera o ranking com IQ 47,7 e custa US$ 12 por milhão de saída — 12,5x mais barato que o Fast.
Para quem o modo rápido do Opus faz sentido?
Para pipelines agentic e jobs em lote onde latência de saída é gargalo e o ganho de velocidade compensa o prêmio de 6x. Para chat, RAG e uso geral, o Opus 4.7 padrão ou alternativas como DeepSeek V4 Pro entregam o mesmo ou mais por menos.