Claude Opus 4.7 Fast cobra 6x mais caro para responder mais rápido
A Anthropic lançou uma variante 'rápida' do Opus 4.7 com janela de 1M de tokens e preço premium. Vale para quem precisa de velocidade — e só para esses.
O gancho está no preço, não no lançamento
Você viu o anúncio da Anthropic e foi direto olhar a tabela de preços. Fez bem. O Claude Opus 4.7 (Fast) é o mesmo Opus 4.7 que já existia — só que com modo de alta velocidade e cobrança premium de 6x sobre a saída. Em outras palavras: você não está comprando um modelo novo, está pagando caro para receber a mesma resposta mais rápido.
A conta fica assim: US$ 30 por milhão de tokens de entrada e US$ 150 por milhão de tokens de saída. O cache, que costuma ser onde dá para economizar em chamadas repetidas, sai a US$ 3 por milhão. Multiplique esses números pelo seu volume mensal e a diferença aparece rápido.
O que exatamente ficou mais rápido
A descrição oficial diz "identical capabilities with higher output speed". Traduzindo: a capacidade do modelo é a mesma do Opus 4.7 padrão. O que muda é a vazão — quantos tokens por segundo a API cospe de volta. Para fluxos onde cada segundo conta, isso muda a vida. Para batch noturno, não muda absolutamente nada.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.7-fast |
| Criador | anthropic |
| Preço de entrada | US$ 30.00 / M tokens |
| Preço de saída | US$ 150.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 3.00 / M (90% de desconto) |
Quem está na frente hoje — e quanto custa
Para situar o Fast no tabuleiro, olhe quem está no topo do índice de inteligência e quanto custa cada um. O ranking atual tem o Gemini 3.1 Pro Preview na frente (IQ 47,7), seguido do Gemini 3.5 Flash (46,7) e do GPT-5.3-Codex (45,5). O DeepSeek V4 Pro aparece logo atrás com IQ 45,3 — e é, disparado, o mais barato do grupo seleto acima de IQ 45: US$ 1,74 por milhão de tokens de saída. O Flash da Google sai a US$ 9. O Pro Preview, a US$ 12.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
Em outras palavras: para cada dólar gasto em saída no Opus Fast, você roda quase 9 chamadas equivalentes no DeepSeek V4 Pro com inteligência próxima. A conta não fecha do mesmo jeito para todo mundo.
Para quem isso vale a pena
Se você está construindo um produto onde o usuário está esperando resposta na tela — um copilot, um chat com latência percebida, um agente que precisa iterar várias vezes por minuto — o modo Fast justifica o premium. A janela de 1 milhão de tokens também é generosa para despejar documentos longos sem picotar.
Se o seu caso de uso é processar 50 mil documentos à noite, gerar embeddings em batch ou qualquer coisa em que a velocidade não é gargalo, você está pagando 6x por nada. O Opus 4.7 padrão ou um modelo mais barato entrega o mesmo resultado.
Quando NÃO vale a pena
Três situações em que o Fast é dinheiro queimado:
- Pipeline assíncrono, fila ou job noturno. Velocidade não importa.
- Orçamento apertado e volume alto. O DeepSeek V4 Pro ou o Gemini 3.5 Flash fazem 90% do trabalho por uma fração do custo.
- Tarefas onde o gargalo é raciocínio, não geração. Modelos com índice de inteligência mais alto podem entregar resposta melhor mesmo sendo mais lentos.
O que fazer com isso amanhã
Antes de trocar qualquer coisa em produção, meça onde a latência de geração está realmente te machucando. Se você nunca reclamou da velocidade do Opus padrão, o Fast não vai te dar nada novo — só uma fatura maior. Se a reclamação é constante e o usuário sente, vale rodar um piloto de uma semana e comparar o custo marginal por usuário ativo. O número que importa não é o preço por milhão de tokens, é o quanto cada resposta te custa no fim do mês.
Só troque para o Opus 4.7 Fast se a latência de geração for gargalo real no seu produto; em qualquer outro cenário, o custo extra de 6x não se justifica.
Perguntas frequentes
Claude Opus 4.7 Fast é um modelo novo?
Não. É a mesma versão do Opus 4.7 com modo de alta velocidade ativado. As capacidades são idênticas; o que muda é a vazão de tokens por segundo e o preço, que é 6x maior na saída.
Quanto custa o Claude Opus 4.7 Fast?
US$ 30 por milhão de tokens de entrada, US$ 150 por milhão de tokens de saída e US$ 3 por milhão de tokens em cache. É um dos preços mais altos do catálogo para a faixa.
Qual a alternativa mais barata com inteligência próxima?
O DeepSeek V4 Pro, com IQ 45,3 e US$ 1,74 por milhão de tokens de saída — cerca de 86 vezes mais barato na saída que o Opus 4.7 Fast.