FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Anthropic cobra 6x por velocidade no Opus 4.7 Fast

A variante rápida do modelo mais caro da casa custa US$ 150 por milhão de tokens de saída — e chega sem nota de inteligência no catálogo.

Redação FalaVIP IA 3 min de leitura
US$ 150por milhão de tokens de saída
US$ 30por milhão de tokens de entrada
6xpreço do modo rápido sobre o Opus 4.7 padrão

A conta da Anthropic subiu hoje. A casa abriu o catálogo com Claude Opus 4.7 (Fast), uma variante do Opus 4.7 que entrega a mesma capacidade e cobra seis vezes mais caro por token de saída — US$ 150 por milhão, contra os US$ 25 do modelo padrão. É a primeira vez que a Anthropic coloca um "modo rápido" como SKU separado, e o preço deixa claro que velocidade, aqui, é produto premium.

O que exatamente ficou 6x mais caro

O pacote é simples de explicar e doloroso de pagar. Entrada: US$ 30 por milhão de tokens. Saída: US$ 150. Cache de leitura: US$ 3 por milhão. Janela de contexto: 1 milhão de tokens. Modalidade: texto, imagem e arquivo gerando texto. O "Fast" está na velocidade de inferência, não no que o modelo sabe fazer — a descrição no catálogo é literal: capacidades idênticas ao Opus 4.7, só com saída mais rápida e cobrança multiplicada.

Ficha técnica — Claude Opus 4.7 (Fast)
CampoValor
Identificadoranthropic/claude-opus-4.7-fast
Criadoranthropic
Preço de entradaUS$ 30.00 / M tokens
Preço de saídaUS$ 150.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 3.00 / M (90% de desconto)

Para quem não usa Opus no dia a dia, o número parece abstrato. Traduzindo: um job que gere 100 mil tokens de saída no Gemini 3.1 Pro Preview custa US$ 1,20. No Opus 4.7 Fast, custa US$ 15. No DeepSeek V4 Pro, US$ 0,17. A diferença entre o mais barato e o mais caro do topo do mercado hoje é de quase 90x no token de saída.

Onde o Fast se encaixa no tabuleiro

Olhando o topo do catálogo hoje, a fotografia é esta:

Preço de saída (US$ por milhão de tokens)
Claude Opus 4.7 (Fast)150Gemini 3.1 Pro Preview12GPT-5.3-Codex14DeepSeek V4 Pro 04232,0845US$/M
Fonte: OpenRouter

Gemini 3.1 Pro Preview lidera em índice de inteligência (47,7) e cobra US$ 12 por milhão de saída. GPT-5.3-Codex vem logo atrás em IQ (45,5) e sai a US$ 14. DeepSeek V4 Pro entrega 45,3 de IQ por US$ 1,74 — disparado o melhor negócio entre os modelos acima de 45 pontos. O Opus 4.7 Fast entra sem nota de inteligência no catálogo e cobra US$ 150.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
MiMo-V2.538.00.28
Entre os 443 modelos disponíveis no catálogo nesta data.
Inteligência × preço de saída
Gemini 3.1 Pro PreviewGPT-5.3-CodexDeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência

Em outras palavras: você está pagando o preço mais alto do mercado por um modelo cujo desempenho bruto ainda não foi medido publicamente no índice da casa, e que compete diretamente com o DeepSeek V4 Pro — que custa 86 vezes menos por token de saída e tem IQ medido.

Para quem vale a pena

Tem um caso de uso real aqui, e não é o de todo mundo. Se você tem um pipeline agentic que fica esperando o modelo terminar — geração de código em loop, tool calls encadeadas, extração em lote — cada segundo de latência custa dinheiro em infraestrutura ociosa. Multiplicar a velocidade de saída pode valer o prêmio de 6x, desde que o ganho de throughput cubra o custo extra.

Para quem está usando Opus 4.7 padrão para chat, redação, análise ou RAG, não muda nada. O modelo padrão continua existindo no catálogo (a referência está na descrição do Fast) e a relação custo-benefício segue a mesma. A nova SKU só faz sentido se latência for o gargalo, não qualidade nem preço.

Para quem está comparando Anthropic com Google, OpenAI ou DeepSeek sem vínculo emocional com a casa, a conta fica ainda mais dura: você paga caro para ter velocidade, mas entrega bruta de inteligência e preço estão contra você.

O detalhe que ninguém comenta

O lançamento chega sem nota de IQ, sem benchmark de coding, sem dado de agentic e sem país de origem no catálogo. Em maio de 2026, com 53 modelos novos nos últimos 30 dias e 443 no total, isso é informação faltando onde normalmente aparece. A Anthropic está apostando que "mais rápido" é argumento de venda suficiente — e cobra de acordo.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Opus 4.7 (Fast) (o novo)301501M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
DeepSeek V4 Pro 042345.31.04232.08451.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A pergunta que fica é se o mercado aceita. O Gemini 3.1 Pro Preview já entrega o melhor IQ do catálogo a US$ 12 de saída. O DeepSeek V4 Pro destrói qualquer cálculo de custo-benefício acima de 45 de IQ. Para o Opus 4.7 Fast encontrar cliente, vai precisar de um gargalo de latência que justifique US$ 150 por milhão — e de uma medição independente que prove que a velocidade não comeu capacidade no caminho.

Em uma frase

Só vale trocar para o Opus 4.7 Fast se latência for o gargalo do seu pipeline e o ganho de throughput cobrir o prêmio de 6x; para o resto, o DeepSeek V4 Pro segue sendo o melhor IQ por dólar e o Gemini 3.1 Pro Preview o topo absoluto em inteligência.

Perguntas frequentes

Quanto custa o Claude Opus 4.7 Fast?

US$ 30 por milhão de tokens de entrada e US$ 150 por milhão de tokens de saída, com cache de leitura a US$ 3 por milhão. É seis vezes o preço do Opus 4.7 padrão no token de saída.

O Opus 4.7 Fast é melhor que o Gemini 3.1 Pro Preview?

O catálogo não publicou índice de inteligência para o Opus 4.7 Fast até agora. O Gemini 3.1 Pro Preview lidera o ranking com IQ 47,7 e custa US$ 12 por milhão de saída — 12,5x mais barato que o Fast.

Para quem o modo rápido do Opus faz sentido?

Para pipelines agentic e jobs em lote onde latência de saída é gargalo e o ganho de velocidade compensa o prêmio de 6x. Para chat, RAG e uso geral, o Opus 4.7 padrão ou alternativas como DeepSeek V4 Pro entregam o mesmo ou mais por menos.

Leia também