FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Opus 4.5 em modo batch custa metade — mas só em algumas contas

A Anthropic cortou o preço do modelo mais caro da casa pela metade se você aceitar esperar; vale entender em que fila isso te coloca.

Redação FalaVIP IA 3 min de leitura
US$ 2,50por milhão de tokens de entrada
US$ 12,50por milhão de tokens de saída
US$ 0,25por milhão de tokens em cache (batch)

Você viu o release da Anthropic dizendo que o Opus 4.5 ficou até 45% mais barato. Antes de comemorar, abre a fatura: o corte vale só na fila batch, aquela em que você entrega o trabalho e aceita esperar horas pelo resultado. No caminho síncrono, o preço é outro — e a conta continua salgada.

O que exatamente ficou mais barato

O Claude Opus 4.5 chegou ao catálogo em 24 de novembro de 2025 e, no dia seguinte, já aparece com uma variante :batch. Os números que importam para quem paga a API são três:

  • Entrada: US$ 2,50 por milhão de tokens.
  • Saída: US$ 12,50 por milhão de tokens.
  • Cache: US$ 0,25 por milhão de tokens.

A tarifa de cache é o chamariz. É dez vezes mais barata que a entrada e 50 vezes mais barata que a saída — exatamente o tipo de economia que faz diferença quando você está reenviando o mesmo prompt longo num pipeline de agente. Mas o desconto agressivo só existe na fila batch. Quem precisa de resposta em segundos paga o preço cheio, que não está publicado nesta listagem.

Ficha técnica — Claude Opus 4.5 (batch)
CampoValor
Identificadoranthropic/claude-opus-4.5:batch
Criadoranthropic
Preço de entradaUS$ 2.50 / M tokens
Preço de saídaUS$ 12.50 / M tokens
Janela de contexto200k
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.250 / M (90% de desconto)

Onde ele se encaixa no tabuleiro de hoje

Olha o topo do catálogo de 281 modelos, medido pelo índice de inteligência atual: o OpenAI o3 lidera com IQ 31,096 e cobra US$ 8 por milhão de tokens de saída — quase 60% mais barato na saída do que o Opus 4.5 em modo síncrono costuma aparecer em outras tabelas. Logo atrás vem o Claude Haiku 4.5, da própria Anthropic, com IQ 29,892 e US$ 5 por milhão de saída. É o irmão menor fazendo 96% do trabalho pelo mesmo dinheiro — literalmente.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Entre os 281 modelos disponíveis no catálogo nesta data.

A leitura fria é esta: o Opus 4.5 batch é um frontier model com desconto de fila, não um modelo barato. O índice de inteligência dele não foi divulgado nesta listagem, então não dá para cravar a distância exata para o o3 ou para o Haiku 4.5 — só dá para dizer que a família Opus historicamente lidera em coding e agentic, e que o preço batch te coloca num patamar intermediário.

Para quem vale trocar

Se você roda pipelines noturnos — varredura de código, classificação em massa, geração assíncrona de relatórios, enriquecimento de bases — a fila batch é sua amiga. Você joga o trabalho, acorda com o resultado pronto e paga uma fração. Para esses casos, US$ 12,50 por milhão de saída com cache a US$ 0,25 vira um custo operacional competitivo.

Se você está construindo agente em tempo real ou produto conversacional, esqueça. Batch não serve: o usuário não espera seis horas pela resposta. Aí a conta volta para o preço síncrono, e o Haiku 4.5 — mesmo IQ de 29,892, mesma casa — provavelmente entrega 90% do resultado por uma fração do custo.

Para quem não muda nada

  • Quem já roda o o3 e está satisfeito com raciocínio: o Opus 4.5 batch não traz argumento de preço forte o suficiente para migrar sem testar.
  • Quem usa Haiku 4.5 para tarefas médias: subir para Opus batch só se justifica em coding pesado ou agentic longo, e mesmo assim vale medir antes.
  • Quem precisa de resposta imediata: batch não é opção.

O que fazer com isso amanhã

A regra prática: antes de migrar qualquer fluxo para Opus 4.5 batch, faça a conta do custo total por tarefa concluída, não por token. Se o trabalho é assíncrono e cabe na janela batch, o desconto é real e vale testar. Se é interativo, o Haiku 4.5 da própria Anthropic é o movimento óbvio — mesma casa, IQ próximo, conta menor. E se você está comparando com OpenAI, o o3 segue sendo a referência de topo em inteligência bruta, com saída mais barata que o Opus síncrono.

Em outras palavras: o Opus 4.5 batch é uma oportunidade de nicho, não uma troca universal. Use onde a fila batch faz sentido; ignore onde ela não cabe.

Em uma frase

Rode Opus 4.5 em batch só para jobs assíncronos; para tudo que precisa de resposta na hora, o Haiku 4.5 da própria Anthropic continua sendo o melhor custo-benefício da casa.

Perguntas frequentes

Quanto custa o Claude Opus 4.5 em modo batch?

US$ 2,50 por milhão de tokens de entrada, US$ 12,50 por milhão de tokens de saída e US$ 0,25 por milhão de tokens em cache. Os descontos valem apenas na fila batch, que entrega o resultado em horas, não em tempo real.

Opus 4.5 batch é mais barato que o OpenAI o3?

Na saída, o Opus 4.5 batch cobra US$ 12,50 por milhão de tokens contra US$ 8 do o3 — ou seja, o o3 segue mais barato na saída. A vantagem do Opus batch está no preço de cache (US$ 0,25) e em workloads de coding e agentic, não no custo bruto por token.

Quando NÃO vale a pena usar Opus 4.5 batch?

Em qualquer fluxo que precise de resposta imediata: chatbots, agentes em tempo real, ferramentas interativas. Nesses casos, a fila batch não se aplica e o Claude Haiku 4.5 da própria Anthropic costuma entregar resultado próximo por uma fração do custo.

Leia também