Opus 4.5 em modo batch custa metade — mas só em algumas contas
A Anthropic cortou o preço do modelo mais caro da casa pela metade se você aceitar esperar; vale entender em que fila isso te coloca.
Você viu o release da Anthropic dizendo que o Opus 4.5 ficou até 45% mais barato. Antes de comemorar, abre a fatura: o corte vale só na fila batch, aquela em que você entrega o trabalho e aceita esperar horas pelo resultado. No caminho síncrono, o preço é outro — e a conta continua salgada.
O que exatamente ficou mais barato
O Claude Opus 4.5 chegou ao catálogo em 24 de novembro de 2025 e, no dia seguinte, já aparece com uma variante :batch. Os números que importam para quem paga a API são três:
- Entrada: US$ 2,50 por milhão de tokens.
- Saída: US$ 12,50 por milhão de tokens.
- Cache: US$ 0,25 por milhão de tokens.
A tarifa de cache é o chamariz. É dez vezes mais barata que a entrada e 50 vezes mais barata que a saída — exatamente o tipo de economia que faz diferença quando você está reenviando o mesmo prompt longo num pipeline de agente. Mas o desconto agressivo só existe na fila batch. Quem precisa de resposta em segundos paga o preço cheio, que não está publicado nesta listagem.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.5:batch |
| Criador | anthropic |
| Preço de entrada | US$ 2.50 / M tokens |
| Preço de saída | US$ 12.50 / M tokens |
| Janela de contexto | 200k |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.250 / M (90% de desconto) |
Onde ele se encaixa no tabuleiro de hoje
Olha o topo do catálogo de 281 modelos, medido pelo índice de inteligência atual: o OpenAI o3 lidera com IQ 31,096 e cobra US$ 8 por milhão de tokens de saída — quase 60% mais barato na saída do que o Opus 4.5 em modo síncrono costuma aparecer em outras tabelas. Logo atrás vem o Claude Haiku 4.5, da própria Anthropic, com IQ 29,892 e US$ 5 por milhão de saída. É o irmão menor fazendo 96% do trabalho pelo mesmo dinheiro — literalmente.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
A leitura fria é esta: o Opus 4.5 batch é um frontier model com desconto de fila, não um modelo barato. O índice de inteligência dele não foi divulgado nesta listagem, então não dá para cravar a distância exata para o o3 ou para o Haiku 4.5 — só dá para dizer que a família Opus historicamente lidera em coding e agentic, e que o preço batch te coloca num patamar intermediário.
Para quem vale trocar
Se você roda pipelines noturnos — varredura de código, classificação em massa, geração assíncrona de relatórios, enriquecimento de bases — a fila batch é sua amiga. Você joga o trabalho, acorda com o resultado pronto e paga uma fração. Para esses casos, US$ 12,50 por milhão de saída com cache a US$ 0,25 vira um custo operacional competitivo.
Se você está construindo agente em tempo real ou produto conversacional, esqueça. Batch não serve: o usuário não espera seis horas pela resposta. Aí a conta volta para o preço síncrono, e o Haiku 4.5 — mesmo IQ de 29,892, mesma casa — provavelmente entrega 90% do resultado por uma fração do custo.
Para quem não muda nada
- Quem já roda o o3 e está satisfeito com raciocínio: o Opus 4.5 batch não traz argumento de preço forte o suficiente para migrar sem testar.
- Quem usa Haiku 4.5 para tarefas médias: subir para Opus batch só se justifica em coding pesado ou agentic longo, e mesmo assim vale medir antes.
- Quem precisa de resposta imediata: batch não é opção.
O que fazer com isso amanhã
A regra prática: antes de migrar qualquer fluxo para Opus 4.5 batch, faça a conta do custo total por tarefa concluída, não por token. Se o trabalho é assíncrono e cabe na janela batch, o desconto é real e vale testar. Se é interativo, o Haiku 4.5 da própria Anthropic é o movimento óbvio — mesma casa, IQ próximo, conta menor. E se você está comparando com OpenAI, o o3 segue sendo a referência de topo em inteligência bruta, com saída mais barata que o Opus síncrono.
Em outras palavras: o Opus 4.5 batch é uma oportunidade de nicho, não uma troca universal. Use onde a fila batch faz sentido; ignore onde ela não cabe.
Rode Opus 4.5 em batch só para jobs assíncronos; para tudo que precisa de resposta na hora, o Haiku 4.5 da própria Anthropic continua sendo o melhor custo-benefício da casa.
Perguntas frequentes
Quanto custa o Claude Opus 4.5 em modo batch?
US$ 2,50 por milhão de tokens de entrada, US$ 12,50 por milhão de tokens de saída e US$ 0,25 por milhão de tokens em cache. Os descontos valem apenas na fila batch, que entrega o resultado em horas, não em tempo real.
Opus 4.5 batch é mais barato que o OpenAI o3?
Na saída, o Opus 4.5 batch cobra US$ 12,50 por milhão de tokens contra US$ 8 do o3 — ou seja, o o3 segue mais barato na saída. A vantagem do Opus batch está no preço de cache (US$ 0,25) e em workloads de coding e agentic, não no custo bruto por token.
Quando NÃO vale a pena usar Opus 4.5 batch?
Em qualquer fluxo que precise de resposta imediata: chatbots, agentes em tempo real, ferramentas interativas. Nesses casos, a fila batch não se aplica e o Claude Haiku 4.5 da própria Anthropic costuma entregar resultado próximo por uma fração do custo.