Claude Opus 4.6 batch: US$ 12,50 por milhão de saída vale o que?
Anthropic lança a versão batch do Opus 4.6 três dias depois do modelo principal. A conta fica 50% menor, mas tem letra miúda.
O desconto que parece óbvio
Você viu o anúncio e fez a conta de cabeça: Opus 4.6 batch cobra metade do preço do Opus 4.6 normal. Parece bom demais. Três dias depois do lançamento principal, a Anthropic colocou no catálogo a versão :batch, e o que muda é exatamente isso — o número na fatura cai pela metade. O resto, a promessa de ser o modelo mais forte da casa para código e fluxos longos, continua sendo marketing até alguém medir.
O detalhe que ninguém comenta é o que a palavra batch significa na prática. Não é um botão mágico que você clica no playground. É um endpoint com SLA diferente: você envia um lote de requisições, o processamento pode levar até 24 horas, e em troca paga 50% menos. Para quem roda agente que processa 200k tokens de log de madrugada, isso muda a conta. Para quem precisa de resposta em 800ms, não muda nada.
A conta de quem usa de verdade
Vamos aos números sem maquiagem. Entrada: US$ 2,50 por milhão de tokens. Saída: US$ 12,50 por milhão. Cache: US$ 0,25 por milhão. Comparado com o Opus 4.6 fora do batch (US$ 5 entrada, US$ 25 saída, US$ 0,50 cache), é literalmente metade em todas as linhas.
Traduzindo para um caso real: um agente que consome 500k tokens de entrada e gera 200k de saída por execução. No batch, são US$ 1,25 de entrada + US$ 2,50 de saída = US$ 3,75 por execução. Fora do batch, seriam US$ 7,50. Em mil execuções por mês, a diferença é US$ 3.750 — paga um almoço ou um engenheiro júnior, dependendo do mês.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.6 |
| Criador | anthropic |
| Preço de entrada | US$ 5.00 / M tokens |
| Preço de saída | US$ 25.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.500 / M (90% de desconto) |
Onde isso encaixa no tabuleiro
Olhando o catálogo de hoje, o topo de inteligência medido está com o Xiaomi MiMo-V2-Flash (IQ 34), seguido do OpenAI o3 (IQ 31) e do Claude Haiku 4.5 (IQ 29). O Opus 4.6 não tem índice publicado ainda — e isso por si só já diz algo: a Anthropic não liberou benchmark para essa rodada, então qualquer comparação de capacidade é chute.
O que dá para comparar é preço. O Haiku 4.5, da própria Anthropic, sai a US$ 5 por milhão de saída — menos da metade do Opus batch. O o3 cobra US$ 8. O MiMo-V2-Flash, US$ 0,30. Se a sua única métrica for "tokens por dólar", o Opus 4.6 batch perde para todo mundo acima dele na régua de preço. Ele só volta a fazer sentido se você precisar especificamente do que a Anthropic promete: raciocínio longo, contexto de 1 milhão de tokens, e comportamento de agente em workflows inteiros.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Coder Next | 21.3 | 0.8 |
Para quem vale
Vale para você se: roda jobs noturnos de indexação, refatoração em massa, geração de documentação a partir de codebase, ou qualquer tarefa em que 24 horas de SLA é aceitável. Vale especialmente se você já está no Opus normal e viu a conta chegar — o batch é o caminho para manter a mesma capacidade sem vender um rim.
Não vale para você se: precisa de resposta em tempo real (chat, IDE com autocomplete, ferramenta interativa). Não vale se a sua carga é tão pequena que a economia de US$ 3,75 por execução não paga o trabalho de configurar o endpoint batch. E não vale se você está comparando capacidade pura — sem benchmark público, o Haiku 4.5 a US$ 5 é a aposta mais racional da casa Anthropic até segunda ordem.
O que fazer agora
Se você já tem integração com a API da Anthropic, o teste é simples: pegue o job mais caro do mês, replique no endpoint batch, meça a economia. Se você está começando do zero, comece pelo Haiku 4.5 e só escale para Opus batch quando o Haiku não der conta. A regra de bolso continua a mesma: o modelo mais caro só compensa quando o mais barato já provou que não resolve.
Use Opus 4.6 batch para jobs assíncronos com SLA de 24h e economia real na fatura; para tudo que exige resposta em tempo real, o Haiku 4.5 continua sendo a escolha racional dentro da Anthropic.
Perguntas frequentes
Qual a diferença entre Claude Opus 4.6 e Opus 4.6 batch?
É o mesmo modelo, mas o endpoint batch aceita apenas requisições em lote com SLA de até 24 horas e cobra 50% menos em todas as linhas — entrada, saída e cache de prompt.
Quanto custa o Claude Opus 4.6 batch por milhão de tokens?
Entrada sai a US$ 2,50, saída a US$ 12,50 e cache de prompt a US$ 0,25 por milhão de tokens. É exatamente metade do preço do Opus 4.6 fora do batch.
Opus 4.6 batch serve para chat em tempo real?
Não. O endpoint batch é projetado para processamento assíncrono com latência de até 24 horas. Para respostas em tempo real, use o Opus 4.6 padrão ou o Haiku 4.5.