Claude Opus 4.6 custa US$ 25 por milhão de saída e mira o topo do catálogo
Anthropic libera o flagship do dia com janela de 1M de tokens e cache a US$ 0,50; versão batch sai pela metade do preço.
O que o anúncio diz e o que a conta mostra
A Anthropic soltou hoje o Claude Opus 4.6 com a proposta de ser o modelo mais forte da casa para coding e para agentes que rodam fluxos inteiros, não só um prompt de cada vez. Janela de 1 milhão de tokens, entrada multimodal (texto, imagem e arquivo) e um preço de US$ 5 por milhão de entrada e US$ 25 por milhão de saída. Em paralelo, veio a variante :batch pela metade: US$ 2,5 e US$ 12,50, respectivamente.
Traduzindo o release: o que ficou mais barato foi o processamento em lote assíncrono, que costuma servir para jobs noturnos, reindexação e backfills. O preço do modo interativo, que é o que aparece na fatura do seu produto, continua na faixa premium. O detalhe que mais mexe no custo de verdade é o cache de prompt: US$ 0,50 por milhão de tokens. Se você repete system prompt e contexto a cada chamada, é aí que a conta despenca — não no preço de tabela.
Onde o Opus 4.6 se encaixa no tabuleiro
O catálogo tem 330 modelos listados hoje, vindos de 52 criadores, e 17 foram lançados nos últimos 30 dias. O topo atual do índice de inteligência é o Xiaomi MiMo-V2-Flash, com IQ 34,024 e saída a US$ 0,30 por milhão — uma combinação que, até agora, ninguém do bloco americano oferecia. Logo abaixo aparece o OpenAI o3, com IQ 31,096 e saída a US$ 8, seguido do próprio Claude Haiku 4.5 da Anthropic, em IQ 29,892 e US$ 5.
O ponto é simples: o Opus 4.6 entra como flagship de preço alto, sem índice publicado no lançamento. Isso não é raro — a Anthropic costuma divulgar benchmarks próprios antes de entrar em índices agregados — mas significa que, por enquanto, a comparação direta tem de ser pelo preço e pelo posicionamento.
A conta, comparada
Se você está pagando US$ 25 por milhão de saída no Opus 4.6 e precisa de algo mais barato para volume, o MiMo-V2-Flash entrega IQ maior no índice atual cobrando US$ 0,30 — quase 83 vezes menos por token de saída. O o3, da OpenAI, sai por US$ 8 com IQ próximo do topo. O Haiku 4.5, da própria Anthropic, fica em US$ 5 e é o primo barato da casa.
A versão :batch do Opus 4.6 a US$ 12,50 não muda esse quadro para chamadas em tempo real, mas muda para pipelines offline. Se o seu caso de uso é gerar embeddings, classificar logs ou rodar avaliações em massa, batch com cache curto costuma ser o caminho.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.6 |
| Criador | anthropic |
| Preço de entrada | US$ 5.00 / M tokens |
| Preço de saída | US$ 25.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.500 / M (90% de desconto) |
Para quem vale e para quem não muda nada
Vale para você se está montando um agente que precisa segurar contexto longo (1M tokens é raro) e que roda em janelas caras mas com baixa frequência de chamada — o cache de US$ 0,50 transforma system prompts repetidos em custo marginal. Vale também se você já está na Anthropic e precisa do melhor da casa para coding, sem trocar de fornecedor.
Não muda nada se você está otimizando custo por token em produto de alto volume. Para isso, o MiMo-V2-Flash segue imbatível no índice atual, e o o3 da OpenAI é a alternativa de marca conhecida com IQ alto e preço intermediário. Também não muda nada se você roda tudo em tempo real e a fatura é dominada por tokens de saída: o Opus 4.6 é, por construção, um modelo caro para chamar interativamente.
A linha completa da Anthropic hoje
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Opus 4.6 (batch) | 2.5 | 12.5 | 1M |
A Anthropic lançou o Opus 4.6 e a variante :batch no mesmo dia. Mesma janela de 1M de tokens, mesmo shape multimodal, preço diferenciado pelo modo de execução. Para quem opera na API, isso significa escolher entre latência e custo em cada job — não entre modelos diferentes.
O que você faz amanhã com isso
Se você já tem produto no ar e está vendo a fatura, o movimento prático é testar a versão :batch em qualquer fluxo que aceite async. Cache de prompt a US$ 0,50 é onde mora a economia real para quem repete contexto. E se você está decidindo entre Anthropic e OpenAI para um agente novo, vale esperar o Opus 4.6 entrar em índices agregados antes de cravar o fornecedor — por enquanto, o único número que você tem para comparar é o preço.
Para chamadas interativas, o Opus 4.6 entra como flagship caro; o caminho de economizar de verdade é usar a variante batch em jobs async e explorar o cache de prompt a US$ 0,50.
Perguntas frequentes
Quanto custa o Claude Opus 4.6 por milhão de tokens?
US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída no modo interativo. A variante `:batch` sai pela metade: US$ 2,5 e US$ 12,50, respectivamente. O cache de prompt fica em US$ 0,50 por milhão.
Qual a diferença entre o Opus 4.6 e a versão batch?
É o mesmo modelo, com a mesma janela de 1M de tokens e o mesmo suporte multimodal. A diferença é o modo de execução: batch roda de forma assíncrona, sem garantia de latência, e por isso custa metade do preço.
O Opus 4.6 é o modelo mais inteligente do catálogo?
Não há índice de inteligência publicado para o Opus 4.6 no lançamento. Pelo índice atual, o topo é o Xiaomi MiMo-V2-Flash (IQ 34,024), seguido do OpenAI o3 (31,096) e do Claude Haiku 4.5 (29,892).