FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Claude Opus 4.6 custa US$ 25 por milhão de saída e mira o topo do catálogo

Anthropic libera o flagship do dia com janela de 1M de tokens e cache a US$ 0,50; versão batch sai pela metade do preço.

Redação FalaVIP IA 3 min de leitura
US$ 25por milhão de tokens de saída no Opus 4.6
US$ 12,50por milhão de tokens de saída na versão batch
US$ 0,50por milhão de tokens em cache de prompt

O que o anúncio diz e o que a conta mostra

A Anthropic soltou hoje o Claude Opus 4.6 com a proposta de ser o modelo mais forte da casa para coding e para agentes que rodam fluxos inteiros, não só um prompt de cada vez. Janela de 1 milhão de tokens, entrada multimodal (texto, imagem e arquivo) e um preço de US$ 5 por milhão de entrada e US$ 25 por milhão de saída. Em paralelo, veio a variante :batch pela metade: US$ 2,5 e US$ 12,50, respectivamente.

Traduzindo o release: o que ficou mais barato foi o processamento em lote assíncrono, que costuma servir para jobs noturnos, reindexação e backfills. O preço do modo interativo, que é o que aparece na fatura do seu produto, continua na faixa premium. O detalhe que mais mexe no custo de verdade é o cache de prompt: US$ 0,50 por milhão de tokens. Se você repete system prompt e contexto a cada chamada, é aí que a conta despenca — não no preço de tabela.

Onde o Opus 4.6 se encaixa no tabuleiro

O catálogo tem 330 modelos listados hoje, vindos de 52 criadores, e 17 foram lançados nos últimos 30 dias. O topo atual do índice de inteligência é o Xiaomi MiMo-V2-Flash, com IQ 34,024 e saída a US$ 0,30 por milhão — uma combinação que, até agora, ninguém do bloco americano oferecia. Logo abaixo aparece o OpenAI o3, com IQ 31,096 e saída a US$ 8, seguido do próprio Claude Haiku 4.5 da Anthropic, em IQ 29,892 e US$ 5.

Índice de inteligência (Artificial Analysis)
MiMo-V2-Flash34o331,1Claude Haiku 4.529,9índice
Fonte: Artificial Analysis

O ponto é simples: o Opus 4.6 entra como flagship de preço alto, sem índice publicado no lançamento. Isso não é raro — a Anthropic costuma divulgar benchmarks próprios antes de entrar em índices agregados — mas significa que, por enquanto, a comparação direta tem de ser pelo preço e pelo posicionamento.

A conta, comparada

Preço de saída (US$ por milhão de tokens)
Claude Opus 4.625MiMo-V2-Flash0,3o38Claude Haiku 4.55US$/M
Fonte: OpenRouter

Se você está pagando US$ 25 por milhão de saída no Opus 4.6 e precisa de algo mais barato para volume, o MiMo-V2-Flash entrega IQ maior no índice atual cobrando US$ 0,30 — quase 83 vezes menos por token de saída. O o3, da OpenAI, sai por US$ 8 com IQ próximo do topo. O Haiku 4.5, da própria Anthropic, fica em US$ 5 e é o primo barato da casa.

Inteligência × preço de saída
MiMo-V2-Flasho3Claude Haiku 4.5US$ por milhão (saída, escala log)índice de inteligência

A versão :batch do Opus 4.6 a US$ 12,50 não muda esse quadro para chamadas em tempo real, mas muda para pipelines offline. Se o seu caso de uso é gerar embeddings, classificar logs ou rodar avaliações em massa, batch com cache curto costuma ser o caminho.

Ficha técnica — Claude Opus 4.6
CampoValor
Identificadoranthropic/claude-opus-4.6
Criadoranthropic
Preço de entradaUS$ 5.00 / M tokens
Preço de saídaUS$ 25.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.500 / M (90% de desconto)

Para quem vale e para quem não muda nada

Vale para você se está montando um agente que precisa segurar contexto longo (1M tokens é raro) e que roda em janelas caras mas com baixa frequência de chamada — o cache de US$ 0,50 transforma system prompts repetidos em custo marginal. Vale também se você já está na Anthropic e precisa do melhor da casa para coding, sem trocar de fornecedor.

Não muda nada se você está otimizando custo por token em produto de alto volume. Para isso, o MiMo-V2-Flash segue imbatível no índice atual, e o o3 da OpenAI é a alternativa de marca conhecida com IQ alto e preço intermediário. Também não muda nada se você roda tudo em tempo real e a fatura é dominada por tokens de saída: o Opus 4.6 é, por construção, um modelo caro para chamar interativamente.

A linha completa da Anthropic hoje

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Claude Opus 4.6 (batch)2.512.51M

A Anthropic lançou o Opus 4.6 e a variante :batch no mesmo dia. Mesma janela de 1M de tokens, mesmo shape multimodal, preço diferenciado pelo modo de execução. Para quem opera na API, isso significa escolher entre latência e custo em cada job — não entre modelos diferentes.

O que você faz amanhã com isso

Se você já tem produto no ar e está vendo a fatura, o movimento prático é testar a versão :batch em qualquer fluxo que aceite async. Cache de prompt a US$ 0,50 é onde mora a economia real para quem repete contexto. E se você está decidindo entre Anthropic e OpenAI para um agente novo, vale esperar o Opus 4.6 entrar em índices agregados antes de cravar o fornecedor — por enquanto, o único número que você tem para comparar é o preço.

Em uma frase

Para chamadas interativas, o Opus 4.6 entra como flagship caro; o caminho de economizar de verdade é usar a variante batch em jobs async e explorar o cache de prompt a US$ 0,50.

Perguntas frequentes

Quanto custa o Claude Opus 4.6 por milhão de tokens?

US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída no modo interativo. A variante `:batch` sai pela metade: US$ 2,5 e US$ 12,50, respectivamente. O cache de prompt fica em US$ 0,50 por milhão.

Qual a diferença entre o Opus 4.6 e a versão batch?

É o mesmo modelo, com a mesma janela de 1M de tokens e o mesmo suporte multimodal. A diferença é o modo de execução: batch roda de forma assíncrona, sem garantia de latência, e por isso custa metade do preço.

O Opus 4.6 é o modelo mais inteligente do catálogo?

Não há índice de inteligência publicado para o Opus 4.6 no lançamento. Pelo índice atual, o topo é o Xiaomi MiMo-V2-Flash (IQ 34,024), seguido do OpenAI o3 (31,096) e do Claude Haiku 4.5 (29,892).

Leia também