FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Claude Opus 4.8 cobra US$ 25 por milhão de saída: vale o que cobra?

Anthropic mantém o preço da família Opus, mas o catálogo já mostra alternativas com IQ acima de 45 por uma fração do custo.

Redação FalaVIP IA 3 min de leitura
US$ 25por milhão de tokens de saída
US$ 5por milhão de tokens de entrada
US$ 0,50por milhão de tokens em cache

O que mudou em seis dias

Você provavelmente viu o anúncio da Anthropic na semana passada e olhou direto para a tabela de preços. Faz sentido: foi exatamente ali que o Claude Opus 4.8 entrou no catálogo, em 27 de maio, sem alterar a política de cobrança da família. Entrada continua em US$ 5 por milhão de tokens, saída em US$ 25, e o cache de prompts em US$ 0,50. Em reais, na ponta do desenvolvedor que consome bastante saída, isso dá algo perto de R$ 130 por milhão de tokens — uma conta que assusta quando o agente entra em loop.

Ficha técnica — Claude Opus 4.8 (batch)
CampoValor
Identificadoranthropic/claude-opus-4.8:batch
Criadoranthropic
Preço de entradaUS$ 2.50 / M tokens
Preço de saídaUS$ 12.50 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.250 / M (90% de desconto)

Seis dias depois do lançamento, a pergunta que importa não é se o modelo é bom. É se a conta fecha.

O tabuleiro em 2 de junho de 2026

O catálogo hoje lista mais de 454 modelos de 61 criadores diferentes. No topo do índice de inteligência aparecem Gemini 3.1 Pro Preview, da Google, com IQ 47,7 e saída a US$ 12 por milhão; Gemini 3.5 Flash, também da Google, com IQ 46,7 a US$ 9; e GPT-5.3-Codex, da OpenAI, com IQ 45,5 a US$ 14. Mais abaixo, mas ainda acima de IQ 45, aparecem dois pesos-pesados em preço: o M3, da MiniMax, com IQ 45,4 e saída a US$ 1,20 por milhão; e o DeepSeek V4 Pro, com IQ 45,3 e saída a US$ 1,74.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
MiniMax M345.41.2
DeepSeek V4 Pro 042345.32.0845
Entre os 454 modelos disponíveis no catálogo nesta data.

Repare no que essa lista diz. Existem hoje pelo menos três modelos com IQ acima de 45 que custam menos de um décimo do Opus 4.8 por token de saída. O argumento "é o melhor" simplesmente não fecha mais pela diferença de preço — a não ser que o Opus 4.8 esteja entregando algo que esses outros não entregam, e o índice de inteligência, sozinho, não captura isso.

O que o catálogo não te conta sobre o Opus 4.8

Aqui está o ponto que incomoda. O Claude Opus 4.8 não tem índice de inteligência publicado no catálogo — o campo está vazio. Isso não significa que ele é ruim; significa que não dá para colocá-lo no mesmo gráfico que os outros. A Anthropic historicamente não submete os modelos Opus a benchmarks padronizados do mercado, e o catálogo respeita isso.

A ficha disponível mostra o que a Anthropic publica: contexto de 1 milhão de tokens, entrada multimodal (texto, imagem, arquivo), saída em texto, suporte a raciocínio. Nada de velocidade medida, nada de corte de conhecimento, nada de tamanho em parâmetros. É uma caixa-preta por design — a empresa vende o resultado, não a engrenagem.

Para quem o Opus 4.8 ainda vale a pena

Se você já roda workloads em produção com Claude Opus 4 ou 4.5 e a troca para Sonnet estava degradando qualidade em tarefas específicas — geração longa com voz consistente, revisão de código em repositórios grandes, análise de documentos jurídicos extensos — o 4.8 é a atualização natural. O preço é o mesmo, então a migração não muda a fatura.

Para quem está escolhendo modelo agora, do zero, a conta é outra. Se o seu uso cabe em Sonnet, fica no Sonnet. Se cabe em Sonnet mas você precisa de mais um degrau de qualidade, vale testar GPT-5.3-Codex ou Gemini 3.5 Flash antes de assinar Opus — a diferença de preço é grande o suficiente para pagar um desenvolvedor júnior por um mês. E se a sua prioridade é custo por token em volume, com IQ acima de 45, o M3 e o DeepSeek V4 Pro são as opções que aparecem primeiro na lista de "mais baratos acima de IQ 45".

Quando NÃO vale a pena

Se você está montando um agente que vai queimar muitos tokens de saída em retries, raciocínio encadeado ou geração longa, US$ 25 por milhão é dinheiro jogado fora quando existe alternativa a US$ 1,20 com IQ parecido. Para chatbots simples, sumarização, classificação e extração, Opus 4.8 é overkill — e a fatura vai mostrar isso no fim do mês.

A regra prática: rode o Opus 4.8 onde o Opus 4 já estava rodando e fazia diferença. Em todo o resto, teste antes de pagar.

Em uma frase

Mantenha o Opus 4.8 onde o Opus anterior já entregava valor; para tudo o mais, teste GPT-5.3-Codex, Gemini 3.5 Flash ou os modelos abaixo de US$ 2 por milhão de saída antes de assinar a fatura mais cara do catálogo.

Perguntas frequentes

Quanto custa o Claude Opus 4.8?

US$ 5 por milhão de tokens de entrada, US$ 25 por milhão de tokens de saída e US$ 0,50 por milhão de tokens em cache. É o mesmo preço da família Opus anterior — a Anthropic não mexeu na tabela.

Claude Opus 4.8 é o modelo mais inteligente do mercado?

Não dá para afirmar pelo catálogo. O Opus 4.8 não tem índice de inteligência publicado, enquanto Gemini 3.1 Pro Preview (IQ 47,7), Gemini 3.5 Flash (IQ 46,7) e GPT-5.3-Codex (IQ 45,5) aparecem medidos no topo.

Qual a alternativa mais barata com IQ acima de 45?

O M3, da MiniMax, com IQ 45,4 e saída a US$ 1,20 por milhão de tokens — cerca de 20 vezes mais barato que o Opus 4.8 no token de saída.