FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Opus 4.6 Fast custa 6x mais caro e o catálogo não mediu o IQ

Anthropic lança variante rápida do Opus 4.6 com preço premium, sem benchmark de inteligência e concorrendo com Gemini 3.1 Pro e GPT-5.3-Codex no topo.

Redação FalaVIP IA 3 min de leitura
US$ 150por milhão de tokens de saída
6xpreço de saída sobre o Opus 4.6 padrão
US$ 3por milhão de tokens em cache (leitura)
1.000.000tokens de contexto

O anúncio diz "mais rápido". A conta diz "mais caro"

Você viu a chamada: Anthropic liberou uma variante Fast do Opus 4.6 no dia 7 de abril. Doze dias depois, o catálogo ainda não publicou um índice de inteligência para ela, e o preço de saída saltou de US$ 25 para US$ 150 por milhão de tokens — seis vezes mais. Antes de colocar isso num agente de produção, vale entender o que está sendo vendido.

O que o "Fast" muda de verdade

A descrição oficial é direta: capacidades idênticas ao Opus 4.6 padrão, só que com velocidade maior de output, cobrada como prêmio. Entrada continua em US$ 30 por milhão de tokens, leitura de cache em US$ 3. Modalidade segue sendo texto + imagem + arquivo → texto, contexto de 1 milhão de tokens. Nenhum campo de benchmark foi preenchido pelo catálogo — nem IQ, nem coding, nem agentic.

Traduzindo: você paga caro por uma promessa de latência menor, sem nenhuma métrica pública que compare essa velocidade com a do Opus padrão ou com a do Gemini 3.1 Pro. É um produto vendido pelo throughput, não pelo resultado.

Ficha técnica — Claude Opus 4.6 (Fast)
CampoValor
Identificadoranthropic/claude-opus-4.6-fast
Criadoranthropic
Preço de entradaUS$ 30.00 / M tokens
Preço de saídaUS$ 150.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 3.00 / M (90% de desconto)

Quem está brigando nesse mesmo andar

No topo do catálogo hoje, o ranking de inteligência tem Google Gemini 3.1 Pro Preview com IQ 47,7 e output a US$ 12 por milhão, e OpenAI GPT-5.3-Codex com IQ 45,5 e output a US$ 14. Ambos são mais baratos na saída e têm benchmark. Xiaomi MiMo-V2-Omni (IQ 35,8, US$ 2) e Claude Sonnet 4.6 (IQ 35,1, US$ 15) ocupam a faixa logo abaixo. O Opus 4.6 Fast entra sem IQ medido, a US$ 150 de saída — quase dez vezes o preço do Gemini líder.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 392 modelos disponíveis no catálogo nesta data.

Se você quer o topo de capacidade pelo menor custo, os dois modelos acima de IQ 45 são exatamente o Gemini 3.1 Pro e o GPT-5.3-Codex. O Opus 4.6 Fast não disputa essa faixa.

Para quem isso faz sentido

A conta fecha em um cenário específico: você já roda Opus 4.6 padrão em produção, tem um gargalo medido de latência de output (não de input, não de raciocínio) e o custo extra de US$ 125 por milhão de tokens de saída é menor que o ganho de receita ou de SLA. Workflows de geração em streaming, respostas longas a clientes em tempo real, ou pipelines onde cada segundo de output impacta diretamente a experiência.

Fora desse caso, é difícil justificar. Para tarefas em que a velocidade não é o gargalo — análise de documentos longos, code review, agentes que esperam tool calls — o Opus 4.6 padrão, o Sonnet 4.6 ou o Gemini 3.1 Pro entregam o mesmo (ou mais, no caso do Gemini) por uma fração do custo.

Quando NÃO vale a pena

  • Se você está escolhendo o primeiro modelo para um produto novo: comece pelo Sonnet 4.6 ou pelo Gemini 3.1 Pro. Ambos têm benchmark, são mais baratos e têm histórico público de comportamento.
  • Se a latência importa mas o orçamento não é elástico: o GPT-5.3-Codex é mais barato na saída e lidera em capacidade de código.
  • Se você precisa comparar velocidade: a Anthropic não publicou números. Peça um teste de throughput antes de migrar.

O tabuleiro em abril de 2026

O catálogo tem 392 modelos listados, 54 criadores, e 18 lançamentos nos últimos 30 dias. O topo de inteligência segue dominado por Google e OpenAI, com Anthropic forte no terceiro andar (Sonnet) e ausente da medição no quarto (Opus Fast). A Anthropic está cobrando pela velocidade o que cobra por capacidade em outros modelos — uma escolha de posicionamento, não de preço.

Em uma frase

Só vale migrar para o Opus 4.6 Fast se você já roda Opus padrão, tem latência de output como gargalo medido e o prêmio de 6x cabe no orçamento; em qualquer outro caso, Gemini 3.1 Pro ou GPT-5.3-Codex entregam mais por menos.

Perguntas frequentes

Quanto custa o Claude Opus 4.6 Fast?

US$ 30 por milhão de tokens de entrada, US$ 150 por milhão de tokens de saída e US$ 3 por milhão em leitura de cache. O preço de saída é seis vezes o do Opus 4.6 padrão.

O Claude Opus 4.6 Fast tem benchmark de inteligência?

Não. O catálogo não publicou IQ, coding, agentic nem blended para essa variante. A comparação com Gemini 3.1 Pro e GPT-5.3-Codex só pode ser feita por conta do usuário.

Quando o Opus 4.6 Fast vale a pena sobre o Gemini 3.1 Pro?

Somente quando a latência de output é o gargalo principal do seu pipeline e o custo extra de US$ 125 por milhão de tokens de saída cabe no orçamento. Em capacidade pura, o Gemini lidera e custa uma fração.

Leia também