Opus 4.6 Fast custa 6x mais caro e o catálogo não mediu o IQ
Anthropic lança variante rápida do Opus 4.6 com preço premium, sem benchmark de inteligência e concorrendo com Gemini 3.1 Pro e GPT-5.3-Codex no topo.
O anúncio diz "mais rápido". A conta diz "mais caro"
Você viu a chamada: Anthropic liberou uma variante Fast do Opus 4.6 no dia 7 de abril. Doze dias depois, o catálogo ainda não publicou um índice de inteligência para ela, e o preço de saída saltou de US$ 25 para US$ 150 por milhão de tokens — seis vezes mais. Antes de colocar isso num agente de produção, vale entender o que está sendo vendido.
O que o "Fast" muda de verdade
A descrição oficial é direta: capacidades idênticas ao Opus 4.6 padrão, só que com velocidade maior de output, cobrada como prêmio. Entrada continua em US$ 30 por milhão de tokens, leitura de cache em US$ 3. Modalidade segue sendo texto + imagem + arquivo → texto, contexto de 1 milhão de tokens. Nenhum campo de benchmark foi preenchido pelo catálogo — nem IQ, nem coding, nem agentic.
Traduzindo: você paga caro por uma promessa de latência menor, sem nenhuma métrica pública que compare essa velocidade com a do Opus padrão ou com a do Gemini 3.1 Pro. É um produto vendido pelo throughput, não pelo resultado.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-opus-4.6-fast |
| Criador | anthropic |
| Preço de entrada | US$ 30.00 / M tokens |
| Preço de saída | US$ 150.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 3.00 / M (90% de desconto) |
Quem está brigando nesse mesmo andar
No topo do catálogo hoje, o ranking de inteligência tem Google Gemini 3.1 Pro Preview com IQ 47,7 e output a US$ 12 por milhão, e OpenAI GPT-5.3-Codex com IQ 45,5 e output a US$ 14. Ambos são mais baratos na saída e têm benchmark. Xiaomi MiMo-V2-Omni (IQ 35,8, US$ 2) e Claude Sonnet 4.6 (IQ 35,1, US$ 15) ocupam a faixa logo abaixo. O Opus 4.6 Fast entra sem IQ medido, a US$ 150 de saída — quase dez vezes o preço do Gemini líder.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
Se você quer o topo de capacidade pelo menor custo, os dois modelos acima de IQ 45 são exatamente o Gemini 3.1 Pro e o GPT-5.3-Codex. O Opus 4.6 Fast não disputa essa faixa.
Para quem isso faz sentido
A conta fecha em um cenário específico: você já roda Opus 4.6 padrão em produção, tem um gargalo medido de latência de output (não de input, não de raciocínio) e o custo extra de US$ 125 por milhão de tokens de saída é menor que o ganho de receita ou de SLA. Workflows de geração em streaming, respostas longas a clientes em tempo real, ou pipelines onde cada segundo de output impacta diretamente a experiência.
Fora desse caso, é difícil justificar. Para tarefas em que a velocidade não é o gargalo — análise de documentos longos, code review, agentes que esperam tool calls — o Opus 4.6 padrão, o Sonnet 4.6 ou o Gemini 3.1 Pro entregam o mesmo (ou mais, no caso do Gemini) por uma fração do custo.
Quando NÃO vale a pena
- Se você está escolhendo o primeiro modelo para um produto novo: comece pelo Sonnet 4.6 ou pelo Gemini 3.1 Pro. Ambos têm benchmark, são mais baratos e têm histórico público de comportamento.
- Se a latência importa mas o orçamento não é elástico: o GPT-5.3-Codex é mais barato na saída e lidera em capacidade de código.
- Se você precisa comparar velocidade: a Anthropic não publicou números. Peça um teste de throughput antes de migrar.
O tabuleiro em abril de 2026
O catálogo tem 392 modelos listados, 54 criadores, e 18 lançamentos nos últimos 30 dias. O topo de inteligência segue dominado por Google e OpenAI, com Anthropic forte no terceiro andar (Sonnet) e ausente da medição no quarto (Opus Fast). A Anthropic está cobrando pela velocidade o que cobra por capacidade em outros modelos — uma escolha de posicionamento, não de preço.
Só vale migrar para o Opus 4.6 Fast se você já roda Opus padrão, tem latência de output como gargalo medido e o prêmio de 6x cabe no orçamento; em qualquer outro caso, Gemini 3.1 Pro ou GPT-5.3-Codex entregam mais por menos.
Perguntas frequentes
Quanto custa o Claude Opus 4.6 Fast?
US$ 30 por milhão de tokens de entrada, US$ 150 por milhão de tokens de saída e US$ 3 por milhão em leitura de cache. O preço de saída é seis vezes o do Opus 4.6 padrão.
O Claude Opus 4.6 Fast tem benchmark de inteligência?
Não. O catálogo não publicou IQ, coding, agentic nem blended para essa variante. A comparação com Gemini 3.1 Pro e GPT-5.3-Codex só pode ser feita por conta do usuário.
Quando o Opus 4.6 Fast vale a pena sobre o Gemini 3.1 Pro?
Somente quando a latência de output é o gargalo principal do seu pipeline e o custo extra de US$ 125 por milhão de tokens de saída cabe no orçamento. Em capacidade pura, o Gemini lidera e custa uma fração.