FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Sonnet 4.6 cobra 87% a mais que o3 por 4 pontos de IQ

Lançado há quatro dias, modelo da Anthropic tem contexto cinco vezes maior e entrega 2,6 vezes mais devagar que o o3, da OpenAI.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de saída (Sonnet 4.6)
US$ 8por milhão de tokens de saída (o3)
2,6xmais rápido: o3 entrega 108,9 tok/s contra 41,4 do Sonnet 4.6

Quatro dias atrás, a Anthropic colocou o Sonnet 4.6 na prateleira. O comunicado falou em "frontier performance" em coding, agentes e trabalho profissional. O que o release não gritou: a saída custa US$ 15 por milhão de tokens — 87% mais caro que os US$ 8 do o3, que já está no mercado há dez meses. A pergunta que vale a sua próxima sprint é direta: os 4 pontos de IQ a mais justificam quase dobrar a fatura?

O que cada um traz na mochila

O Sonnet 4.6 chega com três promessas no release: raciocínio iterativo sobre código, navegação em bases complexas e gestão de projeto de ponta a ponta. O o3, lançado em abril de 2025, foi vendido como "novo padrão em matemática, ciência, coding e raciocínio visual" — e segue sendo o único dos dois com modo de raciocínio nativo ativado por padrão.

Em chamadas simples, o Sonnet 4.6 entrega a resposta direto; o o3 gasta tokens pensando em cadeia antes de responder. Em tarefas que exigem vários passos de raciocínio, essa diferença de arquitetura muda o cálculo de custo por tarefa — não só por token.

Índice de inteligência (Artificial Analysis)
Claude Sonnet 4.635,1o331,1índice
Fonte: Artificial Analysis

No índice de inteligência medido hoje, o Sonnet 4.6 marca 35,1 e o o3 marca 31,1. É uma diferença real, mas não é um abismo: o Gemini 3.1 Pro Preview, da própria prateleira, está em 47,7 e custa os mesmos US$ 12 de saída. O Sonnet 4.6 não é o topo — é a segunda faixa, logo à frente do Qwen3.5 397B (34,3) e do MiMo-V2-Flash (34,0).

O preço que ninguém explica no release

Vamos traduzir o "desempenho de fronteira" em dólares. Para cada milhão de tokens de saída: Sonnet 4.6 a US$ 15, o3 a US$ 8. Na entrada, a diferença cai um pouco — US$ 3 contra US$ 2. Mas atenção ao cache: o Sonnet 4.6 cobra US$ 0,30 por milhão de token cacheado, enquanto o o3 cobra US$ 0,50. Em workloads com muitas chamadas repetidas sobre o mesmo contexto — RAG pesado, agentes com prompt grande, revisões em loop — o cache do Sonnet 4.6 devolve parte do que a saída cara tirou.

Preço de saída (US$ por milhão de tokens)
Claude Sonnet 4.615o38US$/M
Fonte: OpenRouter

O preço blended, que mistura entrada, saída e cache em proporção típica de uso, é a régua mais honesta. Aí o Sonnet 4.6 fica em US$ 6,00 e o o3 em US$ 3,50. Ainda 71% mais caro no agregado.

Velocidade: o trunfo silencioso do o3

Onde a conta mais dói é no tempo. O o3 entrega 108,9 tokens por segundo; o Sonnet 4.6, 41,4. Em outras palavras, o o3 é 2,6 vezes mais rápido. Para quem está construindo um produto com usuário esperando resposta na tela, isso não é detalhe — é UX.

Claude Sonnet 4.6 × o3
CritérioClaude Sonnet 4.6o3
Índice de inteligência35.131.1
Entrada US$/M32
Saída US$/M158
Contexto1M200k
Pesos abertosnãonão
Velocidade (tok/s)41109
Índice de código
Índice agêntico

E o contexto: o Sonnet 4.6 aceita 1 milhão de tokens de entrada, cinco vezes mais que os 200 mil do o3. Se o seu caso é despejar um repositório inteiro, uma base de documentação ou um dump de logs na janela, essa diferença é a única coisa que decide — nenhum prompt engineering resolve o que o limite de contexto barra.

Um detalhe que o release da Anthropic não informa e o da OpenAI sim: o catálogo publica o corte de conhecimento do o3 (junho de 2024); o do Sonnet 4.6 não foi divulgado. Se a sua tarefa depende de eventos recentes, isso entra no cálculo.

Quando cada um ganha

Você escolhe o Sonnet 4.6 quando precisa de contexto longo (acima de 200 mil tokens), quando a tarefa exige nuances de comunicação profissional e quando os 4 pontos de IQ vão para um gargalo real do produto — refatoração delicada, revisão de PR ambíguo, planejamento de projeto em várias etapas. Você escolhe o o3 quando velocidade manda, quando a tarefa é técnica e cabe em 200 mil tokens, e quando a conta da API não pode estourar.

E para quem usa o o3 há meses: o Sonnet 4.6 não invalida a escolha anterior. Ele cobre uma faixa de preço e contexto que o o3 não cobre. Os dois convivem no mesmo carrinho sem se canibalizar — e o catálogo, com 340 modelos hoje, deixa isso explícito.

Em uma frase

Migre para o Sonnet 4.6 só quando o seu caso exigir mais de 200 mil tokens de contexto ou quando os 4 pontos de IQ extra forem para um gargalo real; em qualquer outro cenário, o o3 entrega 2,6 vezes mais rápido e custa 71% menos no preço blended.

Perguntas frequentes

Sonnet 4.6 substitui o o3?

Não. Os dois ocupam faixas diferentes: o Sonnet 4.6 cobre contexto longo e tarefas profissionais delicadas; o o3 cobre velocidade e custo. O catálogo desta data lista os dois lado a lado, em 340 modelos disponíveis.

Por que o o3 é mais barato?

Porque o preço listado é US$ 8 por milhão de tokens de saída contra US$ 15 do Sonnet 4.6. É um posicionamento de preço que a OpenAI segurou dez meses depois do lançamento, em abril de 2025.

Qual dos dois tem raciocínio nativo?

O o3 vem com modo de raciocínio ativado por padrão, segundo os dados do catálogo. O Sonnet 4.6 não tem a flag de reasoning ativa nas informações publicadas até esta data.

Leia também