FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Sonnet 5 chega a US$ 10 por milhão, um quinto do Fable 5

À frente do Gemini 3.1 Pro Preview em IQ e abaixo do Fable 5 no preço, o Sonnet 5 entra no catálogo com cache a US$ 0,20 o milhão de tokens.

Redação FalaVIP IA 3 min de leitura
US$ 10por milhão de tokens de saída
US$ 0,20por milhão de tokens em cache
55,261índice de inteligência (snapshot de hoje)

A US$ 10 por milhão de tokens de saída, o Claude Sonnet 5 não é a estrela da Anthropic — essa continua sendo o Fable 5, a US$ 50. Mas é dele que muita gente vai ouvir falar a partir de hoje, 30 de junho de 2026, porque ele ocupa um lugar que estava vago: o meio do catálogo da casa, com 1 milhão de tokens de contexto e raciocínio adaptativo.

O release fala em "desempenho de fronteira em coding, agents e trabalho profissional". Traduzindo para a fatura: o Sonnet 5 tem IQ 55,261 no snapshot de hoje, contra 62,073 do Fable 5. Ele entrega cerca de 89% da inteligência do topo de linha da casa — por um quinto do preço. Em coding, marca 71,546, o melhor número de tarefa única entre os modelos que estão no topo do catálogo agora. Em agentic, 49,718: consistente, mas não excepcional.

O que muda no boleto

A conta entra assim: US$ 2 por milhão de tokens de entrada, US$ 10 por milhão de saída, US$ 0,20 por milhão para leituras em cache. Contexto de 1 milhão. Modo de raciocínio com níveis selecionáveis — low, medium, high, max — você paga o mesmo, mas controla quanto o modelo pensa.

Para visualizar o desconto interno: um app que produza 500 milhões de tokens de saída por mês paga US$ 5.000 no Sonnet 5. No Fable 5, seriam US$ 25.000. Mesma marca, mesmo SDK, US$ 20.000 a menos no fim do mês. E o cache a US$ 0,20 vira um ímã para workloads com prompts repetidos — bate-papos longos, RAG com reuso de contexto, agentes que partem de instruções idênticas.

Onde se encaixa no tabuleiro

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Sonnet 5 (o novo)55.32101M
Claude Fable 562.110501M
GLM 5.252.60.9663.0361.05M
Gemini 3.1 Pro Preview47.72121.05M
MiniMax M345.40.31.21.05M
DeepSeek V4 Pro 042345.31.04232.08451.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Sonnet 5 é o segundo modelo mais inteligente da Anthropic, atrás só do Fable 5. Contra o GLM 5.2 da chinesa Z.ai — terceiro colocado do catálogo geral com IQ 52,641 — entrega 2,6 pontos de IQ a mais, mas cobra cerca de 3,3 vezes mais caro na saída (US$ 10 contra US$ 3,036). É um posicionamento honesto: você paga mais por melhor qualidade por chamada e pelo ecossistema Anthropic fechado, com pesos proprietários e jurisdição americana.

Preço de saída (US$ por milhão de tokens)
Claude Sonnet 510Claude Fable 550GLM 5.23,036Gemini 3.1 Pro Preview12MiniMax M31,2DeepSeek V4 Pro 04232,0845US$/M
Fonte: OpenRouter

Contra o Gemini 3.1 Pro Preview, do Google, com IQ 47,738 e US$ 12 por milhão de saída, o Sonnet 5 ganha nos dois critérios: mais barato E mais inteligente por 7,5 pontos. Para quem estava segurando o Gemini Pro Preview por causa do preço, o cálculo inverteu de um dia para o outro.

E o andar de baixo?

Inteligência × preço de saída
Claude Sonnet 5Claude Fable 5GLM 5.2Gemini 3.1 Pro PreviewMiniMax M3DeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência

Abaixo do IQ 50, três modelos dominam a conversa de custo-benefício:

  • MiniMax M3 — IQ 45,397, US$ 1,20 por milhão de saída
  • DeepSeek V4 Pro — IQ 45,268, US$ 1,74 por milhão de saída
  • Z.ai GLM 5.2 — IQ 52,641, US$ 3,036 por milhão de saída

O Sonnet 5 nem entra nessa conversa. O público dele tem critérios diferentes: pesos fechados, jurisdição americana, modelo de raciocínio nativo e ferramentas Anthropic. Se algum desses critérios pesa na sua compra, o andar de baixo não é alternativa — é outro produto.

O que veio junto hoje

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Claude Sonnet 5 (batch)151M

A única variante anunciada junto é a Sonnet 5 Batch: mesmo 1 milhão de contexto, com US$ 1 por milhão de entrada e US$ 5 por milhão de saída. Como o nome diz, é a fila para jobs em lote — geração de dataset, avaliações em massa, backfills noturnos. Latência não importa; o que importa é cortar a fatura pela metade em relação ao endpoint síncrono, sem trocar de modelo.

O catálogo soma agora mais de 480 modelos distribuídos por 62 criadores, com 26 lançamentos só nos últimos 30 dias. A Anthropic tinha um buraco entre o Fable 5 caríssimo e o restante do mercado. Para quem estava parado entre o Gemini Pro Preview e o GLM 5.2 esperando uma terceira via, a espera acabou.

Em uma frase

Antes de travar a escolha em GLM 5.2 ou Gemini 3.1 Pro Preview, teste o Sonnet 5 em produção: ele cobra US$ 2 a menos por milhão de saída que o Gemini Pro e fica 7,5 pontos de IQ à frente.

Perguntas frequentes

Quanto custa o Claude Sonnet 5 na API?

US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com leituras em cache a US$ 0,20 por milhão. A variante Batch sai pela metade: US$ 1 de entrada e US$ 5 de saída, mantendo o mesmo contexto de 1 milhão de tokens.

Qual a diferença entre Claude Sonnet 5 e Fable 5?

Ambos são da Anthropic e compartilham o contexto de 1 milhão de tokens e o modo de raciocínio adaptativo. O Fable 5 lidera o catálogo hoje com IQ 62,073 e custa US$ 50 por milhão de saída; o Sonnet 5 fica em IQ 55,261 por US$ 10 — cerca de 89% da inteligência do topo por um quinto do preço.

Sonnet 5 é melhor que o GLM 5.2?

No IQ sim, 55,261 contra 52,641, mas custa cerca de 3,3 vezes mais na saída (US$ 10 contra US$ 3,036). Vale trocar quando a qualidade por chamada pesa mais que o custo total do mês, ou quando você precisa do ecossistema Anthropic fechado (pesos proprietários, jurisdição americana, ferramentas nativas).

Leia também