Sonnet 5 chega a US$ 10 por milhão, um quinto do Fable 5
À frente do Gemini 3.1 Pro Preview em IQ e abaixo do Fable 5 no preço, o Sonnet 5 entra no catálogo com cache a US$ 0,20 o milhão de tokens.
A US$ 10 por milhão de tokens de saída, o Claude Sonnet 5 não é a estrela da Anthropic — essa continua sendo o Fable 5, a US$ 50. Mas é dele que muita gente vai ouvir falar a partir de hoje, 30 de junho de 2026, porque ele ocupa um lugar que estava vago: o meio do catálogo da casa, com 1 milhão de tokens de contexto e raciocínio adaptativo.
O release fala em "desempenho de fronteira em coding, agents e trabalho profissional". Traduzindo para a fatura: o Sonnet 5 tem IQ 55,261 no snapshot de hoje, contra 62,073 do Fable 5. Ele entrega cerca de 89% da inteligência do topo de linha da casa — por um quinto do preço. Em coding, marca 71,546, o melhor número de tarefa única entre os modelos que estão no topo do catálogo agora. Em agentic, 49,718: consistente, mas não excepcional.
O que muda no boleto
A conta entra assim: US$ 2 por milhão de tokens de entrada, US$ 10 por milhão de saída, US$ 0,20 por milhão para leituras em cache. Contexto de 1 milhão. Modo de raciocínio com níveis selecionáveis — low, medium, high, max — você paga o mesmo, mas controla quanto o modelo pensa.
Para visualizar o desconto interno: um app que produza 500 milhões de tokens de saída por mês paga US$ 5.000 no Sonnet 5. No Fable 5, seriam US$ 25.000. Mesma marca, mesmo SDK, US$ 20.000 a menos no fim do mês. E o cache a US$ 0,20 vira um ímã para workloads com prompts repetidos — bate-papos longos, RAG com reuso de contexto, agentes que partem de instruções idênticas.
Onde se encaixa no tabuleiro
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Sonnet 5 (o novo) | 55.3 | 2 | 10 | 1M |
| Claude Fable 5 | 62.1 | 10 | 50 | 1M |
| GLM 5.2 | 52.6 | 0.966 | 3.036 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| MiniMax M3 | 45.4 | 0.3 | 1.2 | 1.05M |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
Sonnet 5 é o segundo modelo mais inteligente da Anthropic, atrás só do Fable 5. Contra o GLM 5.2 da chinesa Z.ai — terceiro colocado do catálogo geral com IQ 52,641 — entrega 2,6 pontos de IQ a mais, mas cobra cerca de 3,3 vezes mais caro na saída (US$ 10 contra US$ 3,036). É um posicionamento honesto: você paga mais por melhor qualidade por chamada e pelo ecossistema Anthropic fechado, com pesos proprietários e jurisdição americana.
Contra o Gemini 3.1 Pro Preview, do Google, com IQ 47,738 e US$ 12 por milhão de saída, o Sonnet 5 ganha nos dois critérios: mais barato E mais inteligente por 7,5 pontos. Para quem estava segurando o Gemini Pro Preview por causa do preço, o cálculo inverteu de um dia para o outro.
E o andar de baixo?
Abaixo do IQ 50, três modelos dominam a conversa de custo-benefício:
- MiniMax M3 — IQ 45,397, US$ 1,20 por milhão de saída
- DeepSeek V4 Pro — IQ 45,268, US$ 1,74 por milhão de saída
- Z.ai GLM 5.2 — IQ 52,641, US$ 3,036 por milhão de saída
O Sonnet 5 nem entra nessa conversa. O público dele tem critérios diferentes: pesos fechados, jurisdição americana, modelo de raciocínio nativo e ferramentas Anthropic. Se algum desses critérios pesa na sua compra, o andar de baixo não é alternativa — é outro produto.
O que veio junto hoje
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Sonnet 5 (batch) | 1 | 5 | 1M |
A única variante anunciada junto é a Sonnet 5 Batch: mesmo 1 milhão de contexto, com US$ 1 por milhão de entrada e US$ 5 por milhão de saída. Como o nome diz, é a fila para jobs em lote — geração de dataset, avaliações em massa, backfills noturnos. Latência não importa; o que importa é cortar a fatura pela metade em relação ao endpoint síncrono, sem trocar de modelo.
O catálogo soma agora mais de 480 modelos distribuídos por 62 criadores, com 26 lançamentos só nos últimos 30 dias. A Anthropic tinha um buraco entre o Fable 5 caríssimo e o restante do mercado. Para quem estava parado entre o Gemini Pro Preview e o GLM 5.2 esperando uma terceira via, a espera acabou.
Antes de travar a escolha em GLM 5.2 ou Gemini 3.1 Pro Preview, teste o Sonnet 5 em produção: ele cobra US$ 2 a menos por milhão de saída que o Gemini Pro e fica 7,5 pontos de IQ à frente.
Perguntas frequentes
Quanto custa o Claude Sonnet 5 na API?
US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com leituras em cache a US$ 0,20 por milhão. A variante Batch sai pela metade: US$ 1 de entrada e US$ 5 de saída, mantendo o mesmo contexto de 1 milhão de tokens.
Qual a diferença entre Claude Sonnet 5 e Fable 5?
Ambos são da Anthropic e compartilham o contexto de 1 milhão de tokens e o modo de raciocínio adaptativo. O Fable 5 lidera o catálogo hoje com IQ 62,073 e custa US$ 50 por milhão de saída; o Sonnet 5 fica em IQ 55,261 por US$ 10 — cerca de 89% da inteligência do topo por um quinto do preço.
Sonnet 5 é melhor que o GLM 5.2?
No IQ sim, 55,261 contra 52,641, mas custa cerca de 3,3 vezes mais na saída (US$ 10 contra US$ 3,036). Vale trocar quando a qualidade por chamada pesa mais que o custo total do mês, ou quando você precisa do ecossistema Anthropic fechado (pesos proprietários, jurisdição americana, ferramentas nativas).