Claude Sonnet 4.5 chega a US$ 15 por milhão de saída e mira o topo
Anthropic mantém o preço do antecessor enquanto reposiciona o modelo como carro-chefe para agentes e código, sem公布ar nota de inteligência.
A conta de API da Anthropic não mudou com o Sonnet 4.5. E isso, em si, já é o anúncio. O modelo principal sai hoje pelo mesmo preço do antecessor: US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de saída, com cache de leitura a US$ 0,30. Quem rodava Sonnet 4 ontem não precisa refazer planilha.
O que mudou é a proposta. A Anthropic descreve o 4.5 como o Sonnet mais avançado até hoje, afinado para agentes e fluxos de codificação, com resultado de ponta no SWE-bench Verified. É a velha jogada de marketing — "estado da arte em X" — mas aqui ela vem com uma escolha de produto reveladora: nenhum índice de inteligência foi publicado no catálogo.
O preço é a mensagem
Em tempos de guerra de centavos por token, manter US$ 15/M de saída é posicionamento. A OpenAI cobra US$ 8/M pelo o3, que lidera o índice de inteligência com 31,096. O Qwen3 Next 80B A3B Thinking sai por US$ 1,20/M. A conta da Anthropic é a mais cara do pelotão de elite que aparece nos rankings.
Você paga caro para quê? Pela narrativa de agente. O release fala em "real-world agents and coding workflows", e o SWE-bench Verified virou o campo de batalha preferido de quem quer provar que entende de código. Para uma equipe que está construindo um agente que precisa terminar tarefas longas sem supervisão, esse é exatamente o argumento que convence o CTO a abrir a exceção no orçamento.
Para quem está prototipando um chatbot de atendimento ou resumindo documentos, a conta não fecha. O o3 custa quase metade por token de saída; o Qwen3 Next custa 8,5% do preço. A diferença só desaparece quando o trabalho exige autonomia e execução de múltiplos passos — o cenário onde cada token economizado por alucinação evitada vale mais que a diferença de tarifa.
A família completa
A Anthropic não soltou só o Sonnet 4.5. Junto veio a versão :batch, com 50% de desconto em ambas as direções: US$ 1,50/M de entrada e US$ 7,50/M de saída. Mesmo contexto de 1 milhão de tokens, mesma janela, só muda a fila de processamento.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Sonnet 4.5 (batch) | 1.5 | 7.5 | 1M |
Para quem usa o batch API — aquela fila onde você entrega um lote de prompts e aceita latência maior em troca de preço —, o Sonnet 4.5 batch vira a opção mais barata da Anthropic para workloads assíncronos. Geração de dataset, classificação em massa, varredura de código: tudo isso cabe no modal barato.
Como ele se compara com o que já estava no mercado
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Sonnet 4.5 (o novo) | — | 3 | 15 | 1M |
| o3 | 31.1 | 2 | 8 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Qwen3 Next 80B A3B Thinking | 16.9 | 0.15 | 1.2 | 262k |
O catálogo tem 243 modelos listados hoje, vindos de 40 criadores. Nos últimos 30 dias, 24 foram lançados — e o Sonnet 4.5 entra nesse bolo. No topo do índice de inteligência, segue o o3 da OpenAI, com o gpt-oss-120b logo abaixo. O Sonnet 4.5 não aparece com nota; sem número, não dá para colocá-lo na régua.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
O que dá para dizer com os dados em mãos: o Sonnet 4.5 custa o mesmo que o Sonnet 4 custava ontem, oferece a mesma janela de 1M de tokens, e promete ser melhor especificamente em agente e código. Não é uma revolução de preço. É uma aposta de que o segmento que mais cresce — agentes autônomos — está disposto a pagar tarifa premium.
Para quem vale e para quem não muda nada
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-sonnet-4.5 |
| Criador | anthropic |
| Preço de entrada | US$ 3.00 / M tokens |
| Preço de saída | US$ 15.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.300 / M (90% de desconto) |
Vale para times que já rodavam Sonnet e querem o声称 de "estado da arte em SWE-bench" sem trocar de fornecedor. Vale para quem está montando agente de coding e precisa de um modelo que termine tarefas longas sem perder o fio. Vale para quem pode usar batch API e quer pagar US$ 7,50/M de saída em vez de US$ 15.
Não muda nada para quem escolheu o o3 pelo índice de inteligência — o 31,096 do o3 segue na frente, e o catálogo não trouxe nota do Sonnet 4.5 para comparar. Não muda nada para quem já usa o Qwen3 Next por economia — US$ 1,20/M de saída é outro planeta. E não muda nada para workloads simples, onde a diferença entre Sonnet 4 e 4.5 provavelmente some no ruído.
O que fazer com isso hoje
Se você está rodando agente em produção, vale rodar o Sonnet 4.5 em batch no trabalho assíncrono e guardar o endpoint síncrono para as tarefas onde latência importa. Se você está decidindo entre Anthropic e OpenAI, o o3 ainda lidera em inteligência medida; o Sonnet 4.5 entra pela porta do coding e dos agentes, não pela régua geral. E se você está com o orçamento apertado, o Qwen3 Next continua sendo o melhor custo por token de saída entre os modelos com índice publicado.
O catálogo não publicou nota de inteligência para o Sonnet 4.5. Enquanto isso não aparecer, o argumento da Anthropic é o SWE-bench e a janela de 1M. Para quem vende código, isso basta. Para quem vende conversa, talvez não.
Mantenha o endpoint síncrono do Sonnet 4.5 para agentes de código em produção e empurre o trabalho assíncrono para a versão batch a US$ 7,50/M; se a régua for inteligência medida, o o3 ainda lidera.
Perguntas frequentes
Quanto custa o Claude Sonnet 4.5?
US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída, com cache de leitura a US$ 0,30 por milhão. A versão batch sai pela metade: US$ 1,50 de entrada e US$ 7,50 de saída.
O Sonnet 4.5 é melhor que o o3 da OpenAI?
O catálogo não publicou índice de inteligência para o Sonnet 4.5, então não dá para comparar na régua geral. O o3 lidera o índice com 31,096. A aposta da Anthropic é em coding (SWE-bench) e agentes, não na nota geral.
Vale trocar o Sonnet 4 pelo 4.5?
O preço é o mesmo e a janela continua em 1 milhão de tokens. A troca vale se você roda agentes de código ou workloads longos; para chatbot ou resumo, a diferença provavelmente não aparece na fatura.