FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Claude Sonnet 4.5 chega a US$ 15 por milhão de saída e mira o topo

Anthropic mantém o preço do antecessor enquanto reposiciona o modelo como carro-chefe para agentes e código, sem公布ar nota de inteligência.

Redação FalaVIP IA 4 min de leitura
US$ 15por milhão de tokens de saída
US$ 3por milhão de tokens de entrada
US$ 0,30cache de leitura por milhão de tokens

A conta de API da Anthropic não mudou com o Sonnet 4.5. E isso, em si, já é o anúncio. O modelo principal sai hoje pelo mesmo preço do antecessor: US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de saída, com cache de leitura a US$ 0,30. Quem rodava Sonnet 4 ontem não precisa refazer planilha.

Preço de saída (US$ por milhão de tokens)
Claude Sonnet 4.515o38gpt-oss-120b0,17Qwen3 Next 80B A3B Thinking1,2US$/M
Fonte: OpenRouter

O que mudou é a proposta. A Anthropic descreve o 4.5 como o Sonnet mais avançado até hoje, afinado para agentes e fluxos de codificação, com resultado de ponta no SWE-bench Verified. É a velha jogada de marketing — "estado da arte em X" — mas aqui ela vem com uma escolha de produto reveladora: nenhum índice de inteligência foi publicado no catálogo.

O preço é a mensagem

Em tempos de guerra de centavos por token, manter US$ 15/M de saída é posicionamento. A OpenAI cobra US$ 8/M pelo o3, que lidera o índice de inteligência com 31,096. O Qwen3 Next 80B A3B Thinking sai por US$ 1,20/M. A conta da Anthropic é a mais cara do pelotão de elite que aparece nos rankings.

Índice de inteligência (Artificial Analysis)
o331,1gpt-oss-120b24,1Qwen3 Next 80B A3B Thinking16,9índice
Fonte: Artificial Analysis

Você paga caro para quê? Pela narrativa de agente. O release fala em "real-world agents and coding workflows", e o SWE-bench Verified virou o campo de batalha preferido de quem quer provar que entende de código. Para uma equipe que está construindo um agente que precisa terminar tarefas longas sem supervisão, esse é exatamente o argumento que convence o CTO a abrir a exceção no orçamento.

Inteligência × preço de saída
o3gpt-oss-120bQwen3 Next 80B A3B ThinkingUS$ por milhão (saída, escala log)índice de inteligência

Para quem está prototipando um chatbot de atendimento ou resumindo documentos, a conta não fecha. O o3 custa quase metade por token de saída; o Qwen3 Next custa 8,5% do preço. A diferença só desaparece quando o trabalho exige autonomia e execução de múltiplos passos — o cenário onde cada token economizado por alucinação evitada vale mais que a diferença de tarifa.

A família completa

A Anthropic não soltou só o Sonnet 4.5. Junto veio a versão :batch, com 50% de desconto em ambas as direções: US$ 1,50/M de entrada e US$ 7,50/M de saída. Mesmo contexto de 1 milhão de tokens, mesma janela, só muda a fila de processamento.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Claude Sonnet 4.5 (batch)1.57.51M

Para quem usa o batch API — aquela fila onde você entrega um lote de prompts e aceita latência maior em troca de preço —, o Sonnet 4.5 batch vira a opção mais barata da Anthropic para workloads assíncronos. Geração de dataset, classificação em massa, varredura de código: tudo isso cabe no modal barato.

Como ele se compara com o que já estava no mercado

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Sonnet 4.5 (o novo)3151M
o331.128200k
gpt-oss-120b24.10.0370.17131k
Qwen3 Next 80B A3B Thinking16.90.151.2262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O catálogo tem 243 modelos listados hoje, vindos de 40 criadores. Nos últimos 30 dias, 24 foram lançados — e o Sonnet 4.5 entra nesse bolo. No topo do índice de inteligência, segue o o3 da OpenAI, com o gpt-oss-120b logo abaixo. O Sonnet 4.5 não aparece com nota; sem número, não dá para colocá-lo na régua.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 243 modelos disponíveis no catálogo nesta data.

O que dá para dizer com os dados em mãos: o Sonnet 4.5 custa o mesmo que o Sonnet 4 custava ontem, oferece a mesma janela de 1M de tokens, e promete ser melhor especificamente em agente e código. Não é uma revolução de preço. É uma aposta de que o segmento que mais cresce — agentes autônomos — está disposto a pagar tarifa premium.

Para quem vale e para quem não muda nada

Ficha técnica — Claude Sonnet 4.5
CampoValor
Identificadoranthropic/claude-sonnet-4.5
Criadoranthropic
Preço de entradaUS$ 3.00 / M tokens
Preço de saídaUS$ 15.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.300 / M (90% de desconto)

Vale para times que já rodavam Sonnet e querem o声称 de "estado da arte em SWE-bench" sem trocar de fornecedor. Vale para quem está montando agente de coding e precisa de um modelo que termine tarefas longas sem perder o fio. Vale para quem pode usar batch API e quer pagar US$ 7,50/M de saída em vez de US$ 15.

Não muda nada para quem escolheu o o3 pelo índice de inteligência — o 31,096 do o3 segue na frente, e o catálogo não trouxe nota do Sonnet 4.5 para comparar. Não muda nada para quem já usa o Qwen3 Next por economia — US$ 1,20/M de saída é outro planeta. E não muda nada para workloads simples, onde a diferença entre Sonnet 4 e 4.5 provavelmente some no ruído.

O que fazer com isso hoje

Se você está rodando agente em produção, vale rodar o Sonnet 4.5 em batch no trabalho assíncrono e guardar o endpoint síncrono para as tarefas onde latência importa. Se você está decidindo entre Anthropic e OpenAI, o o3 ainda lidera em inteligência medida; o Sonnet 4.5 entra pela porta do coding e dos agentes, não pela régua geral. E se você está com o orçamento apertado, o Qwen3 Next continua sendo o melhor custo por token de saída entre os modelos com índice publicado.

O catálogo não publicou nota de inteligência para o Sonnet 4.5. Enquanto isso não aparecer, o argumento da Anthropic é o SWE-bench e a janela de 1M. Para quem vende código, isso basta. Para quem vende conversa, talvez não.

Em uma frase

Mantenha o endpoint síncrono do Sonnet 4.5 para agentes de código em produção e empurre o trabalho assíncrono para a versão batch a US$ 7,50/M; se a régua for inteligência medida, o o3 ainda lidera.

Perguntas frequentes

Quanto custa o Claude Sonnet 4.5?

US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída, com cache de leitura a US$ 0,30 por milhão. A versão batch sai pela metade: US$ 1,50 de entrada e US$ 7,50 de saída.

O Sonnet 4.5 é melhor que o o3 da OpenAI?

O catálogo não publicou índice de inteligência para o Sonnet 4.5, então não dá para comparar na régua geral. O o3 lidera o índice com 31,096. A aposta da Anthropic é em coding (SWE-bench) e agentes, não na nota geral.

Vale trocar o Sonnet 4 pelo 4.5?

O preço é o mesmo e a janela continua em 1 milhão de tokens. A troca vale se você roda agentes de código ou workloads longos; para chatbot ou resumo, a diferença provavelmente não aparece na fatura.

Leia também