FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Claude Sonnet 4.6 assume o topo de inteligência, mas custa 50x mais que o Xiaomi

Anthropic lança o modelo mais capaz do catálogo, com IQ 35,1 e janela de 1 milhão de tokens — só que o preço de US$ 15 por milhão de tokens de saída deixa a conta dura para quem roda volume.

Redação FalaVIP IA 3 min de leitura
35,1índice de inteligência — topo do catálogo
US$ 15por milhão de tokens de saída
50xmais caro que o Xiaomi MiMo-V2-Flash no token de saída

O índice mais alto do catálogo veio com o maior preço de tabela

35,1 pontos. Logo atrás, 34,0. Por uma diferença de pouco mais de 1 ponto de índice, o Claude Sonnet 4.6 assume hoje o topo do catálogo em inteligência — e o segundo colocado, o Xiaomi MiMo-V2-Flash, custa 50 vezes menos no token de saída. É a história deste lançamento em uma frase: a Anthropic entregou o teto de capacidade do mercado, mas o preço virou um muro entre o modelo e quem roda volume.

O que chegou hoje

A Anthropic colocou no ar o Sonnet 4.6 com janela de 1 milhão de tokens, entrada multimídia (texto, imagem e arquivo) e saída em texto. Não é um modelo de raciocínio dedicado. Preço de tabela: US$ 3 por milhão de tokens de entrada, US$ 15 por milhão de saída, com cache de leitura a US$ 0,30. O custo blended (média ponderada) fica em US$ 6 por milhão.

Índice de inteligência (Artificial Analysis)
Claude Sonnet 4.635,1Qwen3.5 397B A17B34,3MiMo-V2-Flash34o331,1índice
Fonte: Artificial Analysis

Para quem não precisa de resposta em tempo real, existe a variante :batch, que corta o preço pela metade: US$ 1,50 de entrada e US$ 7,50 de saída. Continua custando 25 vezes mais que o Xiaomi no token de saída, mas é a opção interna mais barata.

Onde o Sonnet 4.6 se encaixa no tabuleiro

O catálogo de hoje tem mais de 338 modelos ativos, de 52 criadores. Só nos últimos 30 dias foram lançados 23. Mas o topo de inteligência segue concentrado em poucos nomes.

Preço de saída (US$ por milhão de tokens)
Claude Sonnet 4.615Qwen3.5 397B A17B3,5MiMo-V2-Flash0,3o38US$/M
Fonte: OpenRouter

Sonnet 4.6 (35,1), Qwen 3.5 397B A17B (34,3), MiMo-V2-Flash (34,0) e OpenAI o3 (31,1) — esses são os quatro que aparecem acima de 30 pontos. Em preço de saída, a história é outra: US$ 15, US$ 2,34, US$ 0,30 e US$ 8, respectivamente.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Sonnet 4.6 (o novo)35.13151M
Qwen3.5 397B A17B34.30.553.5262k
MiMo-V2-Flash34.00.10.3262k
o331.128200k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

O o3 da OpenAI já parecia caro perto dos chineses; o Sonnet 4.6 cobra quase o dobro disso por 4 pontos a mais de índice. A pergunta que fica é: esses 4 pontos a mais valem US$ 7 a mais por milhão de tokens?

A outra peça do pacote

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Claude Sonnet 4.6 (batch)1.57.51M

O lançamento de hoje tem só dois itens: o Sonnet 4.6 e a versão batch. Sem modelo pequeno, sem open weights. A Anthropic não publicou o número de parâmetros nem a data de corte de conhecimento — o catálogo não traz esses dados.

Para quem vale — e para quem não

Se você roda agente de programação em produção, navegação complexa de codebase ou projeto que precisa de gestão ponta a ponta, o Sonnet 4.6 é o que entrega mais hoje. A versão batch reduz o custo pela metade se você tolera latência maior — e US$ 7,50 por milhão de saída ainda é mais barato que o OpenAI o3.

Se a sua conta de API está sob pressão, o MiMo-V2-Flash da Xiaomi entrega 97% do índice de inteligência do Sonnet por 2% do preço de saída. O Qwen 3.5 397B fica em 98% do índice por 16% do preço. Para muita carga de produção — sumarização, classificação, extração, análise de documentos — a diferença de 1 a 1,1 ponto de índice não aparece no produto final.

A implicação prática: o Sonnet 4.6 virou o novo teto de capacidade do catálogo, mas os modelos chineses continuam fazendo o trabalho sujo na ponta do custo. Antes de migrar tudo, vale rodar um piloto com Qwen ou Xiaomi no mesmo caso de uso. Se a qualidade aguentar, a economia paga o aluguel do escritório — e o Sonnet fica reservado para o que realmente exige o topo.

Em uma frase

Migre para o Sonnet 4.6 só o que exige o melhor em coding e agentes longos; mantenha Qwen 3.5 ou Xiaomi MiMo no resto do pipeline para não multiplicar a fatura por 25 a 50 vezes.

Perguntas frequentes

Qual a diferença entre o Claude Sonnet 4.6 e a versão batch?

A versão `:batch` cobra metade do preço — US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de saída — em troca de latência maior. É indicada para jobs em lote, como processamento de documentos em madruga ou reindexação de base.

Claude Sonnet 4.6 ou OpenAI o3: qual compensa mais?

O Sonnet 4.6 marca 35,1 de índice contra 31,1 do o3, mas custa quase o dobro no token de saída (US$ 15 contra US$ 8). Para coding e agentes longos, a vantagem do Sonnet aparece; para tarefas mais simples, o o3 entrega resultado próximo por menos.

O Sonnet 4.6 vale a pena frente aos modelos chineses mais baratos?

Depende do caso. Em coding, agentes longos e navegação de codebase, o Sonnet 4.6 entrega 4 pontos a mais de índice que o Qwen 3.5 e o Xiaomi MiMo. Em sumarização, extração e classificação, a diferença de 1 a 1,1 ponto raramente aparece no produto final — e o Xiaomi sai por 2% do preço do Sonnet.

Leia também