Claude Sonnet 4.6 assume o topo de inteligência, mas custa 50x mais que o Xiaomi
Anthropic lança o modelo mais capaz do catálogo, com IQ 35,1 e janela de 1 milhão de tokens — só que o preço de US$ 15 por milhão de tokens de saída deixa a conta dura para quem roda volume.
O índice mais alto do catálogo veio com o maior preço de tabela
35,1 pontos. Logo atrás, 34,0. Por uma diferença de pouco mais de 1 ponto de índice, o Claude Sonnet 4.6 assume hoje o topo do catálogo em inteligência — e o segundo colocado, o Xiaomi MiMo-V2-Flash, custa 50 vezes menos no token de saída. É a história deste lançamento em uma frase: a Anthropic entregou o teto de capacidade do mercado, mas o preço virou um muro entre o modelo e quem roda volume.
O que chegou hoje
A Anthropic colocou no ar o Sonnet 4.6 com janela de 1 milhão de tokens, entrada multimídia (texto, imagem e arquivo) e saída em texto. Não é um modelo de raciocínio dedicado. Preço de tabela: US$ 3 por milhão de tokens de entrada, US$ 15 por milhão de saída, com cache de leitura a US$ 0,30. O custo blended (média ponderada) fica em US$ 6 por milhão.
Para quem não precisa de resposta em tempo real, existe a variante :batch, que corta o preço pela metade: US$ 1,50 de entrada e US$ 7,50 de saída. Continua custando 25 vezes mais que o Xiaomi no token de saída, mas é a opção interna mais barata.
Onde o Sonnet 4.6 se encaixa no tabuleiro
O catálogo de hoje tem mais de 338 modelos ativos, de 52 criadores. Só nos últimos 30 dias foram lançados 23. Mas o topo de inteligência segue concentrado em poucos nomes.
Sonnet 4.6 (35,1), Qwen 3.5 397B A17B (34,3), MiMo-V2-Flash (34,0) e OpenAI o3 (31,1) — esses são os quatro que aparecem acima de 30 pontos. Em preço de saída, a história é outra: US$ 15, US$ 2,34, US$ 0,30 e US$ 8, respectivamente.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Sonnet 4.6 (o novo) | 35.1 | 3 | 15 | 1M |
| Qwen3.5 397B A17B | 34.3 | 0.55 | 3.5 | 262k |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
| o3 | 31.1 | 2 | 8 | 200k |
O o3 da OpenAI já parecia caro perto dos chineses; o Sonnet 4.6 cobra quase o dobro disso por 4 pontos a mais de índice. A pergunta que fica é: esses 4 pontos a mais valem US$ 7 a mais por milhão de tokens?
A outra peça do pacote
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Claude Sonnet 4.6 (batch) | 1.5 | 7.5 | 1M |
O lançamento de hoje tem só dois itens: o Sonnet 4.6 e a versão batch. Sem modelo pequeno, sem open weights. A Anthropic não publicou o número de parâmetros nem a data de corte de conhecimento — o catálogo não traz esses dados.
Para quem vale — e para quem não
Se você roda agente de programação em produção, navegação complexa de codebase ou projeto que precisa de gestão ponta a ponta, o Sonnet 4.6 é o que entrega mais hoje. A versão batch reduz o custo pela metade se você tolera latência maior — e US$ 7,50 por milhão de saída ainda é mais barato que o OpenAI o3.
Se a sua conta de API está sob pressão, o MiMo-V2-Flash da Xiaomi entrega 97% do índice de inteligência do Sonnet por 2% do preço de saída. O Qwen 3.5 397B fica em 98% do índice por 16% do preço. Para muita carga de produção — sumarização, classificação, extração, análise de documentos — a diferença de 1 a 1,1 ponto de índice não aparece no produto final.
A implicação prática: o Sonnet 4.6 virou o novo teto de capacidade do catálogo, mas os modelos chineses continuam fazendo o trabalho sujo na ponta do custo. Antes de migrar tudo, vale rodar um piloto com Qwen ou Xiaomi no mesmo caso de uso. Se a qualidade aguentar, a economia paga o aluguel do escritório — e o Sonnet fica reservado para o que realmente exige o topo.
Migre para o Sonnet 4.6 só o que exige o melhor em coding e agentes longos; mantenha Qwen 3.5 ou Xiaomi MiMo no resto do pipeline para não multiplicar a fatura por 25 a 50 vezes.
Perguntas frequentes
Qual a diferença entre o Claude Sonnet 4.6 e a versão batch?
A versão `:batch` cobra metade do preço — US$ 1,50 por milhão de tokens de entrada e US$ 7,50 por milhão de saída — em troca de latência maior. É indicada para jobs em lote, como processamento de documentos em madruga ou reindexação de base.
Claude Sonnet 4.6 ou OpenAI o3: qual compensa mais?
O Sonnet 4.6 marca 35,1 de índice contra 31,1 do o3, mas custa quase o dobro no token de saída (US$ 15 contra US$ 8). Para coding e agentes longos, a vantagem do Sonnet aparece; para tarefas mais simples, o o3 entrega resultado próximo por menos.
O Sonnet 4.6 vale a pena frente aos modelos chineses mais baratos?
Depende do caso. Em coding, agentes longos e navegação de codebase, o Sonnet 4.6 entrega 4 pontos a mais de índice que o Qwen 3.5 e o Xiaomi MiMo. Em sumarização, extração e classificação, a diferença de 1 a 1,1 ponto raramente aparece no produto final — e o Xiaomi sai por 2% do preço do Sonnet.