FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Claude Sonnet 4.6 lidera em inteligência, mas cobra US$ 15 por milhão de saída

O modelo mais capaz do catálogo hoje custa 6,4 vezes o Qwen 3.5 e 50 vezes o MiMo-V2-Flash — vale a diferença?

Redação FalaVIP IA 3 min de leitura
35,108índice de inteligência (Artificial Analysis)
US$ 15por milhão de tokens de saída
US$ 0,30preço de cache por milhão de tokens

O topo da tabela é caro — e o segundo lugar, nem tanto

Você abre o catálogo, procura o modelo mais inteligente e leva um susto na coluna de preço. O Anthropic Claude Sonnet 4.6 lidera o índice de inteligência com 35,108 e cobra US$ 15 por milhão de tokens de saída. Logo abaixo dele, a 0,85 ponto de distância, está o Qwen 3.5 397B A17B, que custa US$ 2,34 pela mesma janela. Em outras palavras: a fronteira de capacidade custa hoje 6,4 vezes mais que a alternativa chinesa que ficou a um fio de distância.

Índice de inteligência (Artificial Analysis)
Claude Sonnet 4.635,1MiMo-V2-Flash34Qwen3.5 397B A17B34,3Claude Haiku 4.529,9o331,1índice
Fonte: Artificial Analysis

A diferença não é só de quem está no topo. É de quem paga a conta no fim do mês.

O que o Sonnet 4.6 entrega que os outros não entregam

O Sonnet 4.6 trabalha com contexto de 1 milhão de tokens — quatro vezes o que o Qwen 3.5 e o MiMo-V2-Flash oferecem (262 mil) e cinco vezes o Claude Haiku 4.5 e o OpenAI o3 (200 mil). Para quem joga livros inteiros, bases de código grandes ou longos históricos de conversa numa única janela, isso muda o tipo de problema que dá para resolver sem ter que fragmentar.

A modalidade também é a mais completa do catálogo entre os modelos do topo: aceita texto, imagem e arquivo, e devolve texto. O Qwen 3.5 ainda vai além e inclui vídeo na entrada, mas o MiMo-V2-Flash é só texto — uma limitação real para fluxos que dependem de análise de imagem ou PDF.

Ficha técnica — Claude Sonnet 4.6
CampoValor
Identificadoranthropic/claude-sonnet-4.6
Criadoranthropic
Preço de entradaUS$ 3.00 / M tokens
Preço de saídaUS$ 15.00 / M tokens
Janela de contexto1M
Modalidadetext+image+file->text
Leitura de cacheUS$ 0.300 / M (90% de desconto)
Índice de inteligência (AA)35.1
Pesosfechados
Velocidade de saída41 tokens/s

A conta que ninguém gosta de fazer

Vamos colocar números na mesa. Para cada milhão de tokens de saída, o Sonnet 4.6 cobra US$ 15. O Haiku 4.5, da própria Anthropic, cobra US$ 5. O o3 da OpenAI fica em US$ 8. O Qwen 3.5 cobra US$ 2,34. O MiMo-V2-Flash cobra US$ 0,30.

Preço de saída (US$ por milhão de tokens)
Claude Sonnet 4.615MiMo-V2-Flash0,3Qwen3.5 397B A17B3,5Claude Haiku 4.55o38US$/M
Fonte: OpenRouter

Tem um porém que merece destaque: o preço de cache do Sonnet 4.6 é US$ 0,30 por milhão de tokens — o mesmo valor do MiMo-V2-Flash como preço de saída. Quem repete muito contexto (RAG, prompts longos, agentes) paga quase nada para reusar o que já mandou. Isso é uma alavanca real de economia para arquiteturas que mandam o mesmo system prompt ou a mesma base de conhecimento a cada chamada.

Inteligência × preço de saída
Claude Sonnet 4.6MiMo-V2-FlashQwen3.5 397B A17BClaude Haiku 4.5o3US$ por milhão (saída, escala log)índice de inteligência

Para quem o Sonnet 4.6 vale a pena

Se o seu gargalo é capacidade bruta — tarefas agentic de múltiplos passos, navegação em codebase grande, planejamento de projeto ponta a ponta — e você já esgotou o que o Haiku 4.5 entrega, o Sonnet 4.6 é a referência hoje. O lançamento é de hoje, 17 de fevereiro de 2026, e ele substitui o Sonnet 4 como carro-chefe da Anthropic.

Se a sua decisão é puramente racional e o orçamento pesa, o caminho inteligente é outro: usar o Haiku 4.5 (US$ 5 de saída) como padrão e subir para o Sonnet 4.6 só nas chamadas que realmente precisam. O blended de US$ 6 por milhão do Sonnet ajuda a fazer essa conta no agregado.

Para quem o Sonnet 4.6 não muda nada

Se você já roda Qwen 3.5 397B ou MiMo-V2-Flash em self-hosting com pesos abertos, a diferença de 0,85 ponto no índice de inteligência raramente justifica migrar para uma API fechada a esse preço. O MiMo-V2-Flash, em particular, custa 50 vezes menos na saída e tem 309 bilhões de parâmetros totais com 15 bilhões ativos — uma pegada viável para quem tem GPU sobrando.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Claude Sonnet 4.6 (o novo)35.13151M
MiMo-V2-Flash34.00.10.3262k
Qwen3.5 397B A17B34.30.553.5262k
Claude Haiku 4.529.915200k
o331.128200k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

E se o seu caso de uso é multimodal com vídeo, o Qwen 3.5 aceita vídeo na entrada — o Sonnet 4.6 não.

O tabuleiro hoje

O catálogo tem 338 modelos listados e 52 criadores diferentes. Nos últimos 30 dias, 23 modelos foram lançados. O Sonnet 4.6 entra no dia do lançamento já no topo da tabela de inteligência, sem nenhum modelo acima de IQ 45 com preço baixo publicado — a faixa de fronteira é, por enquanto, exclusiva dos modelos caros.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
Entre os 338 modelos disponíveis no catálogo nesta data.

A implicação prática é direta: o Sonnet 4.6 vale quando a tarefa exige o que só ele entrega (contexto de 1M tokens, multimodal completo, capacidade agentic de fronteira). Para o resto, o Haiku 4.5 da própria Anthropic ou o Qwen 3.5 fazem o trabalho com folga — e a fatura agradece.

Em uma frase

Use o Sonnet 4.6 nas chamadas que realmente precisam da fronteira; para o restante, Haiku 4.5 ou Qwen 3.5 entregam o suficiente por uma fração do preço.

Perguntas frequentes

Quanto custa o Claude Sonnet 4.6 por milhão de tokens?

US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída. O preço de cache é US$ 0,30 por milhão — uma alavanca forte para prompts repetidos em RAG ou agentes.

Claude Sonnet 4.6 é melhor que o Qwen 3.5 397B?

No índice de inteligência, o Sonnet 4.6 lidera com 35,108 contra 34,262 do Qwen 3.5 — uma diferença de 0,85 ponto. O Qwen 3.5 custa cerca de 6,4 vezes menos na saída e tem pesos abertos, o que muda completamente a conta dependendo do seu cenário.

Vale trocar o Claude Haiku 4.5 pelo Sonnet 4.6?

Depende da tarefa. O Sonnet 4.6 tem contexto de 1 milhão de tokens (5x o Haiku) e lidera em inteligência. Se você só precisa de respostas rápidas em tarefas curtas, o Haiku 4.5 entrega por um terço do preço e com latência menor.

Leia também