Claude Sonnet 4.6 lidera em inteligência, mas cobra US$ 15 por milhão de saída
O modelo mais capaz do catálogo hoje custa 6,4 vezes o Qwen 3.5 e 50 vezes o MiMo-V2-Flash — vale a diferença?
O topo da tabela é caro — e o segundo lugar, nem tanto
Você abre o catálogo, procura o modelo mais inteligente e leva um susto na coluna de preço. O Anthropic Claude Sonnet 4.6 lidera o índice de inteligência com 35,108 e cobra US$ 15 por milhão de tokens de saída. Logo abaixo dele, a 0,85 ponto de distância, está o Qwen 3.5 397B A17B, que custa US$ 2,34 pela mesma janela. Em outras palavras: a fronteira de capacidade custa hoje 6,4 vezes mais que a alternativa chinesa que ficou a um fio de distância.
A diferença não é só de quem está no topo. É de quem paga a conta no fim do mês.
O que o Sonnet 4.6 entrega que os outros não entregam
O Sonnet 4.6 trabalha com contexto de 1 milhão de tokens — quatro vezes o que o Qwen 3.5 e o MiMo-V2-Flash oferecem (262 mil) e cinco vezes o Claude Haiku 4.5 e o OpenAI o3 (200 mil). Para quem joga livros inteiros, bases de código grandes ou longos históricos de conversa numa única janela, isso muda o tipo de problema que dá para resolver sem ter que fragmentar.
A modalidade também é a mais completa do catálogo entre os modelos do topo: aceita texto, imagem e arquivo, e devolve texto. O Qwen 3.5 ainda vai além e inclui vídeo na entrada, mas o MiMo-V2-Flash é só texto — uma limitação real para fluxos que dependem de análise de imagem ou PDF.
| Campo | Valor |
|---|---|
| Identificador | anthropic/claude-sonnet-4.6 |
| Criador | anthropic |
| Preço de entrada | US$ 3.00 / M tokens |
| Preço de saída | US$ 15.00 / M tokens |
| Janela de contexto | 1M |
| Modalidade | text+image+file->text |
| Leitura de cache | US$ 0.300 / M (90% de desconto) |
| Índice de inteligência (AA) | 35.1 |
| Pesos | fechados |
| Velocidade de saída | 41 tokens/s |
A conta que ninguém gosta de fazer
Vamos colocar números na mesa. Para cada milhão de tokens de saída, o Sonnet 4.6 cobra US$ 15. O Haiku 4.5, da própria Anthropic, cobra US$ 5. O o3 da OpenAI fica em US$ 8. O Qwen 3.5 cobra US$ 2,34. O MiMo-V2-Flash cobra US$ 0,30.
Tem um porém que merece destaque: o preço de cache do Sonnet 4.6 é US$ 0,30 por milhão de tokens — o mesmo valor do MiMo-V2-Flash como preço de saída. Quem repete muito contexto (RAG, prompts longos, agentes) paga quase nada para reusar o que já mandou. Isso é uma alavanca real de economia para arquiteturas que mandam o mesmo system prompt ou a mesma base de conhecimento a cada chamada.
Para quem o Sonnet 4.6 vale a pena
Se o seu gargalo é capacidade bruta — tarefas agentic de múltiplos passos, navegação em codebase grande, planejamento de projeto ponta a ponta — e você já esgotou o que o Haiku 4.5 entrega, o Sonnet 4.6 é a referência hoje. O lançamento é de hoje, 17 de fevereiro de 2026, e ele substitui o Sonnet 4 como carro-chefe da Anthropic.
Se a sua decisão é puramente racional e o orçamento pesa, o caminho inteligente é outro: usar o Haiku 4.5 (US$ 5 de saída) como padrão e subir para o Sonnet 4.6 só nas chamadas que realmente precisam. O blended de US$ 6 por milhão do Sonnet ajuda a fazer essa conta no agregado.
Para quem o Sonnet 4.6 não muda nada
Se você já roda Qwen 3.5 397B ou MiMo-V2-Flash em self-hosting com pesos abertos, a diferença de 0,85 ponto no índice de inteligência raramente justifica migrar para uma API fechada a esse preço. O MiMo-V2-Flash, em particular, custa 50 vezes menos na saída e tem 309 bilhões de parâmetros totais com 15 bilhões ativos — uma pegada viável para quem tem GPU sobrando.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Claude Sonnet 4.6 (o novo) | 35.1 | 3 | 15 | 1M |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
| Qwen3.5 397B A17B | 34.3 | 0.55 | 3.5 | 262k |
| Claude Haiku 4.5 | 29.9 | 1 | 5 | 200k |
| o3 | 31.1 | 2 | 8 | 200k |
E se o seu caso de uso é multimodal com vídeo, o Qwen 3.5 aceita vídeo na entrada — o Sonnet 4.6 não.
O tabuleiro hoje
O catálogo tem 338 modelos listados e 52 criadores diferentes. Nos últimos 30 dias, 23 modelos foram lançados. O Sonnet 4.6 entra no dia do lançamento já no topo da tabela de inteligência, sem nenhum modelo acima de IQ 45 com preço baixo publicado — a faixa de fronteira é, por enquanto, exclusiva dos modelos caros.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
| Claude Haiku 4.5 | 29.9 | 5 |
A implicação prática é direta: o Sonnet 4.6 vale quando a tarefa exige o que só ele entrega (contexto de 1M tokens, multimodal completo, capacidade agentic de fronteira). Para o resto, o Haiku 4.5 da própria Anthropic ou o Qwen 3.5 fazem o trabalho com folga — e a fatura agradece.
Use o Sonnet 4.6 nas chamadas que realmente precisam da fronteira; para o restante, Haiku 4.5 ou Qwen 3.5 entregam o suficiente por uma fração do preço.
Perguntas frequentes
Quanto custa o Claude Sonnet 4.6 por milhão de tokens?
US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída. O preço de cache é US$ 0,30 por milhão — uma alavanca forte para prompts repetidos em RAG ou agentes.
Claude Sonnet 4.6 é melhor que o Qwen 3.5 397B?
No índice de inteligência, o Sonnet 4.6 lidera com 35,108 contra 34,262 do Qwen 3.5 — uma diferença de 0,85 ponto. O Qwen 3.5 custa cerca de 6,4 vezes menos na saída e tem pesos abertos, o que muda completamente a conta dependendo do seu cenário.
Vale trocar o Claude Haiku 4.5 pelo Sonnet 4.6?
Depende da tarefa. O Sonnet 4.6 tem contexto de 1 milhão de tokens (5x o Haiku) e lidera em inteligência. Se você só precisa de respostas rápidas em tarefas curtas, o Haiku 4.5 entrega por um terço do preço e com latência menor.