FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Opus 4.6 a US$ 25, coder da Qwen a US$ 0,80: a semana em dois polos

Três lançamentos, nenhum corte de preço. Anthropic reforçou o polo premium; Qwen atacou o polo barato. O meio do mercado ficou parado.

Redação FalaVIP IA 3 min de leitura
US$ 25por milhão de tokens de saída (Claude Opus 4.6)
US$ 0,80por milhão de tokens de saída (Qwen3 Coder Next)
US$ 12,50por milhão de tokens de saída (Opus 4.6 batch)

A semana em duas pontas

US$ 25 por milhão de tokens de saída. Esse é o preço do Claude Opus 4.6, lançado pela Anthropic em 4 de fevereiro. No mesmo dia, a Qwen colocou no ar o Qwen3 Coder Next a US$ 0,80. Em uma semana que colocou três modelos novos no catálogo sem mexer em nenhum preço existente, o que ficou claro é que o mercado está se organizando em dois polos cada vez mais distantes.

Lançamentos da semana por criador
anthropic2qwen1modelos

Anthropic mantém o premium com Opus 4.6

O Opus 4.6 chega a US$ 25 por milhão de tokens de saída — e a versão batch sai por US$ 12,50, metade do preço para quem pode esperar processamento assíncrono. É um dos preços mais altos do mercado de API.

O detalhe que merece atenção: o Opus 4.6 ainda não tem índice de inteligência publicado. Não dá para comparar diretamente com o o3 da OpenAI (IQ 31,1, US$ 8/M) ou com o Haiku 4.5 da própria Anthropic (IQ 29,9, US$ 5/M) por uma métrica única. Quem está decidindo entre pagar US$ 25 ou US$ 5 no Haiku vai ter que testar na própria tarefa antes de bater o martelo.

Para quem faz sentido: workloads onde a qualidade de raciocínio justifica o custo — geração de código complexo, análise jurídica, agentes longos com muitas chamadas encadeadas. Para quem não faz sentido: a maioria dos casos corporativos, onde o Haiku 4.5 resolve com folga a uma fração do custo.

Lançamentos entre 2026-02-02 e 2026-02-08
DataModeloCriadorInteligênciaSaída US$/M
2026-02-04Qwen3 Coder Nextqwen21.30.8
2026-02-04Claude Opus 4.6 (batch)anthropic12.5
2026-02-04Claude Opus 4.6anthropic25

Qwen3 Coder Next: preço de commodity

Também em 4 de fevereiro, a Qwen lançou o Qwen3 Coder Next a US$ 0,80 por milhão de tokens de saída. O índice de inteligência fica em 21,3 — abaixo do Haiku 4.5, mas acima de vários modelos de uso geral no catálogo.

O ponto aqui é o posicionamento. A Qwen não está tentando competir com o Opus 4.6 em raciocínio geral; está mirando em tarefas de código onde o custo por chamada pesa mais que a nota em benchmark genérico. Para um dev gerando centenas de completions por dia, US$ 0,80 vs. US$ 25 é a diferença entre um projeto viável e uma fatura que precisa de aprovação do financeiro.

O resto do catálogo ficou parado

Zero mudanças de preço na semana. Zero cortes, zero aumentos. Em um mercado que vinha com cortes frequentes nos últimos meses, a calmaria chama atenção.

O catálogo está em mais de 330 modelos de 52 criadores. Nos últimos 30 dias, 16 modelos novos entraram — o ritmo de lançamento não parou, mas os preços existentes não estão se mexendo. A mensagem para quem paga a conta: a competição está acontecendo no lançamento de modelos novos, não no ajuste dos antigos.

Olhando o topo do ranking de inteligência, o cenário fica mais interessante. O primeiro lugar hoje é o Xiaomi MiMo-V2-Flash, com IQ 34,0 e preço de US$ 0,30 por milhão de tokens de saída — ou seja, o modelo mais inteligente do catálogo custa menos que um café. Logo atrás vêm o o3 (IQ 31,1, US$ 8/M) e o Haiku 4.5 (IQ 29,9, US$ 5/M). Quando o modelo mais barato do topo é também o mais inteligente, a pergunta deixa de ser "qual é o melhor?" e passa a ser "qual é o melhor para a minha tarefa?".

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
MiMo-V2-Flash34.00.3
o331.18
Claude Haiku 4.529.95
gpt-oss-120b24.10.17
Qwen3 Coder Next21.30.8
Entre os 330 modelos disponíveis no catálogo nesta data.

O que fazer com isso na segunda-feira

Se você está escolhendo modelo esta semana, a decisão é mais sobre qual polo te atende do que sobre qual modelo dentro de um mesmo polo. Precisa do melhor raciocínio e pode pagar? Espere o Opus 4.6 amadurecer os benchmarks, ou vá de o3 (US$ 8/M) ou Haiku 4.5 (US$ 5/M) enquanto isso. Está gerando código em volume? Qwen3 Coder Next a US$ 0,80/M é difícil de bater no custo.

E se você está no meio — tarefa genérica, orçamento moderado — a boa notícia é que o catálogo não mexeu nos preços. O que estava bom continua bom.

Em uma frase

Se você precisa de raciocínio premium, espere o Opus 4.6 ganhar benchmark público; se o que importa é custo por chamada de código, o Qwen3 Coder Next a US$ 0,80/M é o melhor negócio da semana.

Perguntas frequentes

Quanto custa o Claude Opus 4.6?

US$ 25 por milhão de tokens de saída na versão padrão. A versão batch sai por US$ 12,50, com processamento assíncrono e metade do preço.

O Claude Opus 4.6 já tem benchmark de inteligência?

Não. O catálogo ainda não publicou um índice de inteligência para o Opus 4.6, então a comparação com o3 (IQ 31,1) e Haiku 4.5 (IQ 29,9) depende de teste próprio na sua tarefa.

Qwen3 Coder Next serve para quê?

Tarefas de código em volume, onde o custo por chamada pesa mais que a nota em benchmark. O IQ de 21,3 é modesto, mas o preço de US$ 0,80/M é difícil de igualar para quem gera centenas de completions por dia.

Leia também