Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos
A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.
O que aconteceu entre 29 de setembro e 5 de outubro
Quatro modelos entraram no catálogo em sete dias. Pouco? Em semanas normais, sim. Em outubro de 2025, é o ritmo padrão — só nos últimos 30 dias foram 22 entradas novas. O que muda nesta leva é quem apareceu e em que faixa de preço.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2025-09-29 | DeepSeek V3.2 Exp | deepseek | — | 0.41 |
| 2025-09-29 | Claude Sonnet 4.5 (batch) | anthropic | — | 7.5 |
| 2025-09-29 | Claude Sonnet 4.5 | anthropic | — | 15 |
| 2025-09-30 | GLM 4.6 | z-ai | — | 2.2 |
A Anthropic dobrou a aposta no mesmo dia: lançou o Claude Sonnet 4.5 e, na sequência, uma versão batch do mesmo modelo. A Z.ai apareceu com o GLM 4.6. A DeepSeek tratou o V3.2 como experimento — o nome já entrega: "Exp".
O caso Anthropic: cobrar caro e cobrar barato ao mesmo tempo
O Claude Sonnet 4.5 chega a US$ 15 por milhão de tokens de saída. É o topo da prateleira entre os lançamentos da semana, empatado com o que a Anthropic já cobrava do Sonnet 4. Pagar caro aqui é escolha consciente: o cliente quer latência baixa e o melhor que a casa tem.
A jogada está na segunda peça. No mesmo 29 de setembro, a Anthropic publicou o Claude Sonnet 4.5 (batch) a US$ 7,50 por milhão de tokens de saída — exatamente metade do preço. O modo batch não é detalhe: é processamento assíncrono, sem garantia de tempo de resposta, voltado para jobs que podem esperar horas. Traduzindo: o mesmo modelo, sem o mesmo SLA, pela metade.
Para quem paga a conta da API, isso significa duas coisas. Primeiro, dá para escolher rota por tarefa — produção em tempo real com a versão cheia, varredura de dados e geração em massa com a batch. Segundo, a Anthropic está cobrindo a faixa premium inteira com um único modelo, em vez de empurrar o cliente para uma linha mais barata e pior.
DeepSeek V3.2 Exp: o preço de saldo
O DeepSeek V3.2 Exp custou US$ 0,41 por milhão de tokens de saída. Para efeito de comparação: o Claude Sonnet 4.5 custa quase 37 vezes mais. O sufixo "Exp" não é marketing — é um aviso de que o modelo pode mudar de comportamento, de preço ou simplesmente sumir.
A pergunta prática é direta: vale usar um modelo marcado como experimental em produção? A resposta depende do que você está construindo. Para protótipos, testes de prompt e jobs descartáveis, o custo por inferência pesa mais que a estabilidade. Para um produto com SLA, não — e o nome do modelo já está te avisando disso.
Z.ai: o quarto da fila
O GLM 4.6 entrou em 30 de setembro a US$ 1,75 por milhão de tokens de saída. Não é o mais barato da semana (a DeepSeek vence nesse quesito), nem o mais caro (a Anthropic leva). Fica no meio — exatamente onde a maioria dos workloads de produção mora: tarefas que precisam de qualidade razoável sem estourar o orçamento.
Z.ai é uma das 40 criadoras listadas no catálogo. Não é uma gigante ocidental, e é exatamente por isso que aparece nessa faixa: criadores chineses como Z.ai, DeepSeek e Qwen competem por preço enquanto Anthropic e OpenAI competem por topo de capacidade.
Onde isso te deixa
O catálogo fechou a semana com 244 modelos listados e o topo de inteligência ainda dominado pela OpenAI — o3 lidera com IQ 31,096, seguido pelo gpt-oss-120b em 24,126. Nenhum dos quatro lançamentos desta semana aparece nesse ranking, o que confirma a leitura: a briga da semana foi por faixa de preço e formato de cobrança, não por capacidade bruta.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Se você está rodando Anthropic hoje, vale testar o batch no Sonnet 4.5 antes de renovar qualquer contrato — metade do preço no mesmo modelo, desde que a tarefa aceite esperar. Se está prototipando, o DeepSeek V3.2 Exp é o terreno mais barato disponível, com a ressalva de que "Exp" significa "Exp". Se precisa de algo intermediário, o GLM 4.6 é a nova opção nessa faixa.
Mapeie cada workload ao par modelo+modalidade certo: Sonnet 4.5 batch para jobs assíncronos a US$ 7,50/M, V3.2 Exp só para experimentação, GLM 4.6 como intermediário.
Perguntas frequentes
O Claude Sonnet 4.5 vale o dobro do preço da versão batch?
São o mesmo modelo. A diferença é o modo de execução: a versão batch roda de forma assíncrona, sem garantia de latência, e custa US$ 7,50 por milhão de tokens de saída contra US$ 15 da versão padrão. Para tarefas que podem esperar, é a mesma capacidade pela metade do preço.
O que significa "Exp" no DeepSeek V3.2 Exp?
É um rótulo de modelo experimental. Indica que o comportamento, o preço ou a própria disponibilidade podem mudar sem aviso. Serve para testes e protótipos, não para produtos com SLA.
Por que nenhum dos lançamentos da semana aparece no topo de IQ?
Os quatro modelos entraram sem índice de inteligência publicado no catálogo. O topo continua dominado pela OpenAI — o3 em 31,096 e gpt-oss-120b em 24,126 — o que mostra que a briga da semana foi por preço e formato de cobrança, não por capacidade bruta.