FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos

A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.

Redação FalaVIP IA 3 min de leitura
US$ 15por milhão de tokens de saída do Claude Sonnet 4.5
US$ 7,50por milhão de tokens de saída do Claude Sonnet 4.5 em modo batch
US$ 0,41por milhão de tokens de saída do DeepSeek V3.2 Exp

O que aconteceu entre 29 de setembro e 5 de outubro

Quatro modelos entraram no catálogo em sete dias. Pouco? Em semanas normais, sim. Em outubro de 2025, é o ritmo padrão — só nos últimos 30 dias foram 22 entradas novas. O que muda nesta leva é quem apareceu e em que faixa de preço.

Lançamentos entre 2025-09-29 e 2025-10-05
DataModeloCriadorInteligênciaSaída US$/M
2025-09-29DeepSeek V3.2 Expdeepseek0.41
2025-09-29Claude Sonnet 4.5 (batch)anthropic7.5
2025-09-29Claude Sonnet 4.5anthropic15
2025-09-30GLM 4.6z-ai2.2

A Anthropic dobrou a aposta no mesmo dia: lançou o Claude Sonnet 4.5 e, na sequência, uma versão batch do mesmo modelo. A Z.ai apareceu com o GLM 4.6. A DeepSeek tratou o V3.2 como experimento — o nome já entrega: "Exp".

O caso Anthropic: cobrar caro e cobrar barato ao mesmo tempo

O Claude Sonnet 4.5 chega a US$ 15 por milhão de tokens de saída. É o topo da prateleira entre os lançamentos da semana, empatado com o que a Anthropic já cobrava do Sonnet 4. Pagar caro aqui é escolha consciente: o cliente quer latência baixa e o melhor que a casa tem.

A jogada está na segunda peça. No mesmo 29 de setembro, a Anthropic publicou o Claude Sonnet 4.5 (batch) a US$ 7,50 por milhão de tokens de saída — exatamente metade do preço. O modo batch não é detalhe: é processamento assíncrono, sem garantia de tempo de resposta, voltado para jobs que podem esperar horas. Traduzindo: o mesmo modelo, sem o mesmo SLA, pela metade.

Lançamentos da semana por criador
anthropic2deepseek1z-ai1modelos

Para quem paga a conta da API, isso significa duas coisas. Primeiro, dá para escolher rota por tarefa — produção em tempo real com a versão cheia, varredura de dados e geração em massa com a batch. Segundo, a Anthropic está cobrindo a faixa premium inteira com um único modelo, em vez de empurrar o cliente para uma linha mais barata e pior.

DeepSeek V3.2 Exp: o preço de saldo

O DeepSeek V3.2 Exp custou US$ 0,41 por milhão de tokens de saída. Para efeito de comparação: o Claude Sonnet 4.5 custa quase 37 vezes mais. O sufixo "Exp" não é marketing — é um aviso de que o modelo pode mudar de comportamento, de preço ou simplesmente sumir.

A pergunta prática é direta: vale usar um modelo marcado como experimental em produção? A resposta depende do que você está construindo. Para protótipos, testes de prompt e jobs descartáveis, o custo por inferência pesa mais que a estabilidade. Para um produto com SLA, não — e o nome do modelo já está te avisando disso.

Z.ai: o quarto da fila

O GLM 4.6 entrou em 30 de setembro a US$ 1,75 por milhão de tokens de saída. Não é o mais barato da semana (a DeepSeek vence nesse quesito), nem o mais caro (a Anthropic leva). Fica no meio — exatamente onde a maioria dos workloads de produção mora: tarefas que precisam de qualidade razoável sem estourar o orçamento.

Z.ai é uma das 40 criadoras listadas no catálogo. Não é uma gigante ocidental, e é exatamente por isso que aparece nessa faixa: criadores chineses como Z.ai, DeepSeek e Qwen competem por preço enquanto Anthropic e OpenAI competem por topo de capacidade.

Onde isso te deixa

O catálogo fechou a semana com 244 modelos listados e o topo de inteligência ainda dominado pela OpenAI — o3 lidera com IQ 31,096, seguido pelo gpt-oss-120b em 24,126. Nenhum dos quatro lançamentos desta semana aparece nesse ranking, o que confirma a leitura: a briga da semana foi por faixa de preço e formato de cobrança, não por capacidade bruta.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
o331.18
gpt-oss-120b24.10.17
Qwen3 Next 80B A3B Thinking16.91.2
gpt-oss-20b15.20.13
Llama 4 Maverick14.50.696
Entre os 244 modelos disponíveis no catálogo nesta data.

Se você está rodando Anthropic hoje, vale testar o batch no Sonnet 4.5 antes de renovar qualquer contrato — metade do preço no mesmo modelo, desde que a tarefa aceite esperar. Se está prototipando, o DeepSeek V3.2 Exp é o terreno mais barato disponível, com a ressalva de que "Exp" significa "Exp". Se precisa de algo intermediário, o GLM 4.6 é a nova opção nessa faixa.

Em uma frase

Mapeie cada workload ao par modelo+modalidade certo: Sonnet 4.5 batch para jobs assíncronos a US$ 7,50/M, V3.2 Exp só para experimentação, GLM 4.6 como intermediário.

Perguntas frequentes

O Claude Sonnet 4.5 vale o dobro do preço da versão batch?

São o mesmo modelo. A diferença é o modo de execução: a versão batch roda de forma assíncrona, sem garantia de latência, e custa US$ 7,50 por milhão de tokens de saída contra US$ 15 da versão padrão. Para tarefas que podem esperar, é a mesma capacidade pela metade do preço.

O que significa "Exp" no DeepSeek V3.2 Exp?

É um rótulo de modelo experimental. Indica que o comportamento, o preço ou a própria disponibilidade podem mudar sem aviso. Serve para testes e protótipos, não para produtos com SLA.

Por que nenhum dos lançamentos da semana aparece no topo de IQ?

Os quatro modelos entraram sem índice de inteligência publicado no catálogo. O topo continua dominado pela OpenAI — o3 em 31,096 e gpt-oss-120b em 24,126 — o que mostra que a briga da semana foi por preço e formato de cobrança, não por capacidade bruta.

Leia também