Em sete dias, 63 preços mudaram e o barato virou o centro do jogo
DeepSeek, Qwen e Thinking Machines puxaram a semana dos lançamentos baratos, enquanto OpenAI e Anthropic seguem longe do orçamento.
A semana em que o número grande foi o preço
Você não leu errado: entre 27 de julho e hoje, 2 de agosto de 2026, 63 preços mudaram no catálogo. Desses, 37 foram cortes e 22 foram aumentos. É a primeira vez em muito tempo que a fila do barato anda mais cheia que a fila do caro. Mas a mudança não está só no placar — está em quem está marcando os gols.
Quem apareceu no campo esta semana
Sete modelos novos entraram em campo em sete dias, e quase todos vieram de dois times: o laboratório chinês DeepSeek e a novata Thinking Machines.
A DeepSeek lançou três variantes do V4 Flash em 48 horas (entre 31 de julho e 1º de agosto), incluindo a versão :batch e a apelidada latest. O preço de saída da versão padrão caiu para US$ 0,18 por milhão de tokens, abaixo de qualquer coisa que a OpenAI oferece no mesmo nível de capacidade. O índice de inteligência do V4 Flash 0731 é 51,767 — acima de qualquer modelo vendido por menos de US$ 1.
A Qwen abriu a semana com o Qwen3.7 Flash, no dia 27 de julho, a US$ 0,13 por milhão de tokens de saída. É o modelo mais barato lançado neste recorte — e ele entrou sem índice de inteligência publicado no catálogo.
A Thinking Machines, criador novo no catálogo, apareceu em dose tripla no dia 30 de julho: Inkling Small, Inkling Small (batch) e Inkling Small (free). O free cobra zero; o padrão e o batch, US$ 1,20. Nenhum dos três tem IQ medido até agora.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-07-27 | Qwen3.7 Flash | qwen | — | 0.13 |
| 2026-07-30 | Inkling Small (free) | thinkingmachines | — | 0 |
| 2026-07-30 | Inkling Small | thinkingmachines | — | 1.2 |
| 2026-07-30 | Inkling Small (batch) | thinkingmachines | — | 1.2 |
| 2026-07-31 | DeepSeek V4 Flash 0731 (batc | deepseek | — | 0.28 |
| 2026-07-31 | DeepSeek V4 Flash 0731 | deepseek | 51.8 | 0.18 |
| 2026-08-01 | DeepSeek V4 Flash Latest | ~deepseek | — | 0.16 |
Por que o barato virou o protagonista
Antes desta semana, a referência de "barato com IQ razoável" já era o DeepSeek V3. Agora, com o V4 Flash 0731 a US$ 0,18 de saída e IQ de 51,767, a régua mudou. Para você que paga a conta, isso significa uma coisa concreta: tarefas de classificação, sumarização e extração — que antes você rodava num modelo intermediário a US$ 3 ou US$ 5 — cabem agora em uma fração disso.
Olha o abismo entre o topo do mercado e o novo chão:
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| GPT-5.6 Terra | 56.6 | 12 |
O Claude Opus 5, da Anthropic, lidera o índice com 63,053 — e custa US$ 25 por milhão de tokens de saída. É quase 139 vezes mais caro que o V4 Flash 0731. O Claude Fable 5, da mesma Anthropic, está em segundo no ranking (62,073) a US$ 50. Para a maioria das cargas de produção, pagar isso é pagar por capacidade que a requisição nem usa.
O que essa semana diz sobre o tabuleiro
A OpenAI continua no top 3 com o GPT-5.6 Sol (60,93) e o GPT-5.6 Terra (56,576), mas não lançou nada novo nos últimos sete dias. Quem entrou em campo foi o ecossistema chinês, com DeepSeek, Qwen e MoonshotAI (o Kimi K3, lançado no mês passado, segue no top 4 com IQ 59,699 a US$ 15). O sinal é claro: a fronteira da relação custo/benefício está se movendo para Pequim, enquanto a fronteira da capacidade bruta segue em São Francisco.
Outra pista: dos 63 ajustes de preço da semana, 37 foram cortes. Em um mercado que costuma alternar entre aumento e queda, uma razão de quase 2:1 a favor da queda é incomum. Fabricantes menores estão competindo por visibilidade via preço, e os incumbentes respondem — ou perdem share silenciosamente.
Para quem isso muda alguma coisa
Se você roda alto volume de inferência barata — geração de embeddings, classificação, RAG simples, agentes em loop —, o V4 Flash 0731 e o Qwen3.7 Flash merecem um teste A/B esta semana. O custo marginal por chamada vai despencar, e o IQ medido do V4 Flash (51,767) mostra que você não está trocando qualidade por centavos.
Se o seu produto depende do topo absoluto de raciocínio — análise jurídica, código de missão crítica, pesquisa multi-step —, o Opus 5 e o Fable 5 continuam sem substituto no catálogo, e nada nesta semana mudou isso. O índice dos dois segue intocado.
Se você está avaliando fornecedores, a aparição da Thinking Machines com três variantes em um único dia é nota de rodapé relevante: há um player a mais brigando por volume no segmento low-cost, e isso tende a empurrar o chão de preço ainda mais para baixo nas próximas semanas.
O que fazer na segunda-feira
Não troque de modelo no impulso. Pegue as três tarefas que mais consomem tokens na sua fatura, replique no DeepSeek V4 Flash 0731 (deepseek-v4-flash-0731) e meça latência e taxa de erro. Se passar, o seu custo de saída naquelas rotas pode cair para algo próximo de um quinto do que é hoje — sem perder qualidade mensurável.
Troque as tarefas de alto volume para o DeepSeek V4 Flash 0731 (US$ 0,18/M saída) e mantenha Opus 5 ou Fable 5 só para as rotas que realmente exigem o topo do raciocínio.
Perguntas frequentes
Qual foi o modelo mais barato lançado na semana?
O Qwen3.7 Flash, da Qwen, lançado em 27 de julho de 2026, a US$ 0,13 por milhão de tokens de saída. É o menor valor entre os sete lançamentos do recorte.
O DeepSeek V4 Flash 0731 vale a pena trocar pelo GPT-5.6?
Depende da tarefa. O V4 Flash 0731 tem IQ medido de 51,767 e custa US$ 0,18 por milhão de tokens de saída. Para cargas de alto volume e baixa complexidade, o custo cai drasticamente. Para raciocínio complexo, o GPT-5.6 Sol (IQ 60,93) ainda lidera entre os da OpenAI.
Por que teve mais corte de preço do que aumento?
Dos 63 ajustes de preço entre 27 de julho e 2 de agosto de 2026, 37 foram cortes e 22 foram aumentos. A razão indica que fabricantes menores estão competindo por volume via preço, enquanto os incumbentes ainda concentram o topo do ranking de inteligência.