FalaVIP IA quinta-feira, 03 de setembro de 2026
Retrospectiva

Oito modelos novos e 59 cortes de preço em sete dias

Três da Tencent para tradução, dois da Z.ai, visão nova da DeepSeek — e o placar de preços seguiu favorável: 59 cortes contra 40 altas.

Redação FalaVIP IA 3 min de leitura
59cortes de preço na semana (contra 40 altas)
US$ 0,177por milhão de tokens de saída — Tencent Hy-MT2-1.8B
138xdiferença de preço entre o topo (Opus 5) e o mais barato acima de IQ 45 (Flash 0731)

59 cortes contra 40 altas: o mercado segue apertando

O mercado de modelos de IA fechou a semana com sinal claro de compressão de preços. Em sete dias, o catálogo somou 110 mudanças — 59 cortes contra 40 altas. O saldo é negativo, e segue o padrão das últimas semanas. O piso continua descendo enquanto o topo segura.

Lançamentos da semana por criador
tencent3z-ai1~z-ai1stealth1deepseek1meta1modelos

Oito modelos novos em sete dias

A semana teve oito lançamentos. O detalhe que chama atenção não é a quantidade, é o perfil: especialização. Três vieram da Tencent focados em tradução, dois da Z.ai, um da DeepSeek adicionando visão ao Flash, um da Meta como variante "contributor", e um modelo stealth sem criador identificado.

Lançamentos entre 2026-08-17 e 2026-08-23
DataModeloCriadorInteligênciaSaída US$/M
2026-08-18GLM 5.3z-ai59.54.4
2026-08-19Hy-MT2-7Btencent0.295
2026-08-19GLM Latest~z-ai3.432
2026-08-20Hy-MT2-30B-A3Btencent0.295
2026-08-20Hy-MT2-1.8Btencent0.177
2026-08-20Ox Alphastealth0
2026-08-21DeepSeek V4 Flash Vision Expdeepseek1.32
2026-08-21Muse Spark 1.2 Contributormeta0.2

Tencent: trio de tradução abaixo de US$ 0,30

A jogada mais concentrada da semana veio da Tencent. Em 19 e 20 de agosto, a empresa soltou três modelos da linha Hy-MT2: 7B, 30B-A3B (MoE) e 1.8B. Todos com preço de saída abaixo de US$ 0,30 por milhão de tokens — o 1.8B a US$ 0,177, os outros dois a US$ 0,295.

São modelos de tradução. Se você roda pipeline de localização ou chatbot multilíngue, é o tipo de especialização que importa: modelo feito para uma tarefa, precificado como commodity de infraestrutura. A lógica é simples — por que pagar US$ 5/M de um modelo generalista quando existe um específico por uma fração disso? A resposta depende da qualidade de tradução, claro, mas o preço convida ao teste A/B.

Z.ai e DeepSeek mexeram no meio do tabuleiro

A Z.ai não ficou atrás. Em 18 de agosto chegou o GLM 5.3, com IQ 59,513 e preço de US$ 4,40 por milhão. No dia seguinte, um alias chamado "GLM Latest" apareceu a US$ 3,50 — sem IQ publicado, e o catálogo é explícito quando o campo não foi preenchido em vez de chutar número.

A DeepSeek expandiu a linha Flash em 21 de agosto com o V4 Flash Vision Exp a US$ 0,66/M. O Flash 0731 base (ainda o modelo mais barato acima de IQ 45 no catálogo, a US$ 0,18/M) é só texto. A nova variante adiciona visão por 3,6 vezes o preço — ainda barato por qualquer métrica do mercado.

A Meta, por sua vez, colocou no ar o Muse Spark 1.2 Contributor a US$ 0,20/M. Sem IQ publicado. O nome "Contributor" sugere uma variante aberta para comunidade, mas sem mais dados no catálogo, fica a dúvida sobre o que diferencia do Muse Spark 1.2 base.

O topo não se mexeu

Enquanto a base ficou mais cheia e mais barata, o topo ficou parado. Claude Opus 5 segue na frente com IQ 63,053 (US$ 25/M), seguido de Claude Fable 5 (62,073, US$ 50), GPT-5.6 Sol (60,93, US$ 10), Grok 4.6 (60,923, US$ 6) e Kimi K3 da MoonshotAI (59,699, US$ 15).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Grok 4.660.96
Kimi K359.715
Entre os 557 modelos disponíveis no catálogo nesta data.

A distância entre o modelo mais barato acima de IQ 45 (DeepSeek V4 Flash 0731 a US$ 0,18/M) e o topo (Opus 5 a US$ 25/M) é de cerca de 138x. Essa razão não se comprimiu nesta semana — o que se comprimiu foi o meio do tabuleiro, onde a concorrência por especialização está mais agressiva.

O que fazer com isso

Se você está escolhendo modelo esta semana, três coisas importam.

Primeiro: se tradução entra no seu stack, teste o trio da Tencent. Três tamanhos, todos abaixo de US$ 0,30/M — dá para escolher entre qualidade e latência sem estourar orçamento.

Segundo: os 59 cortes de preço significam que o modelo que você escolheu três meses atrás pode estar 20-30% mais barato agora. Vale conferir no catálogo antes de renovar qualquer compromisso de volume.

Terceiro: apareceu um modelo stealth chamado "Ox Alpha" a US$ 0/M de saída. Sem IQ, sem criador. Pode ser experimento gratuito, pode ser placeholder. Não roteie produção por ele sem testar antes.

Em uma frase

Antes de renovar qualquer compromisso de volume, confira se o modelo que você usa não entrou na lista dos 59 cortes desta semana — e se tradução é parte do seu stack, o trio da Tencent abaixo de US$ 0,30/M merece um teste A/B.

Perguntas frequentes

Quais modelos de IA foram lançados entre 17 e 23 de agosto de 2026?

Oito modelos. Destaque para o trio de tradução da Tencent (Hy-MT2-7B, 30B-A3B e 1.8B), os dois da Z.ai (GLM 5.3 e GLM Latest), o DeepSeek V4 Flash Vision Exp e o Meta Muse Spark 1.2 Contributor. Fechou a lista o modelo stealth Ox Alpha, sem criador identificado.

Os preços de API de IA estão caindo?

Na última semana o catálogo registrou 110 mudanças de preço: 59 cortes contra 40 altas. O saldo de 19 mudanças a favor do consumidor segue o padrão das semanas anteriores — o piso do mercado continua descendo enquanto o topo segura.

Qual o modelo mais barato acima de IQ 45 hoje?

DeepSeek V4 Flash 0731, a US$ 0,18 por milhão de tokens de saída, com IQ 51,767. É 138 vezes mais barato que o líder do ranking, Claude Opus 5 (IQ 63,053 a US$ 25/M).

Leia também