Oito modelos novos e 59 cortes de preço em sete dias
Três da Tencent para tradução, dois da Z.ai, visão nova da DeepSeek — e o placar de preços seguiu favorável: 59 cortes contra 40 altas.
59 cortes contra 40 altas: o mercado segue apertando
O mercado de modelos de IA fechou a semana com sinal claro de compressão de preços. Em sete dias, o catálogo somou 110 mudanças — 59 cortes contra 40 altas. O saldo é negativo, e segue o padrão das últimas semanas. O piso continua descendo enquanto o topo segura.
Oito modelos novos em sete dias
A semana teve oito lançamentos. O detalhe que chama atenção não é a quantidade, é o perfil: especialização. Três vieram da Tencent focados em tradução, dois da Z.ai, um da DeepSeek adicionando visão ao Flash, um da Meta como variante "contributor", e um modelo stealth sem criador identificado.
| Data | Modelo | Criador | Inteligência | Saída US$/M |
|---|---|---|---|---|
| 2026-08-18 | GLM 5.3 | z-ai | 59.5 | 4.4 |
| 2026-08-19 | Hy-MT2-7B | tencent | — | 0.295 |
| 2026-08-19 | GLM Latest | ~z-ai | — | 3.432 |
| 2026-08-20 | Hy-MT2-30B-A3B | tencent | — | 0.295 |
| 2026-08-20 | Hy-MT2-1.8B | tencent | — | 0.177 |
| 2026-08-20 | Ox Alpha | stealth | — | 0 |
| 2026-08-21 | DeepSeek V4 Flash Vision Exp | deepseek | — | 1.32 |
| 2026-08-21 | Muse Spark 1.2 Contributor | meta | — | 0.2 |
Tencent: trio de tradução abaixo de US$ 0,30
A jogada mais concentrada da semana veio da Tencent. Em 19 e 20 de agosto, a empresa soltou três modelos da linha Hy-MT2: 7B, 30B-A3B (MoE) e 1.8B. Todos com preço de saída abaixo de US$ 0,30 por milhão de tokens — o 1.8B a US$ 0,177, os outros dois a US$ 0,295.
São modelos de tradução. Se você roda pipeline de localização ou chatbot multilíngue, é o tipo de especialização que importa: modelo feito para uma tarefa, precificado como commodity de infraestrutura. A lógica é simples — por que pagar US$ 5/M de um modelo generalista quando existe um específico por uma fração disso? A resposta depende da qualidade de tradução, claro, mas o preço convida ao teste A/B.
Z.ai e DeepSeek mexeram no meio do tabuleiro
A Z.ai não ficou atrás. Em 18 de agosto chegou o GLM 5.3, com IQ 59,513 e preço de US$ 4,40 por milhão. No dia seguinte, um alias chamado "GLM Latest" apareceu a US$ 3,50 — sem IQ publicado, e o catálogo é explícito quando o campo não foi preenchido em vez de chutar número.
A DeepSeek expandiu a linha Flash em 21 de agosto com o V4 Flash Vision Exp a US$ 0,66/M. O Flash 0731 base (ainda o modelo mais barato acima de IQ 45 no catálogo, a US$ 0,18/M) é só texto. A nova variante adiciona visão por 3,6 vezes o preço — ainda barato por qualquer métrica do mercado.
A Meta, por sua vez, colocou no ar o Muse Spark 1.2 Contributor a US$ 0,20/M. Sem IQ publicado. O nome "Contributor" sugere uma variante aberta para comunidade, mas sem mais dados no catálogo, fica a dúvida sobre o que diferencia do Muse Spark 1.2 base.
O topo não se mexeu
Enquanto a base ficou mais cheia e mais barata, o topo ficou parado. Claude Opus 5 segue na frente com IQ 63,053 (US$ 25/M), seguido de Claude Fable 5 (62,073, US$ 50), GPT-5.6 Sol (60,93, US$ 10), Grok 4.6 (60,923, US$ 6) e Kimi K3 da MoonshotAI (59,699, US$ 15).
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Grok 4.6 | 60.9 | 6 |
| Kimi K3 | 59.7 | 15 |
A distância entre o modelo mais barato acima de IQ 45 (DeepSeek V4 Flash 0731 a US$ 0,18/M) e o topo (Opus 5 a US$ 25/M) é de cerca de 138x. Essa razão não se comprimiu nesta semana — o que se comprimiu foi o meio do tabuleiro, onde a concorrência por especialização está mais agressiva.
O que fazer com isso
Se você está escolhendo modelo esta semana, três coisas importam.
Primeiro: se tradução entra no seu stack, teste o trio da Tencent. Três tamanhos, todos abaixo de US$ 0,30/M — dá para escolher entre qualidade e latência sem estourar orçamento.
Segundo: os 59 cortes de preço significam que o modelo que você escolheu três meses atrás pode estar 20-30% mais barato agora. Vale conferir no catálogo antes de renovar qualquer compromisso de volume.
Terceiro: apareceu um modelo stealth chamado "Ox Alpha" a US$ 0/M de saída. Sem IQ, sem criador. Pode ser experimento gratuito, pode ser placeholder. Não roteie produção por ele sem testar antes.
Antes de renovar qualquer compromisso de volume, confira se o modelo que você usa não entrou na lista dos 59 cortes desta semana — e se tradução é parte do seu stack, o trio da Tencent abaixo de US$ 0,30/M merece um teste A/B.
Perguntas frequentes
Quais modelos de IA foram lançados entre 17 e 23 de agosto de 2026?
Oito modelos. Destaque para o trio de tradução da Tencent (Hy-MT2-7B, 30B-A3B e 1.8B), os dois da Z.ai (GLM 5.3 e GLM Latest), o DeepSeek V4 Flash Vision Exp e o Meta Muse Spark 1.2 Contributor. Fechou a lista o modelo stealth Ox Alpha, sem criador identificado.
Os preços de API de IA estão caindo?
Na última semana o catálogo registrou 110 mudanças de preço: 59 cortes contra 40 altas. O saldo de 19 mudanças a favor do consumidor segue o padrão das semanas anteriores — o piso do mercado continua descendo enquanto o topo segura.
Qual o modelo mais barato acima de IQ 45 hoje?
DeepSeek V4 Flash 0731, a US$ 0,18 por milhão de tokens de saída, com IQ 51,767. É 138 vezes mais barato que o líder do ranking, Claude Opus 5 (IQ 63,053 a US$ 25/M).