FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

Cinco modelos mexeram no preço hoje; três ficaram mais baratos

Tencent Hy3, Kimi K2.7 Code e Trinity Large Thinking lideram os cortes do dia — e revelam quem está brigando por volume.

Redação FalaVIP IA 3 min de leitura
-19%no preço de saída do Tencent Hy3 preview
US$ 0,612por milhão de tokens de entrada no Kimi K2.7 Code
US$ 1,20por milhão de tokens de saída do MiniMax M3, o mais barato acima de IQ 45

O que mudou de preço hoje

Cinco modelos mexeram na tabela entre ontem e hoje. Três cortaram, dois só ajustaram decimais sem mexer no total — o tipo de mudança que ninguém nota no dashboard. A pergunta que importa é outra: quem está brigando por volume e quem está só polindo a vitrine.

O corte mais agressivo do dia veio de um modelo que pouca gente tinha no radar: Tencent Hy3 preview, que passou de US$ 0,26 para US$ 0,21 por milhão de tokens de saída — uma queda de 19% no output. O input também cedeu, de US$ 0,066 para US$ 0,063. É o tipo de movimento que costuma aparecer quando uma casa chinesa entra em modo de aquisição de usuários.

O segundo corte é o que mais pesa na fatura

MoonshotAI Kimi K2.7 Code recuou 12% no preço de saída, de US$ 3,50 para US$ 3,069 por milhão de tokens. No input, a queda foi de US$ 0,74 para US$ 0,612. Para quem roda esse modelo em volume — geração de código, agentes, pipelines longos —, a conta do fim do mês muda de verdade. É o corte mais relevante do dia em termos absolutos, porque o K2.7 Code é um modelo caro por design: serve para tarefas que outros mais baratos não dão conta.

Variação do preço de saída (%)
Hy3 preview-19Kimi K2.7 Code-12Trinity Large Thinking-6MoonshotAI Kimi Latest0Kimi K2.60%

E o que subiu?

Nenhum dos cinco movimentos foi alta. O único ajuste que pesa contra o bolso foi o Arcee AI Trinity Large Thinking, que subiu 14% no input (de US$ 0,22 para US$ 0,25) e cedeu 6% no output (de US$ 0,85 para US$ 0,80). É um movimento estranho — quem sobe input e baixa output geralmente está sinalizando que o modelo consome mais contexto do que produz, ou tentando recalibrar a percepção de valor.

Os outros dois movimentos do dia foram cosméticos: MoonshotAI Kimi Latest e Kimi K2.6 passaram de US$ 0,67 para US$ 0,66 no input, sem mexer no output. Arredondamento, não corte real.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
Hy3 preview0.260.21-19%
Kimi K2.7 Code3.53.069-12%
Trinity Large Thinking0.850.8-6%
MoonshotAI Kimi Latest3.53.50%
Kimi K2.63.53.50%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Para quem isso vale a pena

Se você já roda Kimi K2.7 Code em produção, vale revisar a integração hoje: 12% a menos no output é dinheiro que volta sem trocar uma linha de código. Se você estava olhando o Tencent Hy3 preview mas travou no preço, o novo número tira a objeção — desde que o modelo sirva para o que você precisa, o que é outra conversa.

Se você usa Trinity Large Thinking, a conta do input sobe. Não é o fim do mundo, mas é o tipo de mudança que some no relatório trimestral e aparece quando alguém pergunta por que o custo médio por chamada subiu.

Onde isso te deixa no tabuleiro

O catálogo hoje tem mais de 475 modelos ativos de 61 criadores. No topo por inteligência medida hoje, Claude Fable 5 lidera com IQ 62 a US$ 50 por milhão de tokens de saída — é o topo absoluto, mas não é o que essa notícia discute. A briga de preço acontece mais abaixo, na faixa dos modelos com IQ acima de 45, onde mora a maioria das aplicações reais.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Fable 562.150
GLM 5.252.63.036
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
Entre os 475 modelos disponíveis no catálogo nesta data.

Lá embaixo, MiniMax M3 segue como o mais barato acima de IQ 45: US$ 1,20 por milhão de tokens de saída. DeepSeek V4 Pro 0423 aparece logo depois, a US$ 1,74. E Z.ai GLM 5.2, que tem IQ 52,6 — acima de muita gente grande —, custa US$ 3,036. É o modelo que mais incomoda a concorrência na faixa intermediária: inteligência de topo de tabela chinesa, preço de modelo de meio de tabela.

O que fazer agora

Rode a consulta de billing do mês atual e separe o que é Kimi K2.7 Code e Tencent Hy3. Se houver volume ali, o ajuste já aconteceu sozinho. Se você está avaliando Trinity Large Thinking para um projeto novo, repense a conta de input — 14% a mais por chamada não é desprezível em agentes que carregam contexto grande.

E se você ainda não olhou o catálogo de modelos baratos acima de IQ 45, está na hora. A diferença entre o topo absoluto e o "bom o suficiente" nunca foi tão grande em dólares.

Em uma frase

Revise hoje o quanto você gasta com Kimi K2.7 Code e Tencent Hy3 — os cortes já valem sem trocar modelo; quem usa Trinity Large Thinking precisa recalcular o custo de input.

Perguntas frequentes

Quais modelos ficaram mais baratos em 20 de junho de 2026?

Três modelos cortaram preço: Tencent Hy3 preview (-19% no output), MoonshotAI Kimi K2.7 Code (-12% no output) e Arcee AI Trinity Large Thinking (-6% no output, mas +14% no input).

O preço do Kimi K2.7 Code mudou quanto?

O input caiu de US$ 0,74 para US$ 0,612 por milhão de tokens, e o output de US$ 3,50 para US$ 3,069. Em volume, é o corte mais relevante do dia em valor absoluto.

Qual é o modelo mais barato acima de IQ 45 hoje?

MiniMax M3, a US$ 1,20 por milhão de tokens de saída. DeepSeek V4 Pro 0423 aparece em segundo, a US$ 1,74, e Z.ai GLM 5.2, com IQ 52,6, a US$ 3,036.

Leia também