FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

MythoMax 13B sobe 83% no preço de saída em um único dia

Onze modelos mexeram na tabela em 4 de agosto; enquanto roleplay paga a conta, visão economiza com corte de quase 70% no input do Qwen2.5 VL 72B.

Redação FalaVIP IA 3 min de leitura
US$ 0,11novo preço por milhão de tokens de saída do MythoMax 13B
+83%de aumento no output do MythoMax em um único dia
US$ 0,25novo preço de input do Qwen2.5 VL 72B (era US$ 0,80)

MythoMax 13B: +83% no output em um único dia

Você rodava roleplay ou agentes conversacionais no MythoMax 13B porque ele era um dos mais baratos do catálogo — US$ 0,06 por milhão de tokens de saída. Hoje, 4 de agosto de 2026, esse número foi para US$ 0,11. É um aumento de 83% no preço que mais pesa em cargas de chat, onde o modelo responde em volume.

Não é caso isolado. Em um único dia, onze modelos mexeram na tabela. A maioria subiu; uma parte cortou. E um deles ainda fez uma volta completa que merece ser contada.

Preços que mudaram no dia
ModeloSaída antes US$/MSaída depois US$/MVariação
MythoMax 13B0.060.11+83%
Qwen3.5-122B-A10B2.083.2+54%
Qwen3.5-122B-A10B3.22.08-35%
Kimi K2.63.412.48-27%
Qwen2.5 VL 72B Instruct10.75-25%
Mistral Small 3.2 24B0.20.25+25%
Llama 3.3 70B Instruct0.40.32-20%
GLM 5.21.97562.42+22%
Comparação entre duas capturas consecutivas do catálogo (2x/dia).

Quem cortou preço enquanto isso

Nem tudo é pesadelo. O corte mais agressivo do dia veio da Qwen2.5 VL 72B Instruct: input de US$ 0,80 para US$ 0,25 por milhão de tokens — quase 69% de desconto só no lado de mandar a imagem. Output também caiu de US$ 1,00 para US$ 0,75. Se seu pipeline passa o dia lendo PDFs, screenshots ou fotos, este é o nome para revisar agora.

Kimi K2.6, da MoonshotAI, reduziu o output de US$ 3,41 para US$ 2,48 — corte de 27% no lado mais caro da fatura — sem mexer quase nada no input (US$ 0,60 → US$ 0,589). Llama 3.3 70B Instruct ficou marginalmente mais barato: input de US$ 0,13 para US$ 0,10, output de US$ 0,40 para US$ 0,32. Nada que mude o jogo, mas é cortesia.

Do lado das altas: Mistral Small 3.2 24B subiu 25% no output (US$ 0,20 → US$ 0,25). Z.ai GLM 5.2 ficou 22% mais caro no output (US$ 1,98 → US$ 2,42). Nenhuma das duas é drástica isoladamente, mas ambas pegam modelos que entram em produção justamente por serem "baratos o suficiente". Acumulam.

A novela do Qwen 122B

Qwen3.5-122B-A10B protagonizou a mudança mais confusa do dia. Primeiro subiu: input de US$ 0,26 para US$ 0,40, output de US$ 2,08 para US$ 3,20. Horas depois, o catálogo voltou o preço ao valor original: input US$ 0,26, output US$ 2,08. O efeito líquido no seu bolso é zero, mas o vaivém sugere um ajuste interno que acabou registrado como duas mudanças separadas.

Se você recebeu dois alertas seguidos desse modelo hoje, ignore o primeiro.

Variação do preço de saída (%)
MythoMax 13B83Qwen3.5-122B-A10B54Qwen3.5-122B-A10B-35Kimi K2.6-27Qwen2.5 VL 72B Instruct-25Mistral Small 3.2 24B25Llama 3.3 70B Instruct-20GLM 5.222%

Para quem muda a conta — e para quem não muda

Muda para você se MythoMax 13B está no seu pipeline com volume alto de output, ou se migrou recentemente para Z.ai GLM 5.2 ou Mistral Small achando que tinha achado um bom negócio. Também muda para quem processa muitas imagens — o corte do Qwen2.5 VL é a melhor notícia do dia.

Não muda nada se você está no tier superior pagando Claude Opus 5 (US$ 25 por milhão de tokens de saída), ou se roda DeepSeek V4 Flash, que segue como o mais barato acima de IQ 45 a US$ 0,18 por milhão de output. Para esses, o ruído de hoje é estatístico.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Claude Opus 563.125
Claude Fable 562.150
GPT-5.6 Sol60.910
Kimi K359.715
Qwen3.8 Max58.16
Entre os 529 modelos disponíveis no catálogo nesta data.

O que fazer amanhã de manhã

Se MythoMax entrou no orçamento desta semana, vale rodar uma semana em substituto antes de absorver o aumento. Para visão, o Qwen2.5 VL 72B agora cobra um terço do que cobrava ontem — se seu caso é leitura de imagem, é hora de testar.

Para os modelos cortados (Qwen2.5 VL, Llama 3.3 70B, Kimi K2.6), o movimento costuma ser aproveitado para travar workloads antes do próximo reajuste. E se você viu duas notificações do Qwen 122B hoje, ignore a primeira — ela foi revertida no mesmo dia.

Em uma frase

Se MythoMax 13B está no seu pipeline com alto volume de output, migre antes de absorver o aumento de 83%; quem processa imagem em escala ganha a maior queda do dia com o Qwen2.5 VL 72B.

Perguntas frequentes

Por que MythoMax 13B ficou 83% mais caro em um dia?

O catálogo reajustou o preço de saída do modelo de US$ 0,06 para US$ 0,11 por milhão de tokens. Para cargas de chat com alto volume de output, isso muda a fatura sem mudar a experiência do usuário.

O Qwen2.5 VL 72B serve para qual caso de uso?

É um modelo de visão da Qwen, indicado para análise de imagens, PDFs e screenshots. O corte de hoje no input (US$ 0,80 → US$ 0,25) faz dele a opção mais barata para processar imagem em escala.

Qual o modelo mais barato acima de IQ 45 hoje?

DeepSeek V4 Flash, a US$ 0,18 por milhão de tokens de saída. É mais de 138 vezes mais barato que Claude Opus 5, que lidera o ranking de inteligência a US$ 25 por milhão de output.

Leia também