MythoMax 13B ficou 83% mais caro em um dia
Onze modelos mexeram no preço em 4 de agosto. Seis subiram, quatro caíram, e a direção do dia mostra que preço de LLM virou cotação, não atributo estável.
MythoMax 13B quase dobrou de preço em 24 horas
Se você roda MythoMax 13B em produção, abre o dashboard hoje com calma antes de continuar. O preço de saída saltou de US$ 0,06 para US$ 0,11 por milhão de tokens — alta de 83% em um único dia. O de entrada subiu mais modestamente, de US$ 0,06 para US$ 0,08. É o maior reajuste do dia, e cai num modelo que muita gente escolheu justamente por ser barato.
Esse é o tipo de mudança que não vem em release de empresa: ninguém manda email avisando "dobramos o preço do seu modelo favorito". O catálogo apenas registra o novo valor, e a fatura do mês que vem chega maior.
Subiu mais do que caiu
Em 4 de agosto, 11 modelos mexeram de preço. Seis ficaram mais caros, quatro ficaram mais baratos. É uma direção clara: o tabuleiro dos modelos open-weight e médio porte está apertando, não afrouxando.
O segundo reajuste mais agressivo foi no Qwen 3.5-122B-A10B, cujo preço de saída chegou a saltar de US$ 2,08 para US$ 3,20 por milhão de tokens (+54%). Horas depois, porém, o catálogo voltou a registrar US$ 2,08. A mesma linha aparece duas vezes na lista de mudanças — uma subindo, outra voltando — e o saldo final é neutro: hoje ele custa o mesmo que ontem. É o tipo de oscilação que só aparece para quem monitora preço todo dia.
Os cortes vieram — alguns com pegadinha
Nem todo corte é economia completa. O Qwen 2.5 VL 72B Instruct, multimodal da Qwen, derrubou o preço de entrada de US$ 0,80 para US$ 0,25 por milhão de tokens — queda de quase 69%. Só que o preço de saída mal se mexeu: foi de US$ 1,00 para US$ 0,75. Se seu produto lê muito e escreve pouco, a economia é grande. Se faz o contrário, a conta praticamente não muda.
| Modelo | Saída antes US$/M | Saída depois US$/M | Variação |
|---|---|---|---|
| MythoMax 13B | 0.06 | 0.11 | +83% |
| Qwen3.5-122B-A10B | 2.08 | 3.2 | +54% |
| Qwen3.5-122B-A10B | 3.2 | 2.08 | -35% |
| Kimi K2.6 | 3.41 | 2.48 | -27% |
| Qwen2.5 VL 72B Instruct | 1 | 0.75 | -25% |
| Mistral Small 3.2 24B | 0.2 | 0.25 | +25% |
| Llama 3.3 70B Instruct | 0.4 | 0.32 | -20% |
| GLM 5.2 | 1.9756 | 2.42 | +22% |
Já o Llama 3.3 70B Instruct, da Meta, teve corte nos dois: input foi de US$ 0,13 para US$ 0,10, e output de US$ 0,40 para US$ 0,32. Não é o corte do mês, mas multiplicado por volume paga um almoço.
Quem também entrou na conta
Do lado das altas, além do MythoMax:
- Mistral Small 3.2 24B: preço de saída foi de US$ 0,20 para US$ 0,25 (+25%).
- Z.ai GLM 5.2: preço de saída subiu de US$ 1,98 para US$ 2,42 (+22%); entrada, de US$ 0,63 para US$ 0,76.
E uma boa notícia isolada: o MoonshotAI Kimi K2.6 teve queda real no preço de saída, de US$ 3,41 para US$ 2,48 — economia de 27%, mesmo com a entrada praticamente estável. É o único corte com folga entre os modelos chineses do dia.
Em que isso mexe no seu setup
Se MythoMax 13B estava no seu pipeline, vale repensar hoje. O catálogo desta data tem mais de 529 modelos ativos, e os mais baratos entre os que passam de IQ 45 são DeepSeek V4 Flash 0731 (US$ 0,18/MM de saída), OpenAI GPT-5.6 Luna (US$ 1,20/MM) e MiniMax M3 (US$ 1,20/MM). Nenhum é substituição automática — cada um tem perfil de capacidade diferente — mas estão ali, na mesma prateleira de preço.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Claude Opus 5 | 63.1 | 25 |
| Claude Fable 5 | 62.1 | 50 |
| GPT-5.6 Sol | 60.9 | 10 |
| Kimi K3 | 59.7 | 15 |
| Qwen3.8 Max | 58.1 | 6 |
Se seu gargalo é multimodal barato, o corte do Qwen 2.5 VL 72B é uma janela a aproveitar enquanto esses números estiverem na tabela. E se você roda Kimi K2.6 com foco em inferência de saída, este é um dos raros dias recentes em que ele ficou mais barato.
O sinal por trás do ruído
Onze reajustes num único dia, com mais altas do que cortes, confirma uma verdade que o marketing não admite: preço de modelo não é atributo estável. É cotação. Quem fecha contrato de API hoje deveria planejar o custo da mesma forma que planeja custo de cloud — com folga para o próximo ajuste, porque o próximo ajuste vem.
Se MythoMax 13B estava no seu pipeline, migre pelo menos parte do tráfego para um substituto mais barato esta semana e passe a tratar custo de API como cotação: 11 mudanças em um único dia é o novo normal.
Perguntas frequentes
Por que MythoMax 13B ficou 83% mais caro de um dia para o outro?
O catálogo não publica a justificativa de cada reajuste, apenas o novo valor. O que sabemos é que entrada e saída foram elevadas no mesmo dia, o que indica reposicionamento do modelo e não ajuste isolado de tarifa. Criadores de modelos open-weight mexem em preço quando mudam o tier de hospedagem ou o mix de capacidade.
Qual modelo substitui o MythoMax 13B hoje?
Olhando só preço e capacidade acima de IQ 45, as opções mais em conta em 4 de agosto são DeepSeek V4 Flash 0731 (US$ 0,18/MM de saída, IQ 51,8), OpenAI GPT-5.6 Luna (US$ 1,20/MM, IQ 52,3) e MiniMax M3 (US$ 1,20/MM, IQ 45,4). Cada um tem perfil próprio — vale testar com seu workload antes de migrar tráfego de produção.
Preço de modelo de IA muda todo dia?
Não todo dia, mas com frequência alta. Em 4 de agosto de 2026, 11 modelos mexeram de preço — seis para cima, quatro para baixo. Tratar custo de API como cotação, e não como atributo estável, evita surpresa na fatura do fim do mês.