DeepSeek V4 Pro salta 283,5% e recua no mesmo dia
O modelo chegou a US$ 3,20 por milhão de tokens antes de cair para US$ 2,069. Inception Mercury 2.5 Preview e IBM Granite 4.2 8B estreiam com preços baixos e contexto longo.
Se você usa o DeepSeek V4 Pro em produção, a decisão de custo mudou — ainda que o susto tenha durado pouco. O preço listado no OpenRouter saiu de US$ 0,835 para US$ 3,20 por milhão de tokens, uma alta de 283,5%. Depois, recuou 35,4%, para US$ 2,069.
A sequência importa mais do que o preço final isolado. Um sistema que escolhe modelos automaticamente, sem acompanhar a tarifa efetivamente cobrada, pode ter passado por uma janela de custo muito mais alta no mesmo dia. O episódio também enfraquece a ideia de que um preço publicado para um modelo de API seja necessariamente estável.
DeepSeek teve alta, pico e recuo
Os preços praticados no OpenRouter mostram uma alteração em duas etapas para o DeepSeek V4 Pro 0423. Primeiro, o valor foi de US$ 0,835 para US$ 3,20 por milhão de tokens. Em seguida, caiu para US$ 2,069.
O resultado final ainda fica acima do valor inicial. A queda a partir do pico não devolveu o modelo à tarifa anterior. Para quem compara fornecedores apenas uma vez, o número que aparece agora pode esconder uma mudança relevante em relação ao custo que motivou a implantação.
A instabilidade não ficou restrita a ele. O Tencent Hy3 subiu de US$ 0,33 para US$ 0,528 e depois voltou a US$ 0,33. O Kimi K2.5 caiu de US$ 3 para US$ 2,25, enquanto o Llama 4 Maverick passou de US$ 0,80 para US$ 0,696. Também houve mudanças no DeepSeek V4 Flash e no Gemini 3.5 Flash.
Isso não significa que todos esses modelos estejam seguindo a mesma tendência. Significa que a fatura de uma aplicação pode mudar por decisões individuais de preço, e não apenas por uma troca de versão feita pelo desenvolvedor.
As estreias baratas ampliam o cardápio
O Inception Mercury 2.5 Preview entrou no catálogo em 31 de agosto com preço de US$ 0,04 por milhão de tokens de entrada e US$ 0,15 de saída. A janela de contexto é de 260.000 tokens.
O IBM Granite 4.2 8B estreou no mesmo dia. Custa US$ 0,10 por milhão de tokens de entrada e US$ 0,15 de saída, com contexto de 131.072 tokens.
A combinação é útil para quem precisa processar instruções longas sem pagar a tarifa de um modelo de ponta. O Mercury 2.5 Preview leva vantagem no preço de entrada e oferece uma janela de contexto maior entre os dois. O Granite 4.2 8B pode interessar a equipes que querem incluir uma opção da IBM no conjunto de modelos disponíveis, mas os dados não trazem notas de inteligência, código ou desempenho agêntico para nenhuma dessas estreias.
Preço baixo e contexto longo, portanto, não são sinônimos de qualidade comprovada. Eles descrevem uma oportunidade de custo e capacidade de entrada, não uma recomendação automática para tarefas críticas.
O topo continua caro
O índice Artificial Analysis coloca Claude Opus 5 com raciocínio adaptativo e esforço máximo no topo da inteligência, com nota 63,1 e preço de US$ 10 por milhão de tokens. O mesmo modelo aparece com esforço extra alto e nota 62,5, também a US$ 10.
Na sequência, Claude Fable 5 com fallback para Opus 4.8 marca 62,1 e custa US$ 20. GPT-5.6 Sol chega a 60,9 por US$ 8, enquanto Grok 4.6 alcança 60,9 por US$ 3.
A diferença ajuda a colocar o reajuste do DeepSeek em perspectiva. Mesmo a US$ 2,069, o V4 Pro não ocupa a faixa mais cara do catálogo entre os modelos destacados. Mas isso não elimina o problema operacional: um aumento de 283,5% muda o cálculo de aplicações de alto volume, mesmo quando o preço recua depois.
Para quem a mudança vale
A volatilidade do DeepSeek V4 Pro vale diretamente para você se a aplicação usa esse modelo em produção, mantém orçamento fixo ou escolhe rotas por preço. Também merece atenção se o sistema não registra a tarifa no momento de cada chamada.
O impacto é menor para quem usa apenas modelos locais, endpoints com preço contratado fora do OpenRouter ou workloads sem volume relevante. As estreias da Inception e da IBM, por outro lado, interessam a quem precisa de contexto longo e quer testar alternativas de entrada. Não há evidência nos dados de que elas substituam modelos avaliados em raciocínio, programação ou agentes.
O catálogo do OpenRouter reúne 565 modelos de 70 criadores. Com mais opções, a escolha deixa de ser apenas “qual modelo responde melhor?” e passa a incluir “qual tarifa estava ativa quando a chamada aconteceu?”.
A implicação prática é simples: trate preço de API como configuração monitorada, teste Mercury 2.5 Preview e Granite 4.2 8B em tarefas de baixo risco e mantenha um limite de custo antes de liberar o DeepSeek V4 Pro para tráfego sem controle.
Se você paga a API, monitore o preço em tempo real e use os novos modelos baratos como alternativas testáveis, não como substitutos automáticos.
Perguntas frequentes
Quanto custa o DeepSeek V4 Pro no OpenRouter?
Após o recuo registrado em 31 de agosto, o DeepSeek V4 Pro aparece a US$ 2,069 por milhão de tokens. No mesmo dia, o preço chegou a US$ 3,20, depois de sair de US$ 0,835.
Qual é o modelo mais barato entre as novas estreias?
O Inception Mercury 2.5 Preview custa US$ 0,04 por milhão de tokens de entrada e US$ 0,15 de saída. O IBM Granite 4.2 8B custa US$ 0,10 na entrada e US$ 0,15 na saída.
Qual é o contexto do Mercury 2.5 Preview?
O Inception Mercury 2.5 Preview tem janela de contexto de 260.000 tokens. O IBM Granite 4.2 8B, outra estreia do dia, oferece 131.072 tokens.