FalaVIP IA quinta-feira, 03 de setembro de 2026
Preços

DeepSeek V4 Pro sobe 283%, enquanto Mistral corta batch pela metade

O catálogo do OpenRouter registrou aumentos bruscos no DeepSeek V4 Pro e reduções de 50% em três serviços batch da Mistral. Para quem usa roteamento automático, a mudança exige revisar preços e fallback.

Redação FalaVIP IA 3 min de leitura
283,5%aumento listado para o DeepSeek V4 Pro 0423
US$ 3,346preço listado por milhão de tokens do DeepSeek V4 Pro 0813 antes da redução
50%corte nos preços batch de três modelos da Mistral

Se você usa o DeepSeek V4 Pro em produção, a referência de preço mudou de forma agressiva: uma das entradas do modelo saltou de US$ 0,835 para US$ 3,2 por milhão de tokens, alta listada de 283,5% no OpenRouter. Em outra variante, o DeepSeek V4 Pro 0813 chegou a US$ 3,346 por milhão antes de cair para US$ 1,98.

A virada é importante porque a conta não acompanhou uma mudança de benchmark apresentada nos dados disponíveis. O que aparece é uma sequência de alterações de preço em uma janela de dois dias, não uma evidência de que o modelo ficou mais inteligente ou mais rápido.

DeepSeek teve alta — e depois recuou

O caso mais extremo é o DeepSeek V4 Pro 0423. Em 31 de agosto, o preço listado passou de US$ 0,835 para US$ 3,2 por milhão de tokens, variação de 283,5%. Em 1º de setembro, o catálogo também registra uma mudança de US$ 2,069 para US$ 3,2, alta de 54,7%, e outra de US$ 3,2 para US$ 2,069, queda de 35,4%.

A variante V4 Pro 0813 repete a instabilidade. Ela foi de US$ 1,98 para US$ 3,346, aumento de 69%, e depois aparece de US$ 3,346 para US$ 1,98, redução de 40,8%.

Na prática, não dá para tratar os US$ 3,2 ou US$ 3,346 como uma tarifa estável sem conferir a rota escolhida e o momento da chamada. O OpenRouter mostra snapshots diferentes para o mesmo identificador e para variantes próximas. Se o seu sistema escolhe provedores automaticamente, o orçamento pode variar mesmo sem alteração no código.

Mistral reduz batch em três modelos

A Mistral oferece o movimento oposto para tarefas assíncronas. O Codestral 2508 (batch) caiu de US$ 0,9 para US$ 0,45 por milhão de tokens. O Ministral 3 8B 2512 (batch) passou de US$ 0,15 para US$ 0,075. Já o Mistral Large 3 2512 (batch) foi de US$ 1,5 para US$ 0,75.

Nos três casos, o corte foi de 50%. Isso favorece pipelines em que a resposta não precisa ser imediata: classificação em lote, geração de conteúdo, processamento de documentos e tarefas de avaliação. O desconto, porém, não significa que as versões de atendimento em tempo real tenham ficado mais baratas. A alteração registrada é especificamente nos identificadores com :batch.

Para quem já usa batch e consegue adiar a execução, a redução pode mudar a escolha do modelo. Para quem depende de baixa latência, ela não muda automaticamente a fatura.

A competição ficou mais ampla

A movimentação não se limita a DeepSeek e Mistral. O catálogo do OpenRouter registrou quatro lançamentos e vinte mudanças de preço no período, reunindo 567 modelos de 70 criadores.

Entre as estreias, o Claude Fable 5.1 chegou com contexto de 1.000.000 de tokens e preço de US$ 10 por milhão na entrada e US$ 50 na saída. A versão batch custa US$ 5 na entrada e US$ 25 na saída. O Mercury 2.5 Preview apareceu a US$ 0,04 na entrada e US$ 0,15 na saída, com contexto de 260.000 tokens. O Granite 4.2 8B foi listado a US$ 0,1 na entrada e US$ 0,15 na saída, com contexto de 131.072 tokens.

Essas estreias não tornam o DeepSeek V4 Pro mais caro ou mais barato por si só. Elas apenas aumentam o número de alternativas para redistribuir carga e criar fallbacks.

O que os benchmarks dizem — e não dizem

O Artificial Analysis coloca o DeepSeek V4 Flash Vision, em uma configuração de raciocínio e esforço máximo, entre as opções de melhor custo-benefício, com índice de inteligência de 51,5 e preço de US$ 0,66 por milhão. Esse dado é da variante Flash Vision, não do V4 Pro que sofreu os aumentos.

O mesmo índice aponta o Qwen3.8-Flash-Next como opção de melhor custo-benefício, com índice de 55,8 e preço de US$ 0,23 por milhão, além do GLM-5.3-Flash, com índice de 57,5 e preço de US$ 0,238. Não há, nos dados disponíveis, uma nota de inteligência para o DeepSeek V4 Pro que justifique pagar mais pela alta registrada.

Isso vale para quem revisa uma arquitetura de produção: compare qualidade medida, latência e preço da variante exata. Não vale concluir que todo DeepSeek ficou caro — o V4 Flash, por exemplo, também teve alterações menores e chegou a aparecer a US$ 0,15 por milhão.

Se você não usa DeepSeek V4 Pro, não depende de batch da Mistral ou não roteia chamadas pelo OpenRouter, a mudança provavelmente não altera sua fatura. Para os demais, é hora de fixar a variante, registrar o preço efetivamente aplicado e testar um fallback antes da próxima escala de tráfego.

Em uma frase

Fixe a variante usada em produção e revise o fallback: o DeepSeek ficou volátil, enquanto o batch da Mistral ficou 50% mais barato.

Perguntas frequentes

Quanto subiu o preço do DeepSeek V4 Pro?

O DeepSeek V4 Pro 0423 aparece com alta de 283,5%, de US$ 0,835 para US$ 3,2 por milhão de tokens. A variante 0813 chegou a US$ 3,346 antes de aparecer novamente a US$ 1,98.

Quais modelos batch da Mistral ficaram mais baratos?

O Codestral 2508, o Ministral 3 8B 2512 e o Mistral Large 3 2512 tiveram cortes de 50%. Os preços passaram a US$ 0,45, US$ 0,075 e US$ 0,75 por milhão de tokens, respectivamente.

A alta do DeepSeek V4 Pro significa que ele ficou melhor?

Não há essa indicação nos dados. O Artificial Analysis não apresenta uma nota de inteligência para o V4 Pro nessa relação, então o aumento deve ser tratado como alteração de preço, não como prova de ganho de qualidade.

Leia também