Mercury 2.5 chega a US$ 0,04; IBM amplia o catálogo barato
Inception e IBM adicionam opções de baixo custo, mas nenhum dos dois lançamentos tem nota de inteligência, código ou uso agêntico no Artificial Analysis.
Se você usa IA em produção, a diferença mais importante desta rodada está na entrada: o Mercury 2.5 Preview custa US$ 0,04 por milhão de tokens. A saída sai por US$ 0,15. O IBM Granite 4.2 8B custa US$ 0,10 na entrada e os mesmos US$ 0,15 na saída, segundo os preços listados no OpenRouter.
São duas opções para workloads em larga escala, mas o preço baixo não vem acompanhado de uma nota de qualidade que permita concluir qual entrega melhor resultado. O Artificial Analysis ainda não registra pontuações de inteligência, código ou uso agêntico para nenhum dos dois lançamentos.
Mercury mira o menor custo de entrada
O Mercury 2.5 Preview entrou no catálogo em 31 de agosto. Sua janela de contexto é de 260.000 tokens, de acordo com o OpenRouter. Isso o coloca acima de modelos pequenos com janelas mais restritas, mas abaixo de opções que chegam a 1.048.576 tokens no mesmo catálogo.
Na prática, o preço favorece aplicações que recebem grandes volumes de texto: classificação, extração, triagem, enriquecimento de dados e automações com muitas chamadas. Se o seu fluxo gera respostas longas, porém, a economia de entrada perde parte do impacto, porque cada milhão de tokens de saída custa US$ 0,15 — o mesmo valor cobrado pelo Granite 4.2 8B.
O rótulo “Preview” também importa para quem opera uma API crítica. O dado disponível informa o preço e o contexto, mas não oferece nota independente de desempenho nem parâmetros sobre estabilidade. Antes de trocar um modelo já validado, você precisa testar qualidade, latência e comportamento em falhas no seu próprio tráfego.
Granite 4.2 8B aposta no equilíbrio
O IBM Granite 4.2 8B chegou na mesma data do Mercury, com janela de contexto de 131.072 tokens. O nome indica um modelo de 8 bilhões de parâmetros, mas os dados disponíveis não trazem notas de inteligência, código ou tarefas agênticas para esta versão.
A diferença de entrada é pequena em termos absolutos: US$ 0,10 contra US$ 0,04 do Mercury. Para uma operação que processa muitos milhões de tokens, ela já pode aparecer na fatura. Para uma API com respostas extensas, no entanto, ambos têm o mesmo preço de saída, de US$ 0,15 por milhão de tokens.
Isso torna a escolha menos dependente do preço e mais dependente do comportamento do modelo. O Granite pode fazer sentido para quem prefere testar uma alternativa da família IBM e precisa de uma janela de 131.072 tokens. O Mercury é mais agressivo no custo de entrada e oferece uma janela maior, de 260.000 tokens.
O catálogo ficou maior, mas a conta ficou instável
Os lançamentos aparecem em um catálogo que soma 567 modelos de 70 criadores no OpenRouter. A movimentação, porém, não é apenas de modelos baratos. Em 1º de setembro, o MythoMax 13B aparece com uma alteração de US$ 0,06 para US$ 0,60 por milhão de tokens, além de outro registro no mesmo dia indicando o movimento inverso, de US$ 0,60 para US$ 0,06.
O DeepSeek V4 Pro 0423 também aparece com mudanças conflitantes: uma elevação de US$ 2,069 para US$ 3,20 e uma redução de US$ 3,20 para US$ 2,069 em registros diferentes. Para quem escolhe fornecedor por preço, isso é um alerta operacional. O valor observado no catálogo pode mudar — e os registros do próprio período nem sempre apontam para uma única direção.
Há reduções mais claras em modalidades batch. O Codestral 2508 caiu de US$ 0,90 para US$ 0,45 por milhão de tokens de entrada. O Ministral 3 8B 2512 caiu de US$ 0,15 para US$ 0,075, e o Mistral Large 3 2512 passou de US$ 1,50 para US$ 0,75.
Para quem os novos modelos valem
O Mercury 2.5 Preview vale a investigação se você prioriza custo de entrada, processa muito texto e consegue aceitar o risco de testar uma versão Preview. O Granite 4.2 8B interessa a quem busca uma opção de 8 bilhões de parâmetros, custo equilibrado entre entrada e saída e uma janela de 131.072 tokens.
Nenhum dos dois substitui automaticamente um modelo com desempenho comprovado. O Artificial Analysis lista, por exemplo, modelos de melhor custo-benefício com notas de inteligência: o Qwen3.8-Flash-Next tem índice 55,8 a US$ 0,23 por milhão de tokens, enquanto o GLM-5.3-Flash marca 57,5 a US$ 0,238. Essa comparação não inclui Mercury nem Granite, porque eles ainda não têm essas notas registradas.
Para quem já usa Claude 3.5 Haiku, Gemini 3.5 Flash Lite ou NVIDIA Nemotron 3.5 Lightning, os lançamentos não mudam a decisão sem um teste de qualidade. Esses modelos têm preços e, em alguns casos, métricas disponíveis; trocar apenas pelo anúncio de uma tarifa menor pode transferir o custo para retrabalho, revisão humana ou respostas recusadas.
A consequência prática é direta: coloque Mercury e Granite em uma rota de teste com volume controlado, acompanhe o custo separado de entrada e saída e só promova o vencedor depois de medir a qualidade no seu caso de uso.
Teste o Mercury para reduzir o custo de entrada e o Granite para ampliar as opções, mas não altere a produção sem métricas próprias.
Perguntas frequentes
Quanto custa o Mercury 2.5 Preview no OpenRouter?
O Mercury 2.5 Preview custa US$ 0,04 por milhão de tokens de entrada e US$ 0,15 por milhão de tokens de saída. A janela de contexto é de 260.000 tokens.
Qual é a janela de contexto do IBM Granite 4.2 8B?
O IBM Granite 4.2 8B tem janela de contexto de 131.072 tokens. No OpenRouter, custa US$ 0,10 por milhão de tokens de entrada e US$ 0,15 por milhão de tokens de saída.
Mercury 2.5 e Granite 4.2 8B têm nota no Artificial Analysis?
Ainda não há nota de inteligência, código ou uso agêntico registrada para esses dois lançamentos no Artificial Analysis. Portanto, os preços não permitem concluir qual modelo entrega melhor qualidade.