Arquivo — 2026-08
96 reportagens neste mês.
DeepSeek V4 Pro salta 283,5% e recua no mesmo dia
O modelo chegou a US$ 3,20 por milhão de tokens antes de cair para US$ 2,069. Inception Mercury 2.5 Preview e IBM Granite 4.2 8B estreiam com preços baixos e contexto longo.
Kimi K2.5 cai 25%, mas DeepSeek V4 Pro encarece
O OpenRouter registra cortes para Kimi K2.5 e Llama 4 Maverick, enquanto o Apodex 1.1 estreia no índice com IQ 44. O movimento do DeepSeek mostra que o preço do dia pode esconder uma sequência instável.
Hy3 sobe 60%, enquanto Nemotron 3.5 Lightning fica 20% mais barato
A Tencent encarece o Hy3 no OpenRouter, enquanto a NVIDIA reduz o preço do Nemotron 3.5 Lightning. Se você usa uma dessas opções em produção, a revisão de custo-benefício deixou de ser opcional.
Gemini 3.7 Flash e DeepSeek V4 Flash dobram de preço
No OpenRouter, o Gemini 3.7 Flash passou de US$ 1,875 para US$ 3,75 por milhão de tokens. A alta do DeepSeek vale para a versão 0731, enquanto outra versão do V4 Flash ficou mais barata.
Meta corta 20% no Muse Glimmer; DeepSeek Pro cai 17,6%
Os preços listados no OpenRouter recuaram para modelos usados em cargas intensivas, mas a janela de dois dias também trouxe aumentos de até 100%. A economia depende do modelo escolhido e da divisão entre entrada e saída.
Gemini Flash dobra para US$ 3,75 e lidera alta nas APIs
O Gemini 3.7 Flash e o Gemini Flash Latest tiveram aumento de 100% no preço de saída. DeepSeek, Meta e NVIDIA reduziram tarifas, mas o alívio não compensa o impacto para aplicações de alta volumetria.
Robótica da Anthropic: os dados não mostram lançamento em 29 de agosto
A pauta fala em MCP para robôs e pesquisa automatizada, mas o retrato de preços e benchmarks não registra lançamento nem protocolo novo da Anthropic. Para quem paga API, a única evidência concreta é o desempenho e o custo do Claude Opus 5.
Qwen 3.8 Flash custa US$ 0,23 e pressiona modelos caros
O modelo aparece entre as melhores relações custo-benefício, mas os dados disponíveis não confirmam todos os detalhes da promessa de economia em animação e código.
DeepSeek V4 Pro cai 41,2%, mas Tencent e Qwen confundem a conta
O preço do DeepSeek V4 Pro 0813 recuou para US$ 1,98 por milhão de tokens. Na mesma data, registros conflitantes para Tencent Hy3 e Qwen3.6 dificultam prever o impacto no orçamento.
Tencent Hy4 preview chega com 1 milhão de tokens por US$ 2,501
O modelo estreia com contexto de 1.048.576 tokens e preço intermediário: custa mais que opções Flash, mas menos que modelos premium de contexto semelhante.
GLM 5.3 Flash cai a US$ 0,25, mas Qwen não exibe tarifa
O GLM 5.3 Flash combina janela de contexto de 1.310.720 tokens com preço de entrada de US$ 0,075 por milhão. Já o Qwen3.8-Flash-Next aparece bem avaliado no Artificial Analysis, mas sem tarifa operacional correspondente no OpenRouter.
OpenRouter registra quedas de até 38,9% e oscilações na conta
O Nemotron 3 Ultra ficou mais barato, enquanto modelos da Tencent, Qwen e DeepSeek mudaram de preço no mesmo dia. Para quem roda alto volume, a diferença entre uma escolha e outra pode pesar mais que o nome do modelo.
GLM-5.3-Flash estreia com 57,4 de IQ custando 105x menos que o topo
Seis modelos entraram no índice da Artificial Analysis hoje. O destaque é da Z.ai, que colocou um flash quase no top 5 por menos de um quarto de dólar por milhão de tokens de saída.
Ling 3.0 Flash Fin chega grátis e focado em finanças: o que sobra na sua fatura
Modelo da InclusionAI é uma variante MoE de 124B parâmetros com 5,1B ativos, voltada para investimento — e não tem preço publicado porque não cobra.
Llama sobe 121,9% e DeepSeek V4 Pro encarece 51,9%
Os preços listados no OpenRouter mostram reajustes capazes de alterar a fatura de aplicações em produção. Tencent e alguns modelos Qwen ficaram mais baratos, enquanto três modelos estrearam com janelas de contexto acima de 1 milhão de tokens.
Chip próprio e Macs não mudam a conta sem preço de inferência
A disputa por hardware local e chips dedicados ainda não aparece nos preços observados. Para quem paga API, a mudança concreta está nos lançamentos baratos e nos reajustes do OpenRouter.
Google lança Gemini 3.5 Transcribe enquanto Qwen e Z.ai estreiam modelos flash de entrada
Novas opções especializadas em transcrição e modelos flash com contexto milionário ampliam o leque de alternativas econômicas para processamento de alta volumetria no OpenRouter.
Jalapeño promete eficiência, mas DeepSeek muda preços até 112,8%
A OpenAI apresenta o chip Jalapeño como aposta para acelerar e baratear a inferência, mas os dados do OpenRouter mostram um cenário mais imediato: preços da DeepSeek subindo e caindo no mesmo dia.
Perplexity anuncia computador local, mas os dados confirmam só o Qwen 3.8
A promessa de hardware com inferência local ainda não aparece como lançamento confirmado. O que já aparece é o Qwen3.8 27B, com preços diferentes conforme a referência.
Agentes multi modelo crescem, mas a conta ainda muda de direção
O ecossistema de desenvolvimento já reúne 557 modelos e 70 criadores no OpenRouter. Para quem usa agentes em produção, a disputa não está apenas no modelo escolhido, mas no roteamento, no preço e na estabilidade da API.