Arquivo
746 reportagens desde setembro de 2025.
Meta corta 20% no Muse Glimmer; DeepSeek Pro cai 17,6%
Os preços listados no OpenRouter recuaram para modelos usados em cargas intensivas, mas a janela de dois dias também trouxe aumentos de até 100%. A economia depende do modelo escolhido e da divisão entre entrada e saída.
Hy3 sobe 60%, enquanto Nemotron 3.5 Lightning fica 20% mais barato
A Tencent encarece o Hy3 no OpenRouter, enquanto a NVIDIA reduz o preço do Nemotron 3.5 Lightning. Se você usa uma dessas opções em produção, a revisão de custo-benefício deixou de ser opcional.
Gemini Flash dobra para US$ 3,75 e lidera alta nas APIs
O Gemini 3.7 Flash e o Gemini Flash Latest tiveram aumento de 100% no preço de saída. DeepSeek, Meta e NVIDIA reduziram tarifas, mas o alívio não compensa o impacto para aplicações de alta volumetria.
Qwen 3.8 Flash custa US$ 0,23 e pressiona modelos caros
O modelo aparece entre as melhores relações custo-benefício, mas os dados disponíveis não confirmam todos os detalhes da promessa de economia em animação e código.
Robótica da Anthropic: os dados não mostram lançamento em 29 de agosto
A pauta fala em MCP para robôs e pesquisa automatizada, mas o retrato de preços e benchmarks não registra lançamento nem protocolo novo da Anthropic. Para quem paga API, a única evidência concreta é o desempenho e o custo do Claude Opus 5.
Tencent Hy4 preview chega com 1 milhão de tokens por US$ 2,501
O modelo estreia com contexto de 1.048.576 tokens e preço intermediário: custa mais que opções Flash, mas menos que modelos premium de contexto semelhante.
DeepSeek V4 Pro cai 41,2%, mas Tencent e Qwen confundem a conta
O preço do DeepSeek V4 Pro 0813 recuou para US$ 1,98 por milhão de tokens. Na mesma data, registros conflitantes para Tencent Hy3 e Qwen3.6 dificultam prever o impacto no orçamento.
GLM 5.3 Flash cai a US$ 0,25, mas Qwen não exibe tarifa
O GLM 5.3 Flash combina janela de contexto de 1.310.720 tokens com preço de entrada de US$ 0,075 por milhão. Já o Qwen3.8-Flash-Next aparece bem avaliado no Artificial Analysis, mas sem tarifa operacional correspondente no OpenRouter.
GLM-5.3-Flash estreia com 57,4 de IQ custando 105x menos que o topo
Seis modelos entraram no índice da Artificial Analysis hoje. O destaque é da Z.ai, que colocou um flash quase no top 5 por menos de um quarto de dólar por milhão de tokens de saída.
OpenRouter registra quedas de até 38,9% e oscilações na conta
O Nemotron 3 Ultra ficou mais barato, enquanto modelos da Tencent, Qwen e DeepSeek mudaram de preço no mesmo dia. Para quem roda alto volume, a diferença entre uma escolha e outra pode pesar mais que o nome do modelo.
Ling 3.0 Flash Fin chega grátis e focado em finanças: o que sobra na sua fatura
Modelo da InclusionAI é uma variante MoE de 124B parâmetros com 5,1B ativos, voltada para investimento — e não tem preço publicado porque não cobra.
Chip próprio e Macs não mudam a conta sem preço de inferência
A disputa por hardware local e chips dedicados ainda não aparece nos preços observados. Para quem paga API, a mudança concreta está nos lançamentos baratos e nos reajustes do OpenRouter.
Llama sobe 121,9% e DeepSeek V4 Pro encarece 51,9%
Os preços listados no OpenRouter mostram reajustes capazes de alterar a fatura de aplicações em produção. Tencent e alguns modelos Qwen ficaram mais baratos, enquanto três modelos estrearam com janelas de contexto acima de 1 milhão de tokens.
Google lança Gemini 3.5 Transcribe enquanto Qwen e Z.ai estreiam modelos flash de entrada
Novas opções especializadas em transcrição e modelos flash com contexto milionário ampliam o leque de alternativas econômicas para processamento de alta volumetria no OpenRouter.
Jalapeño promete eficiência, mas DeepSeek muda preços até 112,8%
A OpenAI apresenta o chip Jalapeño como aposta para acelerar e baratear a inferência, mas os dados do OpenRouter mostram um cenário mais imediato: preços da DeepSeek subindo e caindo no mesmo dia.
Agentes multi modelo crescem, mas a conta ainda muda de direção
O ecossistema de desenvolvimento já reúne 557 modelos e 70 criadores no OpenRouter. Para quem usa agentes em produção, a disputa não está apenas no modelo escolhido, mas no roteamento, no preço e na estabilidade da API.
Perplexity anuncia computador local, mas os dados confirmam só o Qwen 3.8
A promessa de hardware com inferência local ainda não aparece como lançamento confirmado. O que já aparece é o Qwen3.8 27B, com preços diferentes conforme a referência.
DeepSeek reprecifica V4 inteira: Pro sobe 51% e Flash 0731 despenca 71%
Flash 0731 fechou o dia com corte de 71% na saída, mas V4 Pro subiu 51% — e o saldo líquido do catálogo aponta para alta.
DeepSeek V4 Flash Vision estreia a US$ 0,66 e empurra o índice de inteligência
Qwen3.8 27B entra junto, mas fica longe do pelotão intermediário. Enquanto isso, Claude Opus 5 segue no topo a US$ 25 por milhão de tokens.
OpenRouter eleva preços de Kimi, DeepSeek e Qwen em até 75,4%
O Kimi K2.6 passou a custar US$ 4 por milhão de tokens de saída. Mas a mesma lista também registra quedas, inclusive no DeepSeek V4 Flash 0731.