FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

746 reportagens desde setembro de 2025.

Preços

Meta corta 20% no Muse Glimmer; DeepSeek Pro cai 17,6%

Os preços listados no OpenRouter recuaram para modelos usados em cargas intensivas, mas a janela de dois dias também trouxe aumentos de até 100%. A economia depende do modelo escolhido e da divisão entre entrada e saída.

Preços

Hy3 sobe 60%, enquanto Nemotron 3.5 Lightning fica 20% mais barato

A Tencent encarece o Hy3 no OpenRouter, enquanto a NVIDIA reduz o preço do Nemotron 3.5 Lightning. Se você usa uma dessas opções em produção, a revisão de custo-benefício deixou de ser opcional.

Preços

Gemini Flash dobra para US$ 3,75 e lidera alta nas APIs

O Gemini 3.7 Flash e o Gemini Flash Latest tiveram aumento de 100% no preço de saída. DeepSeek, Meta e NVIDIA reduziram tarifas, mas o alívio não compensa o impacto para aplicações de alta volumetria.

Análise

Qwen 3.8 Flash custa US$ 0,23 e pressiona modelos caros

O modelo aparece entre as melhores relações custo-benefício, mas os dados disponíveis não confirmam todos os detalhes da promessa de economia em animação e código.

Análise

Robótica da Anthropic: os dados não mostram lançamento em 29 de agosto

A pauta fala em MCP para robôs e pesquisa automatizada, mas o retrato de preços e benchmarks não registra lançamento nem protocolo novo da Anthropic. Para quem paga API, a única evidência concreta é o desempenho e o custo do Claude Opus 5.

Lançamentos

Tencent Hy4 preview chega com 1 milhão de tokens por US$ 2,501

O modelo estreia com contexto de 1.048.576 tokens e preço intermediário: custa mais que opções Flash, mas menos que modelos premium de contexto semelhante.

Preços

DeepSeek V4 Pro cai 41,2%, mas Tencent e Qwen confundem a conta

O preço do DeepSeek V4 Pro 0813 recuou para US$ 1,98 por milhão de tokens. Na mesma data, registros conflitantes para Tencent Hy3 e Qwen3.6 dificultam prever o impacto no orçamento.

Preços

GLM 5.3 Flash cai a US$ 0,25, mas Qwen não exibe tarifa

O GLM 5.3 Flash combina janela de contexto de 1.310.720 tokens com preço de entrada de US$ 0,075 por milhão. Já o Qwen3.8-Flash-Next aparece bem avaliado no Artificial Analysis, mas sem tarifa operacional correspondente no OpenRouter.

Benchmarks

GLM-5.3-Flash estreia com 57,4 de IQ custando 105x menos que o topo

Seis modelos entraram no índice da Artificial Analysis hoje. O destaque é da Z.ai, que colocou um flash quase no top 5 por menos de um quarto de dólar por milhão de tokens de saída.

Preços

OpenRouter registra quedas de até 38,9% e oscilações na conta

O Nemotron 3 Ultra ficou mais barato, enquanto modelos da Tencent, Qwen e DeepSeek mudaram de preço no mesmo dia. Para quem roda alto volume, a diferença entre uma escolha e outra pode pesar mais que o nome do modelo.

Lançamentos

Ling 3.0 Flash Fin chega grátis e focado em finanças: o que sobra na sua fatura

Modelo da InclusionAI é uma variante MoE de 124B parâmetros com 5,1B ativos, voltada para investimento — e não tem preço publicado porque não cobra.

Análise

Chip próprio e Macs não mudam a conta sem preço de inferência

A disputa por hardware local e chips dedicados ainda não aparece nos preços observados. Para quem paga API, a mudança concreta está nos lançamentos baratos e nos reajustes do OpenRouter.

Preços

Llama sobe 121,9% e DeepSeek V4 Pro encarece 51,9%

Os preços listados no OpenRouter mostram reajustes capazes de alterar a fatura de aplicações em produção. Tencent e alguns modelos Qwen ficaram mais baratos, enquanto três modelos estrearam com janelas de contexto acima de 1 milhão de tokens.

Lançamentos

Google lança Gemini 3.5 Transcribe enquanto Qwen e Z.ai estreiam modelos flash de entrada

Novas opções especializadas em transcrição e modelos flash com contexto milionário ampliam o leque de alternativas econômicas para processamento de alta volumetria no OpenRouter.

Mercado

Jalapeño promete eficiência, mas DeepSeek muda preços até 112,8%

A OpenAI apresenta o chip Jalapeño como aposta para acelerar e baratear a inferência, mas os dados do OpenRouter mostram um cenário mais imediato: preços da DeepSeek subindo e caindo no mesmo dia.

Análise

Agentes multi modelo crescem, mas a conta ainda muda de direção

O ecossistema de desenvolvimento já reúne 557 modelos e 70 criadores no OpenRouter. Para quem usa agentes em produção, a disputa não está apenas no modelo escolhido, mas no roteamento, no preço e na estabilidade da API.

Mercado

Perplexity anuncia computador local, mas os dados confirmam só o Qwen 3.8

A promessa de hardware com inferência local ainda não aparece como lançamento confirmado. O que já aparece é o Qwen3.8 27B, com preços diferentes conforme a referência.

Preços

DeepSeek reprecifica V4 inteira: Pro sobe 51% e Flash 0731 despenca 71%

Flash 0731 fechou o dia com corte de 71% na saída, mas V4 Pro subiu 51% — e o saldo líquido do catálogo aponta para alta.

Benchmarks

DeepSeek V4 Flash Vision estreia a US$ 0,66 e empurra o índice de inteligência

Qwen3.8 27B entra junto, mas fica longe do pelotão intermediário. Enquanto isso, Claude Opus 5 segue no topo a US$ 25 por milhão de tokens.

Preços

OpenRouter eleva preços de Kimi, DeepSeek e Qwen em até 75,4%

O Kimi K2.6 passou a custar US$ 4 por milhão de tokens de saída. Mas a mesma lista também registra quedas, inclusive no DeepSeek V4 Flash 0731.

← anteriores página 2 de 38 próximas →