FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-08

96 reportagens neste mês.

Preços

DeepSeek V4 Pro salta 283,5% e recua no mesmo dia

O modelo chegou a US$ 3,20 por milhão de tokens antes de cair para US$ 2,069. Inception Mercury 2.5 Preview e IBM Granite 4.2 8B estreiam com preços baixos e contexto longo.

Preços

Kimi K2.5 cai 25%, mas DeepSeek V4 Pro encarece

O OpenRouter registra cortes para Kimi K2.5 e Llama 4 Maverick, enquanto o Apodex 1.1 estreia no índice com IQ 44. O movimento do DeepSeek mostra que o preço do dia pode esconder uma sequência instável.

Preços

Hy3 sobe 60%, enquanto Nemotron 3.5 Lightning fica 20% mais barato

A Tencent encarece o Hy3 no OpenRouter, enquanto a NVIDIA reduz o preço do Nemotron 3.5 Lightning. Se você usa uma dessas opções em produção, a revisão de custo-benefício deixou de ser opcional.

Preços

Gemini 3.7 Flash e DeepSeek V4 Flash dobram de preço

No OpenRouter, o Gemini 3.7 Flash passou de US$ 1,875 para US$ 3,75 por milhão de tokens. A alta do DeepSeek vale para a versão 0731, enquanto outra versão do V4 Flash ficou mais barata.

Preços

Meta corta 20% no Muse Glimmer; DeepSeek Pro cai 17,6%

Os preços listados no OpenRouter recuaram para modelos usados em cargas intensivas, mas a janela de dois dias também trouxe aumentos de até 100%. A economia depende do modelo escolhido e da divisão entre entrada e saída.

Preços

Gemini Flash dobra para US$ 3,75 e lidera alta nas APIs

O Gemini 3.7 Flash e o Gemini Flash Latest tiveram aumento de 100% no preço de saída. DeepSeek, Meta e NVIDIA reduziram tarifas, mas o alívio não compensa o impacto para aplicações de alta volumetria.

Análise

Robótica da Anthropic: os dados não mostram lançamento em 29 de agosto

A pauta fala em MCP para robôs e pesquisa automatizada, mas o retrato de preços e benchmarks não registra lançamento nem protocolo novo da Anthropic. Para quem paga API, a única evidência concreta é o desempenho e o custo do Claude Opus 5.

Análise

Qwen 3.8 Flash custa US$ 0,23 e pressiona modelos caros

O modelo aparece entre as melhores relações custo-benefício, mas os dados disponíveis não confirmam todos os detalhes da promessa de economia em animação e código.

Preços

DeepSeek V4 Pro cai 41,2%, mas Tencent e Qwen confundem a conta

O preço do DeepSeek V4 Pro 0813 recuou para US$ 1,98 por milhão de tokens. Na mesma data, registros conflitantes para Tencent Hy3 e Qwen3.6 dificultam prever o impacto no orçamento.

Lançamentos

Tencent Hy4 preview chega com 1 milhão de tokens por US$ 2,501

O modelo estreia com contexto de 1.048.576 tokens e preço intermediário: custa mais que opções Flash, mas menos que modelos premium de contexto semelhante.

Preços

GLM 5.3 Flash cai a US$ 0,25, mas Qwen não exibe tarifa

O GLM 5.3 Flash combina janela de contexto de 1.310.720 tokens com preço de entrada de US$ 0,075 por milhão. Já o Qwen3.8-Flash-Next aparece bem avaliado no Artificial Analysis, mas sem tarifa operacional correspondente no OpenRouter.

Preços

OpenRouter registra quedas de até 38,9% e oscilações na conta

O Nemotron 3 Ultra ficou mais barato, enquanto modelos da Tencent, Qwen e DeepSeek mudaram de preço no mesmo dia. Para quem roda alto volume, a diferença entre uma escolha e outra pode pesar mais que o nome do modelo.

Benchmarks

GLM-5.3-Flash estreia com 57,4 de IQ custando 105x menos que o topo

Seis modelos entraram no índice da Artificial Analysis hoje. O destaque é da Z.ai, que colocou um flash quase no top 5 por menos de um quarto de dólar por milhão de tokens de saída.

Lançamentos

Ling 3.0 Flash Fin chega grátis e focado em finanças: o que sobra na sua fatura

Modelo da InclusionAI é uma variante MoE de 124B parâmetros com 5,1B ativos, voltada para investimento — e não tem preço publicado porque não cobra.

Preços

Llama sobe 121,9% e DeepSeek V4 Pro encarece 51,9%

Os preços listados no OpenRouter mostram reajustes capazes de alterar a fatura de aplicações em produção. Tencent e alguns modelos Qwen ficaram mais baratos, enquanto três modelos estrearam com janelas de contexto acima de 1 milhão de tokens.

Análise

Chip próprio e Macs não mudam a conta sem preço de inferência

A disputa por hardware local e chips dedicados ainda não aparece nos preços observados. Para quem paga API, a mudança concreta está nos lançamentos baratos e nos reajustes do OpenRouter.

Lançamentos

Google lança Gemini 3.5 Transcribe enquanto Qwen e Z.ai estreiam modelos flash de entrada

Novas opções especializadas em transcrição e modelos flash com contexto milionário ampliam o leque de alternativas econômicas para processamento de alta volumetria no OpenRouter.

Mercado

Jalapeño promete eficiência, mas DeepSeek muda preços até 112,8%

A OpenAI apresenta o chip Jalapeño como aposta para acelerar e baratear a inferência, mas os dados do OpenRouter mostram um cenário mais imediato: preços da DeepSeek subindo e caindo no mesmo dia.

Mercado

Perplexity anuncia computador local, mas os dados confirmam só o Qwen 3.8

A promessa de hardware com inferência local ainda não aparece como lançamento confirmado. O que já aparece é o Qwen3.8 27B, com preços diferentes conforme a referência.

Análise

Agentes multi modelo crescem, mas a conta ainda muda de direção

O ecossistema de desenvolvimento já reúne 557 modelos e 70 criadores no OpenRouter. Para quem usa agentes em produção, a disputa não está apenas no modelo escolhido, mas no roteamento, no preço e na estabilidade da API.

página 1 de 5 próximas →