FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

746 reportagens desde setembro de 2025.

Análise

Pesos abertos encaram Claude, mas a conta separa GLM e Qwen

GLM 5.3 Flash combina pesos abertos, programação competitiva e API de US$ 0,25 por milhão de tokens de saída. Qwen3.8-Flash-Next aparece como opção ainda mais barata, mas os dados disponíveis não confirmam sua execução local.

Benchmarks

1 milhão de tokens chega, mas o raciocínio ainda custa caro

Meta Muse Spark 1.3 e Google Gemini 3.8 Flash empatam no contexto, mas cobram preços e entregam níveis diferentes de inteligência, velocidade e desempenho agêntico.

Preços

Qwen3 14B sobe 279,2%; Llama 3.3 70B cai 54,9%

Os preços listados no OpenRouter mudaram radicalmente em modelos médios e grandes. Enquanto o Qwen3 14B ficou quase quatro vezes mais caro, o Llama 3.3 70B ficou menos da metade do preço anterior.

Preços

Fable 5.1 custa US$ 50 na saída e desafia a conta da API

A Anthropic estreia modelos com raciocínio adaptativo e desempenho forte em código. Mas a redução de cache de até 45% não está comprovada pelos preços listados no OpenRouter, enquanto o Opus 5 ainda exige cautela na comparação.

Preços

API fica mais instável: preços sobem 100%, modelos baratos avançam

DeepSeek registra reajustes e recuos bruscos, enquanto Gemini 3.8 Flash e alternativas de baixo custo mudam a conta de agentes em escala. A promessa de alta de até 1100% não aparece nos preços listados.

Lançamentos

Muse Spark 1.3 da Meta entra a US$ 4,25/M de saída — preço já valendo

Modelo de 1M de contexto chega ao catálogo com tarifa entre Gemini Flash e Claude Fable; versão Contributor sai por US$ 0,20.

Preços

Claude Fable custa US$ 10 na entrada, mas saída chega a US$ 50

Anthropic lidera o índice de inteligência, enquanto o Muse Spark 1.3 abre uma faixa mais barata para agentes. A conta, porém, muda radicalmente conforme a quantidade de tokens gerados.

Lançamentos

Gemini 3.8 Flash custa US$ 0,75, mas não lidera

O novo modelo do Google combina janela de contexto de 1.048.576 tokens e preço de entrada baixo. Nos índices de inteligência, porém, fica atrás de opções mais caras e de alternativas econômicas.

Preços

MythoMax oscila 900% e DeepSeek remarca tarifas em dois dias

O MythoMax 13B aparece primeiro com aumento de 900% e depois com redesconto de 90%. Na DeepSeek, modelos populares também registram movimentos de alta e queda, exigindo revisão dos custos em produção.

Mercado

GPT-5.6 chega ao Bedrock na Austrália, mas a conta ainda é incógnita

A AWS anuncia acesso regional aos modelos da OpenAI com inferência cross-Region global. Para quem paga a API, o ganho de arquitetura é claro; o preço específico do Bedrock não aparece nos dados públicos disponíveis.

Preços

DeepSeek V3.1 cai 42%, mas Gemini 3.7 Flash batch dobra

Os preços por milhão de tokens mudaram em direções opostas no OpenRouter. Para quem usa esses modelos em produção, a revisão das estimativas de custo não pode esperar.

Preços

DeepSeek V4 Pro sobe 283%, enquanto Mistral corta batch pela metade

O catálogo do OpenRouter registrou aumentos bruscos no DeepSeek V4 Pro e reduções de 50% em três serviços batch da Mistral. Para quem usa roteamento automático, a mudança exige revisar preços e fallback.

Lançamentos

Mercury 2.5 chega a US$ 0,04; IBM amplia o catálogo barato

Inception e IBM adicionam opções de baixo custo, mas nenhum dos dois lançamentos tem nota de inteligência, código ou uso agêntico no Artificial Analysis.

Lançamentos

Claude Fable 5.1 chega com 1 milhão de tokens, mas saída custa US$ 50

O novo modelo da Anthropic mira programação e agentes com contexto massivo. A opção batch reduz a tarifa pela metade, mas não transforma o Fable 5.1 em uma alternativa barata para respostas longas.

Análise

Astra atinge risco crítico, mas não tem preço público na API

A OpenAI diz que seu novo modelo cruzou o limiar crítico de cibersegurança do Preparedness Framework. Para quem paga API, porém, a mudança mais concreta ainda é a ausência de preço, janela e endpoint do Astra nas listagens do OpenRouter.

Preços

Quasar 438B estreia a US$ 0,90 enquanto preços oscilam

O OpenRouter registrou 20 mudanças em um dia, incluindo alta de 900% no MythoMax 13B. O Quasar 438B apareceu no Artificial Analysis com índice de inteligência 43 e preço de US$ 0,90 por milhão de tokens.

Lançamentos

Claude Fable 5.1 chega a US$ 50 por milhão de saída e assume topo do catálogo

Anthropic lança a versão 5.1 com ganho em coding e workflows agênticos, mas o preço de saída dobra em relação ao Opus 5.

Preços

Kimi K2.5 cai 25%, mas DeepSeek V4 Pro encarece

O OpenRouter registra cortes para Kimi K2.5 e Llama 4 Maverick, enquanto o Apodex 1.1 estreia no índice com IQ 44. O movimento do DeepSeek mostra que o preço do dia pode esconder uma sequência instável.

Preços

DeepSeek V4 Pro salta 283,5% e recua no mesmo dia

O modelo chegou a US$ 3,20 por milhão de tokens antes de cair para US$ 2,069. Inception Mercury 2.5 Preview e IBM Granite 4.2 8B estreiam com preços baixos e contexto longo.

Preços

Gemini 3.7 Flash e DeepSeek V4 Flash dobram de preço

No OpenRouter, o Gemini 3.7 Flash passou de US$ 1,875 para US$ 3,75 por milhão de tokens. A alta do DeepSeek vale para a versão 0731, enquanto outra versão do V4 Flash ficou mais barata.

página 1 de 38 próximas →