FalaVIP IA o que os modelos custam,
medido todo dia

quinta-feira, 3 de setembro 2026

7 reportagems
Lançamentos

Muse Spark 1.3 da Meta entra a US$ 4,25/M de saída — preço já valendo

Modelo de 1M de contexto chega ao catálogo com tarifa entre Gemini Flash e Claude Fable; versão Contributor sai por US$ 0,20.

Preços

API fica mais instável: preços sobem 100%, modelos baratos avançam

DeepSeek registra reajustes e recuos bruscos, enquanto Gemini 3.8 Flash e alternativas de baixo custo mudam a conta de agentes em escala. A promessa de alta de até 1100% não aparece nos preços listados.

Preços

Fable 5.1 custa US$ 50 na saída e desafia a conta da API

A Anthropic estreia modelos com raciocínio adaptativo e desempenho forte em código. Mas a redução de cache de até 45% não está comprovada pelos preços listados no OpenRouter, enquanto o Opus 5 ainda exige cautela na comparação.

Preços

Qwen3 14B sobe 279,2%; Llama 3.3 70B cai 54,9%

Os preços listados no OpenRouter mudaram radicalmente em modelos médios e grandes. Enquanto o Qwen3 14B ficou quase quatro vezes mais caro, o Llama 3.3 70B ficou menos da metade do preço anterior.

Benchmarks

1 milhão de tokens chega, mas o raciocínio ainda custa caro

Meta Muse Spark 1.3 e Google Gemini 3.8 Flash empatam no contexto, mas cobram preços e entregam níveis diferentes de inteligência, velocidade e desempenho agêntico.

Mercado

Preços de APIs dobram enquanto novos benchmarks reordenam o mercado

DeepSeek e Google registram ajustes de até 100% no OpenRouter, enquanto Claude Fable 5.1 estreia no topo do índice de inteligência do Artificial Analysis. Para quem paga por volume, trocar de modelo sem recalcular a fatura ficou mais arriscado.

Análise

Pesos abertos encaram Claude, mas a conta separa GLM e Qwen

GLM 5.3 Flash combina pesos abertos, programação competitiva e API de US$ 0,25 por milhão de tokens de saída. Qwen3.8-Flash-Next aparece como opção ainda mais barata, mas os dados disponíveis não confirmam sua execução local.