quinta-feira, 3 de setembro 2026
7 reportagemsMuse Spark 1.3 da Meta entra a US$ 4,25/M de saída — preço já valendo
Modelo de 1M de contexto chega ao catálogo com tarifa entre Gemini Flash e Claude Fable; versão Contributor sai por US$ 0,20.
API fica mais instável: preços sobem 100%, modelos baratos avançam
DeepSeek registra reajustes e recuos bruscos, enquanto Gemini 3.8 Flash e alternativas de baixo custo mudam a conta de agentes em escala. A promessa de alta de até 1100% não aparece nos preços listados.
Fable 5.1 custa US$ 50 na saída e desafia a conta da API
A Anthropic estreia modelos com raciocínio adaptativo e desempenho forte em código. Mas a redução de cache de até 45% não está comprovada pelos preços listados no OpenRouter, enquanto o Opus 5 ainda exige cautela na comparação.
Qwen3 14B sobe 279,2%; Llama 3.3 70B cai 54,9%
Os preços listados no OpenRouter mudaram radicalmente em modelos médios e grandes. Enquanto o Qwen3 14B ficou quase quatro vezes mais caro, o Llama 3.3 70B ficou menos da metade do preço anterior.
1 milhão de tokens chega, mas o raciocínio ainda custa caro
Meta Muse Spark 1.3 e Google Gemini 3.8 Flash empatam no contexto, mas cobram preços e entregam níveis diferentes de inteligência, velocidade e desempenho agêntico.
Preços de APIs dobram enquanto novos benchmarks reordenam o mercado
DeepSeek e Google registram ajustes de até 100% no OpenRouter, enquanto Claude Fable 5.1 estreia no topo do índice de inteligência do Artificial Analysis. Para quem paga por volume, trocar de modelo sem recalcular a fatura ficou mais arriscado.
Pesos abertos encaram Claude, mas a conta separa GLM e Qwen
GLM 5.3 Flash combina pesos abertos, programação competitiva e API de US$ 0,25 por milhão de tokens de saída. Qwen3.8-Flash-Next aparece como opção ainda mais barata, mas os dados disponíveis não confirmam sua execução local.