FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (20)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

749 reportagens desde setembro de 2025.

Análise

Kimi K2.5 da MoonshotAI cobra US$ 2,25 por milhão de tokens de saída

Lançado há dois dias, o modelo multimodal de 262K de contexto não tem score de IQ publicado no catálogo — então a conta é o único número firme para decidir.

Lançamentos

Step 3.5 Flash entra pelo preço do topo, sem nota de IQ

StepFun traz foundation model open-source de 196B (11B ativos por token) a US$ 0,10/M de entrada — o mais barato entre modelos de 200k+ de contexto hoje.

Análise

Solar Pro 3 chega barato, mas sem benchmark no catálogo

Modelo MoE da Upstage cobra US$ 0,60 por milhão de tokens de saída e não publica nota de inteligência. Para quem vale testar e para quem é melhor esperar.

Análise

Nemotron Nano é 60% mais barato e lê vídeo; Mistral pensa quase 2x melhor

A diferença entre os dois modelos abertos não é só preço nem só tamanho: é multimodalidade. Veja quando cada um vence.

Lançamentos

Upstage Solar Pro 3 sai por US$ 0,60 por milhão, 13× abaixo do o3

MoE com 102 bilhões de parâmetros totais e 12 bilhões ativos por inferência. Sem índice de inteligência publicado.

Análise

Os 4 modelos chineses no catálogo custam menos de US$ 1,20 por milhão de saída

Xiaomi, Qwen e Baidu ocupam 1,2% do catálogo e entregam o modelo mais barato entre os top 5 de inteligência.

Análise

Quatro modelos chineses, um topo e uma conta muito mais barata

Xiaomi, Qwen e Baidu ocupam o recorte chinês do catálogo e entregam o melhor custo por inteligência — com pesos abertos e um detalhe que ninguém conta no release.

Retrospectiva

Sete dias, sete modelos e zero corte de preço: o que ficou caro e o que ficou grátis

A semana fechou com lançamentos da Z.ai, OpenAI, LiquidAI, Writer e MiniMax — e nenhum ajuste de tabela. O fio condutor é a corrida pelo áudio e pelos modelos de borda.

Análise

MiniMax M2-her custa R$ 1,76 por turno e ninguém testou a inteligência dele

Modelo de roleplay da MiniMax chega a US$ 1,20 por milhão de saída e US$ 0,03 de cache — mas sem nota de IQ, sem benchmark e sem país declarado.

Análise

GPT Audio da OpenAI custa US$ 10 por milhão e só fala inglês bem

Modelo de áudio chega cinco dias depois do anúncio, com voz mais natural e preço dez vezes maior que o GPT-4o mini em texto.

Análise

Mistral Large 3 2512 cobra o dobro do Llama 3.3 70B e entrega 72% mais inteligência

Comparativo frente a frente entre dois pesos abertos com proposta parecida e faturas bem diferentes.

Análise

GPT Audio Mini custa um quinto do irmão cheio — e ninguém mediu a inteligência dele

Quatro dias após o lançamento, o modelo de voz barato da OpenAI ainda não tem nota de IQ no catálogo. Para quem vale e para quem não muda nada.

Análise

GPT Audio Mini custa 70% menos que o o3 e ninguém sabe para que serve

Lançado há quatro dias, o modelo de voz mais barato da OpenAI não traz índice de inteligência nem benchmark de código — e é justamente aí que mora a dúvida.

Análise

Mistral Large 3 cobra 5x mais que Llama 4 Scout na saída

Ambos são abertos, MoE e servidos por inferência própria — mas a conta no fim do mês diz quem é quem.

Análise

GLM 4.7 Flash custa US$ 0,40/M de saída sem nota de QI

Modelo de 30B da Z.ai aposta em coding agentic com cache de US$ 0,01, mas o catálogo ainda não publicou benchmark de inteligência nem de código.

Análise

1,2B de parâmetros e grátis: o que o LFM2.5 da LiquidAI resolve de verdade

Modelo de borda tem IQ 2,3 e fica longe do topo do catálogo. Faz sentido só se você roda IA no celular — não se paga API.

Análise

1,2B de parâmetros, grátis e offline: o que o LFM2.5-1.2B da LiquidAI realmente entrega

Lançado ontem, o modelo da LiquidAI cabe em edge devices e tem pesos abertos — mas o índice de inteligência 2.299 deixa claro que ele não está concorrendo com a nuvem.

Lançamentos

LiquidAI solta raciocínio grátis de 1,2B — roda no celular, mas fica em 2,3 de IQ

Modelo de 1,17 bilhão de parâmetros chega com preço zero, 32K de contexto e pesos abertos. O índice de inteligência, porém, está quase 15 vezes abaixo do topo do catálogo.

Análise

LFM2.5-1.2B-Thinking: o que um modelo de 1,2 bilhão de parâmetros resolve em 20 de janeiro

Grátis, open weights e pensado para rodar no edge — mas o índice de inteligência fica abaixo de vários rivais pequenos.

Lançamentos

GPT Audio da OpenAI entra em GA cobrando US$ 10 por milhão de saída

Primeiro modelo de áudio em disponibilidade geral da OpenAI traz decodificador reformulado. A versão Mini sai por um quarto do preço.

← anteriores página 24 de 38 próximas →