FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-01

59 reportagens neste mês.

Análise

140 modelos leem imagem. Só 2 valem o preço

O multimodal virou quase metade do catálogo em janeiro. O topo continua caro — e o meio do pacote esconde uma armadilha.

Análise

INTELLECT-3 a US$ 1,10 vs Nemotron Nano a US$ 0,20: quem vale o que

Dois modelos abertos americanos com 65 dias de diferença no catálogo, preços e tamanhos quase opostos — e o placar de inteligência não acompanha a conta.

Análise

Os 11 modelos MoE que seguram o topo e o preço baixo do catálogo

Mistura de especialistas responde por 3% dos modelos listados, mas abriga o IQ mais alto e a saída mais barata entre os cinco primeiros do ranking.

Análise

Mistral Large 3 2512 custa 9× mais que Nemotron Nano 9B V2 — vale a diferença?

Dois modelos open weights em pontas opostas do catálogo: um aposta em capacidade, o outro em velocidade por centavo.

Lançamentos

Step 3.5 Flash entra pelo preço do topo, sem nota de IQ

StepFun traz foundation model open-source de 196B (11B ativos por token) a US$ 0,10/M de entrada — o mais barato entre modelos de 200k+ de contexto hoje.

Análise

Kimi K2.5 da MoonshotAI cobra US$ 2,25 por milhão de tokens de saída

Lançado há dois dias, o modelo multimodal de 262K de contexto não tem score de IQ publicado no catálogo — então a conta é o único número firme para decidir.

Análise

Solar Pro 3 chega barato, mas sem benchmark no catálogo

Modelo MoE da Upstage cobra US$ 0,60 por milhão de tokens de saída e não publica nota de inteligência. Para quem vale testar e para quem é melhor esperar.

Análise

Nemotron Nano é 60% mais barato e lê vídeo; Mistral pensa quase 2x melhor

A diferença entre os dois modelos abertos não é só preço nem só tamanho: é multimodalidade. Veja quando cada um vence.

Lançamentos

Upstage Solar Pro 3 sai por US$ 0,60 por milhão, 13× abaixo do o3

MoE com 102 bilhões de parâmetros totais e 12 bilhões ativos por inferência. Sem índice de inteligência publicado.

Análise

Os 4 modelos chineses no catálogo custam menos de US$ 1,20 por milhão de saída

Xiaomi, Qwen e Baidu ocupam 1,2% do catálogo e entregam o modelo mais barato entre os top 5 de inteligência.

Análise

Quatro modelos chineses, um topo e uma conta muito mais barata

Xiaomi, Qwen e Baidu ocupam o recorte chinês do catálogo e entregam o melhor custo por inteligência — com pesos abertos e um detalhe que ninguém conta no release.

Análise

MiniMax M2-her custa R$ 1,76 por turno e ninguém testou a inteligência dele

Modelo de roleplay da MiniMax chega a US$ 1,20 por milhão de saída e US$ 0,03 de cache — mas sem nota de IQ, sem benchmark e sem país declarado.

Retrospectiva

Sete dias, sete modelos e zero corte de preço: o que ficou caro e o que ficou grátis

A semana fechou com lançamentos da Z.ai, OpenAI, LiquidAI, Writer e MiniMax — e nenhum ajuste de tabela. O fio condutor é a corrida pelo áudio e pelos modelos de borda.

Análise

Mistral Large 3 2512 cobra o dobro do Llama 3.3 70B e entrega 72% mais inteligência

Comparativo frente a frente entre dois pesos abertos com proposta parecida e faturas bem diferentes.

Análise

GPT Audio da OpenAI custa US$ 10 por milhão e só fala inglês bem

Modelo de áudio chega cinco dias depois do anúncio, com voz mais natural e preço dez vezes maior que o GPT-4o mini em texto.

Análise

GPT Audio Mini custa 70% menos que o o3 e ninguém sabe para que serve

Lançado há quatro dias, o modelo de voz mais barato da OpenAI não traz índice de inteligência nem benchmark de código — e é justamente aí que mora a dúvida.

Análise

GPT Audio Mini custa um quinto do irmão cheio — e ninguém mediu a inteligência dele

Quatro dias após o lançamento, o modelo de voz barato da OpenAI ainda não tem nota de IQ no catálogo. Para quem vale e para quem não muda nada.

Análise

GLM 4.7 Flash custa US$ 0,40/M de saída sem nota de QI

Modelo de 30B da Z.ai aposta em coding agentic com cache de US$ 0,01, mas o catálogo ainda não publicou benchmark de inteligência nem de código.

Análise

Mistral Large 3 cobra 5x mais que Llama 4 Scout na saída

Ambos são abertos, MoE e servidos por inferência própria — mas a conta no fim do mês diz quem é quem.

Análise

1,2B de parâmetros, grátis e offline: o que o LFM2.5-1.2B da LiquidAI realmente entrega

Lançado ontem, o modelo da LiquidAI cabe em edge devices e tem pesos abertos — mas o índice de inteligência 2.299 deixa claro que ele não está concorrendo com a nuvem.

página 1 de 3 próximas →