Arquivo — 2026-01
59 reportagens neste mês.
140 modelos leem imagem. Só 2 valem o preço
O multimodal virou quase metade do catálogo em janeiro. O topo continua caro — e o meio do pacote esconde uma armadilha.
INTELLECT-3 a US$ 1,10 vs Nemotron Nano a US$ 0,20: quem vale o que
Dois modelos abertos americanos com 65 dias de diferença no catálogo, preços e tamanhos quase opostos — e o placar de inteligência não acompanha a conta.
Os 11 modelos MoE que seguram o topo e o preço baixo do catálogo
Mistura de especialistas responde por 3% dos modelos listados, mas abriga o IQ mais alto e a saída mais barata entre os cinco primeiros do ranking.
Mistral Large 3 2512 custa 9× mais que Nemotron Nano 9B V2 — vale a diferença?
Dois modelos open weights em pontas opostas do catálogo: um aposta em capacidade, o outro em velocidade por centavo.
Step 3.5 Flash entra pelo preço do topo, sem nota de IQ
StepFun traz foundation model open-source de 196B (11B ativos por token) a US$ 0,10/M de entrada — o mais barato entre modelos de 200k+ de contexto hoje.
Kimi K2.5 da MoonshotAI cobra US$ 2,25 por milhão de tokens de saída
Lançado há dois dias, o modelo multimodal de 262K de contexto não tem score de IQ publicado no catálogo — então a conta é o único número firme para decidir.
Solar Pro 3 chega barato, mas sem benchmark no catálogo
Modelo MoE da Upstage cobra US$ 0,60 por milhão de tokens de saída e não publica nota de inteligência. Para quem vale testar e para quem é melhor esperar.
Nemotron Nano é 60% mais barato e lê vídeo; Mistral pensa quase 2x melhor
A diferença entre os dois modelos abertos não é só preço nem só tamanho: é multimodalidade. Veja quando cada um vence.
Upstage Solar Pro 3 sai por US$ 0,60 por milhão, 13× abaixo do o3
MoE com 102 bilhões de parâmetros totais e 12 bilhões ativos por inferência. Sem índice de inteligência publicado.
Os 4 modelos chineses no catálogo custam menos de US$ 1,20 por milhão de saída
Xiaomi, Qwen e Baidu ocupam 1,2% do catálogo e entregam o modelo mais barato entre os top 5 de inteligência.
Quatro modelos chineses, um topo e uma conta muito mais barata
Xiaomi, Qwen e Baidu ocupam o recorte chinês do catálogo e entregam o melhor custo por inteligência — com pesos abertos e um detalhe que ninguém conta no release.
MiniMax M2-her custa R$ 1,76 por turno e ninguém testou a inteligência dele
Modelo de roleplay da MiniMax chega a US$ 1,20 por milhão de saída e US$ 0,03 de cache — mas sem nota de IQ, sem benchmark e sem país declarado.
Sete dias, sete modelos e zero corte de preço: o que ficou caro e o que ficou grátis
A semana fechou com lançamentos da Z.ai, OpenAI, LiquidAI, Writer e MiniMax — e nenhum ajuste de tabela. O fio condutor é a corrida pelo áudio e pelos modelos de borda.
Mistral Large 3 2512 cobra o dobro do Llama 3.3 70B e entrega 72% mais inteligência
Comparativo frente a frente entre dois pesos abertos com proposta parecida e faturas bem diferentes.
GPT Audio da OpenAI custa US$ 10 por milhão e só fala inglês bem
Modelo de áudio chega cinco dias depois do anúncio, com voz mais natural e preço dez vezes maior que o GPT-4o mini em texto.
GPT Audio Mini custa 70% menos que o o3 e ninguém sabe para que serve
Lançado há quatro dias, o modelo de voz mais barato da OpenAI não traz índice de inteligência nem benchmark de código — e é justamente aí que mora a dúvida.
GPT Audio Mini custa um quinto do irmão cheio — e ninguém mediu a inteligência dele
Quatro dias após o lançamento, o modelo de voz barato da OpenAI ainda não tem nota de IQ no catálogo. Para quem vale e para quem não muda nada.
GLM 4.7 Flash custa US$ 0,40/M de saída sem nota de QI
Modelo de 30B da Z.ai aposta em coding agentic com cache de US$ 0,01, mas o catálogo ainda não publicou benchmark de inteligência nem de código.
Mistral Large 3 cobra 5x mais que Llama 4 Scout na saída
Ambos são abertos, MoE e servidos por inferência própria — mas a conta no fim do mês diz quem é quem.
1,2B de parâmetros, grátis e offline: o que o LFM2.5-1.2B da LiquidAI realmente entrega
Lançado ontem, o modelo da LiquidAI cabe em edge devices e tem pesos abertos — mas o índice de inteligência 2.299 deixa claro que ele não está concorrendo com a nuvem.