Arquivo — 2026-01
59 reportagens neste mês.
Mistral Large 3 2512 e INTELLECT-3 custam quase o mesmo e tiram quase a mesma nota
Dois modelos abertos com arquiteturas parecidas, preços parecidos e um IQ separados por 0,2 ponto — mas só um deles tem modo de raciocínio
Qwen3 Next Thinking cobra 8x mais no output que o Ministral 3 8B
Dois modelos open-weights disputam o meio de tabela: um emite traços de pensamento, o outro responde direto. O preço na fatura é menos óbvio do que parece.
MiMo-V2-Flash lidera catálogo inteiro e custa 26 vezes menos que o3
MoE assume o topo do ranking de inteligência do catálogo nesta data. A diferença de preço para os modelos densos é o que muda a conta em produção.
Qwen3 Next 80B Thinking custa 6× mais caro na saída que o Ministral 3 14B
Comparativo frente a frente entre dois modelos chineses e franceses de pesos abertos, e o que essa diferença de preço significa na fatura do final do mês.
Qwen3 Next 80B Thinking custa 6× mais caro que Nemotron 3 Nano e só ganha em raciocínio
Comparativo entre dois modelos MoE chineses e americanos que disputam o mesmo nicho: tarefas longas com reasoning, mas em faixas de preço e desempenho bem diferentes.
Quatro modelos chineses, um só topo de ranking e preço de centavos
Xiaomi, Qwen e Baidu ocupam o catálogo com pesos abertos e custo por token que nenhum americano consegue igualar hoje.
Qwen3 Next 80B e Mistral Large 3 2512: US$ 0,35 que separam a conta
Os dois têm 262K de contexto, IQ próximo de 16 e são open weights. Mas um cobra 82% a mais no blended — e cada um brilha num tipo de tarefa.
8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece
A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.
Olmo 3.1 32B Instruct custa US$ 0,60 por milhão de saída — e entrega menos inteligência que um modelo de 3B da Mistral
A AllenAI abriu o código de um 32B que perde, no índice de inteligência, para o Ministral 3B que cabe em qualquer GPU.
Olmo 3.1 32B chega aberto e barato — mas o QI é 6
AllenAI colocou no catálogo um modelo de 32B com pesos abertos e US$ 0,60 por milhão de tokens de saída. O índice de inteligência, porém, está em outro andar.
Nova 2 Lite custa 12× mais que Ministral 3 14B na saída
Amazon e Mistral lançaram modelos pequenos no mesmo dia, em dezembro; um deles cobra caro pelo token, o outro cobra barato pelo token — e a conta muda tudo.
12 modelos de raciocínio, um líder chinês e o3 custando 26 vezes mais
O recorte de reasoning do catálogo mostra Xiaomi na frente do índice de inteligência e OpenAI cobrando US$ 8 por milhão de tokens de saída no topo.
Amazon Nova 2 Lite cobra US$ 2,50 por milhão de saída; Nemotron 49B cobra US$ 0,40 e abre pesos
Dois modelos lançados no fim de 2025 disputam o mesmo nicho de raciocínio barato — mas só um entrega os pesos e só um entende imagem e vídeo.
Um milhão de tokens virou commodity: 38 modelos e o preço varia 40 vezes
Llama 4 Scout cobra US$ 0,10 por milhão de tokens de entrada. Nova Premier, US$ 12,50 de saída. A janela de contexto longa deixou de ser diferencial — o que você faz com ela é.
Nova 2 Lite custa o triplo do Qwen3 Next e entrega 40% mais IQ
Amazon aposta em multimodal e reasoning; Qwen responde com pesos abertos e 1M de tokens de cache barato. Cada um ganha num tipo de tarefa — e nenhum dos dois ganha em todas.
Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI
Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.
Nova 2 Lite custa quase o quádruplo do Maverick por saída de token
Amazon turbina o modelo de entrada e cobra caro pelo milagre; Meta segue barato e aberto, mas perde em inteligência.
Seed 1.6 Flash custa o mesmo que o topo do ranking — e ninguém mediu o QI dele
ByteDance joga na faixa dos US$ 0,30 por milhão de tokens de saída, igual ao MiMo da Xiaomi, mas sem benchmark público de inteligência para comparar.
Nova 2 Lite custa 12,5× mais que Nemotron Nano no token de saída
Amazon e NVIDIA lançaram modelos de raciocínio em dezembro. Um entrega multimodalidade e contexto gigante, o outro entrega preço quase dez vezes menor e pesos abertos.