FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (22)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-01

59 reportagens neste mês.

Análise

Mistral Large 3 2512 e INTELLECT-3 custam quase o mesmo e tiram quase a mesma nota

Dois modelos abertos com arquiteturas parecidas, preços parecidos e um IQ separados por 0,2 ponto — mas só um deles tem modo de raciocínio

Análise

Qwen3 Next Thinking cobra 8x mais no output que o Ministral 3 8B

Dois modelos open-weights disputam o meio de tabela: um emite traços de pensamento, o outro responde direto. O preço na fatura é menos óbvio do que parece.

Análise

MiMo-V2-Flash lidera catálogo inteiro e custa 26 vezes menos que o3

MoE assume o topo do ranking de inteligência do catálogo nesta data. A diferença de preço para os modelos densos é o que muda a conta em produção.

Análise

Qwen3 Next 80B Thinking custa 6× mais caro na saída que o Ministral 3 14B

Comparativo frente a frente entre dois modelos chineses e franceses de pesos abertos, e o que essa diferença de preço significa na fatura do final do mês.

Análise

Qwen3 Next 80B Thinking custa 6× mais caro que Nemotron 3 Nano e só ganha em raciocínio

Comparativo entre dois modelos MoE chineses e americanos que disputam o mesmo nicho: tarefas longas com reasoning, mas em faixas de preço e desempenho bem diferentes.

Análise

Quatro modelos chineses, um só topo de ranking e preço de centavos

Xiaomi, Qwen e Baidu ocupam o catálogo com pesos abertos e custo por token que nenhum americano consegue igualar hoje.

Análise

Qwen3 Next 80B e Mistral Large 3 2512: US$ 0,35 que separam a conta

Os dois têm 262K de contexto, IQ próximo de 16 e são open weights. Mas um cobra 82% a mais no blended — e cada um brilha num tipo de tarefa.

Preços

8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece

A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.

Análise

Olmo 3.1 32B Instruct custa US$ 0,60 por milhão de saída — e entrega menos inteligência que um modelo de 3B da Mistral

A AllenAI abriu o código de um 32B que perde, no índice de inteligência, para o Ministral 3B que cabe em qualquer GPU.

Lançamentos

Olmo 3.1 32B chega aberto e barato — mas o QI é 6

AllenAI colocou no catálogo um modelo de 32B com pesos abertos e US$ 0,60 por milhão de tokens de saída. O índice de inteligência, porém, está em outro andar.

Análise

Nova 2 Lite custa 12× mais que Ministral 3 14B na saída

Amazon e Mistral lançaram modelos pequenos no mesmo dia, em dezembro; um deles cobra caro pelo token, o outro cobra barato pelo token — e a conta muda tudo.

Análise

12 modelos de raciocínio, um líder chinês e o3 custando 26 vezes mais

O recorte de reasoning do catálogo mostra Xiaomi na frente do índice de inteligência e OpenAI cobrando US$ 8 por milhão de tokens de saída no topo.

Análise

Amazon Nova 2 Lite cobra US$ 2,50 por milhão de saída; Nemotron 49B cobra US$ 0,40 e abre pesos

Dois modelos lançados no fim de 2025 disputam o mesmo nicho de raciocínio barato — mas só um entrega os pesos e só um entende imagem e vídeo.

Análise

Um milhão de tokens virou commodity: 38 modelos e o preço varia 40 vezes

Llama 4 Scout cobra US$ 0,10 por milhão de tokens de entrada. Nova Premier, US$ 12,50 de saída. A janela de contexto longa deixou de ser diferencial — o que você faz com ela é.

Análise

Nova 2 Lite custa o triplo do Qwen3 Next e entrega 40% mais IQ

Amazon aposta em multimodal e reasoning; Qwen responde com pesos abertos e 1M de tokens de cache barato. Cada um ganha num tipo de tarefa — e nenhum dos dois ganha em todas.

Preços

Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI

Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.

Análise

Nova 2 Lite custa quase o quádruplo do Maverick por saída de token

Amazon turbina o modelo de entrada e cobra caro pelo milagre; Meta segue barato e aberto, mas perde em inteligência.

Análise

Seed 1.6 Flash custa o mesmo que o topo do ranking — e ninguém mediu o QI dele

ByteDance joga na faixa dos US$ 0,30 por milhão de tokens de saída, igual ao MiMo da Xiaomi, mas sem benchmark público de inteligência para comparar.

Análise

Nova 2 Lite custa 12,5× mais que Nemotron Nano no token de saída

Amazon e NVIDIA lançaram modelos de raciocínio em dezembro. Um entrega multimodalidade e contexto gigante, o outro entrega preço quase dez vezes menor e pesos abertos.

← anteriores página 3 de 3