FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (20)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

749 reportagens desde setembro de 2025.

Análise

Qwen3 Next 80B Thinking custa mais caro que Nemotron 3 Nano e só ganha em raciocínio

Comparativo entre dois modelos MoE chineses e americanos que disputam o mesmo nicho: tarefas longas com reasoning, mas em faixas de preço e desempenho bem diferentes.

Análise

Quatro modelos chineses, um só topo de ranking e preço de centavos

Xiaomi, Qwen e Baidu ocupam o catálogo com pesos abertos e custo por token que nenhum americano consegue igualar hoje.

Preços

8 modelos custam menos de US$ 0,40 por milhão de tokens — e entregam mais do que parece

A faixa barata do catálogo em janeiro de 2026 reúne modelos abertos de Xiaomi, OpenAI, NVIDIA, Mistral e Meta com preços que cabem em qualquer projeto.

Análise

Qwen3 Next 80B e Mistral Large 3 2512: US$ 0,35 que separam a conta

Os dois têm 262K de contexto, IQ próximo de 16 e são open weights. Mas um cobra 82% a mais no blended — e cada um brilha num tipo de tarefa.

Análise

Olmo 3.1 32B Instruct custa US$ 0,60 por milhão de saída — e entrega menos inteligência que um modelo de 3B da Mistral

A AllenAI abriu o código de um 32B que perde, no índice de inteligência, para o Ministral 3B que cabe em qualquer GPU.

Lançamentos

Olmo 3.1 32B chega aberto e barato — mas o QI é 6

AllenAI colocou no catálogo um modelo de 32B com pesos abertos e US$ 0,60 por milhão de tokens de saída. O índice de inteligência, porém, está em outro andar.

Análise

Nova 2 Lite custa 12× mais que Ministral 3 14B na saída

Amazon e Mistral lançaram modelos pequenos no mesmo dia, em dezembro; um deles cobra caro pelo token, o outro cobra barato pelo token — e a conta muda tudo.

Análise

12 modelos de raciocínio, um líder chinês e o3 custando 26 vezes mais

O recorte de reasoning do catálogo mostra Xiaomi na frente do índice de inteligência e OpenAI cobrando US$ 8 por milhão de tokens de saída no topo.

Análise

Amazon Nova 2 Lite cobra US$ 2,50 por milhão de saída; Nemotron 49B cobra US$ 0,40 e abre pesos

Dois modelos lançados no fim de 2025 disputam o mesmo nicho de raciocínio barato — mas só um entrega os pesos e só um entende imagem e vídeo.

Análise

Um milhão de tokens virou commodity: 38 modelos e o preço varia 40 vezes

Llama 4 Scout cobra US$ 0,10 por milhão de tokens de entrada. Nova Premier, US$ 12,50 de saída. A janela de contexto longa deixou de ser diferencial — o que você faz com ela é.

Análise

Nova 2 Lite custa o triplo do Qwen3 Next e entrega 40% mais IQ

Amazon aposta em multimodal e reasoning; Qwen responde com pesos abertos e 1M de tokens de cache barato. Cada um ganha num tipo de tarefa — e nenhum dos dois ganha em todas.

Análise

Nova 2 Lite custa quase o quádruplo do Maverick por saída de token

Amazon turbina o modelo de entrada e cobra caro pelo milagre; Meta segue barato e aberto, mas perde em inteligência.

Preços

Cache de LLM: 10x mais barato, exceto em um modelo da OpenAI

Dos 141 modelos do catálogo que publicam preço de cache, quase todos dão 10% do input. Um deles cobra o mesmo valor — e é justamente o open-weight mais barato da casa.

Análise

Nova 2 Lite custa 12,5× mais que Nemotron Nano no token de saída

Amazon e NVIDIA lançaram modelos de raciocínio em dezembro. Um entrega multimodalidade e contexto gigante, o outro entrega preço quase dez vezes menor e pesos abertos.

Análise

Seed 1.6 Flash custa o mesmo que o topo do ranking — e ninguém mediu o QI dele

ByteDance joga na faixa dos US$ 0,30 por milhão de tokens de saída, igual ao MiMo da Xiaomi, mas sem benchmark público de inteligência para comparar.

Análise

Amazon Nova 2 Lite cobra 19 vezes mais na saída que o gpt-oss-20b da OpenAI

Dois modelos norte-americanos de baixo custo, mas o preço por token de saída revela quem mira produção em escala e quem mira economia de verdade.

Análise

Seed 1.6 aceita vídeo por US$ 2 — mas sem QI publicado

Modelo multimodal da ByteDance Seed entrou há oito dias com 256K de contexto. A conta é convidativa; o catálogo ainda não mediu.

Análise

MiniMax M2.1: 7 dias de mercado e zero benchmark publicado

Lançado em 23 de dezembro focado em coding e agentes, o modelo entra no catálogo com IQ, coding e agentic em branco — e a régua de comparação passa a ser o preço.

Análise

Nova 2 Lite custa 2,3× mais que INTELLECT-3 por token de saída

Amazon entrega multimodal e contexto de 1 milhão; Prime Intellect responde com pesos abertos e 107B parâmetros. O preço mais alto da Nova 2 Lite só se justifica se você usa câmera nem roda modelo local.

Análise

Nova 2 Lite custa 67% mais que Mistral Large 3 — e perde em raciocínio

Amazon cobra US$ 2,50 por milhão de tokens de saída contra US$ 1,50 do modelo francês, que ainda abre o peso e tem contexto quatro vezes menor. O comparativo que faltava para fechar o ano.

← anteriores página 26 de 38 próximas →