FalaVIP IA o que os modelos custam,
medido todo dia
2026-09 (29)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

758 reportagens desde setembro de 2025.

Análise

Nemotron Super 49B custa o triplo do gpt-oss-20b e perde em inteligência

NVIDIA lançou ontem um derivado do Llama 3.3 70B focado em tool calling — mas no comparativo direto de preço e IQ, o modelo da OpenAI ainda reina na faixa aberta.

Lançamentos

Nemotron 49B chega por US$ 0,40/M e fica no meio de tabela

O modelo da NVIDIA tem pesos abertos e 128K de contexto, mas custa mais que o dobro do gpt-oss-120b por um índice de inteligência menor.

Lançamentos

O3 Deep Research sai por 5x mais que o o3 na saída de tokens

OpenAI também lançou hoje o o4-mini Deep Research por US$ 8 por milhão de tokens de saída — um quinto do preço do irmão mais caro.

Análise

Qwen3 VL 30B sai por US$ 0,60 sem nota de IQ publicada

Três dias depois do lançamento, o multimodal da Qwen já tem tabela de cobrança mas nenhum benchmark público no catálogo. Para um modelo de visão, isso muda como você decide.

Lançamentos

Baidu lança ERNIE 4.5 21B Thinking a US$ 0,28 por milhão de saída

Modelo leve de raciocínio da chinesa chega ao catálogo com preço entre os menores do segmento, mas sem nota de inteligência publicada.

Análise

GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída

Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.

Análise

Llama 4 Maverick custa 5x mais que Nemotron Nano 9B V2 e não raciocina

O modelo da Meta tem 1M de contexto e aceita imagem, mas o da NVIDIA cobra uma fração do preço e entrega raciocínio nativo.

Análise

GPT-5 Pro custa US$ 120 por milhão de saída — vale para quem?

Lançado ontem pela OpenAI, o modelo topo de linha cobra 15 vezes mais caro na saída do que o o3 e fica sem nota pública de inteligência no catálogo.

Lançamentos

Nano Banana chega ao catálogo a US$ 2,50 por milhão de tokens de saída

Google libera Gemini 2.5 Flash Image com foco em geração e edição de imagens, mas sem índice de inteligência publicado e sem preço de entrada divulgado.

Lançamentos

Qwen lança VL 30B Thinking a US$ 2,40 por milhão de saída

Modelo multimodal da Alibaba custa quase 4× menos que o o3 da OpenAI por token gerado, mas ainda não tem nota de inteligência no catálogo.

Lançamentos

GPT-5 Pro chega a US$ 120 por milhão de tokens de saída

OpenAI lança a versão Pro do GPT-5 com contexto de 400 mil e cobra 15 vezes mais caro que o o3 na saída — vale para quem precisa do topo, não para o resto.

Análise

GLM 4.6 cobra US$ 1,75 por milhão de saída e mira o topo da Z.ai

Cinco dias após o lançamento, o modelo chinês de 200K de contexto entra num catálogo onde o3 lidera disparado — e a conta precisa fazer sentido.

Retrospectiva

Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos

A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.

Análise

Llama 4 Maverick custa menos que o dobro do ERNIE 4.5 — e entrega bem mais

Comparativo entre dois MoEs open-weights deMeta e Baidu mostra que preço de entrada não conta a história inteira quando o assunto é inteligência por dólar.

Análise

Maverick custa 37% menos e pontua 63% mais que o ERNIE 4.5

O MoE americano de 17B ativos vence o chinês de 47B em quase tudo — exceto quando idioma, recência ou jurisdição pesam.

Análise

Llama 4 Maverick custa o dobro do Qwen3 Next e entrega só 5% mais IQ

Comparativo frente a frente entre dois modelos abertos com arquitetura MoE: um americano de 402B e um chinês de 80B que cobram preços muito diferentes pelo mesmo tipo de tarefa.

Análise

DeepSeek V3.2 Exp cobra US$ 0,41 por milhão de saída e entra sem nota de IQ

Modelo experimental chinês lançado há três dias traz atenção esparsa nova, mas não aparece no ranking de inteligência do catálogo — e isso muda o cálculo.

Análise

gpt-oss-20b custa 13 vezes menos que o Nemotron 70B e ainda é mais inteligente

Modelo aberto da OpenAI sai por US$ 0,13 por milhão de tokens de saída e deixa o Nemotron da NVIDIA para trás em preço, IQ e velocidade em quase todos os eixos.

Análise

Gemini 2.5 Flash Lite Preview cobra US$ 0,40 por milhão de saída: vale trocar?

Modelo leve da Google chega seis dias atrás com preço agressivo, mas sem nota de inteligência publicada e sem benchmark aberto.

Análise

gpt-oss-20b cobra US$ 0,13 e entrega 2x a inteligência do Command A

Comparativo frente a frente entre o modelo aberto da OpenAI e o canadense da Cohere, com 76x de diferença no preço de saída.

← anteriores página 35 de 38 próximas →