Arquivo
758 reportagens desde setembro de 2025.
Nemotron Super 49B custa o triplo do gpt-oss-20b e perde em inteligência
NVIDIA lançou ontem um derivado do Llama 3.3 70B focado em tool calling — mas no comparativo direto de preço e IQ, o modelo da OpenAI ainda reina na faixa aberta.
Nemotron 49B chega por US$ 0,40/M e fica no meio de tabela
O modelo da NVIDIA tem pesos abertos e 128K de contexto, mas custa mais que o dobro do gpt-oss-120b por um índice de inteligência menor.
O3 Deep Research sai por 5x mais que o o3 na saída de tokens
OpenAI também lançou hoje o o4-mini Deep Research por US$ 8 por milhão de tokens de saída — um quinto do preço do irmão mais caro.
Qwen3 VL 30B sai por US$ 0,60 sem nota de IQ publicada
Três dias depois do lançamento, o multimodal da Qwen já tem tabela de cobrança mas nenhum benchmark público no catálogo. Para um modelo de visão, isso muda como você decide.
Baidu lança ERNIE 4.5 21B Thinking a US$ 0,28 por milhão de saída
Modelo leve de raciocínio da chinesa chega ao catálogo com preço entre os menores do segmento, mas sem nota de inteligência publicada.
GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída
Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.
Llama 4 Maverick custa 5x mais que Nemotron Nano 9B V2 e não raciocina
O modelo da Meta tem 1M de contexto e aceita imagem, mas o da NVIDIA cobra uma fração do preço e entrega raciocínio nativo.
GPT-5 Pro custa US$ 120 por milhão de saída — vale para quem?
Lançado ontem pela OpenAI, o modelo topo de linha cobra 15 vezes mais caro na saída do que o o3 e fica sem nota pública de inteligência no catálogo.
Nano Banana chega ao catálogo a US$ 2,50 por milhão de tokens de saída
Google libera Gemini 2.5 Flash Image com foco em geração e edição de imagens, mas sem índice de inteligência publicado e sem preço de entrada divulgado.
Qwen lança VL 30B Thinking a US$ 2,40 por milhão de saída
Modelo multimodal da Alibaba custa quase 4× menos que o o3 da OpenAI por token gerado, mas ainda não tem nota de inteligência no catálogo.
GPT-5 Pro chega a US$ 120 por milhão de tokens de saída
OpenAI lança a versão Pro do GPT-5 com contexto de 400 mil e cobra 15 vezes mais caro que o o3 na saída — vale para quem precisa do topo, não para o resto.
GLM 4.6 cobra US$ 1,75 por milhão de saída e mira o topo da Z.ai
Cinco dias após o lançamento, o modelo chinês de 200K de contexto entra num catálogo onde o3 lidera disparado — e a conta precisa fazer sentido.
Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos
A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.
Llama 4 Maverick custa menos que o dobro do ERNIE 4.5 — e entrega bem mais
Comparativo entre dois MoEs open-weights deMeta e Baidu mostra que preço de entrada não conta a história inteira quando o assunto é inteligência por dólar.
Maverick custa 37% menos e pontua 63% mais que o ERNIE 4.5
O MoE americano de 17B ativos vence o chinês de 47B em quase tudo — exceto quando idioma, recência ou jurisdição pesam.
Llama 4 Maverick custa o dobro do Qwen3 Next e entrega só 5% mais IQ
Comparativo frente a frente entre dois modelos abertos com arquitetura MoE: um americano de 402B e um chinês de 80B que cobram preços muito diferentes pelo mesmo tipo de tarefa.
DeepSeek V3.2 Exp cobra US$ 0,41 por milhão de saída e entra sem nota de IQ
Modelo experimental chinês lançado há três dias traz atenção esparsa nova, mas não aparece no ranking de inteligência do catálogo — e isso muda o cálculo.
gpt-oss-20b custa 13 vezes menos que o Nemotron 70B e ainda é mais inteligente
Modelo aberto da OpenAI sai por US$ 0,13 por milhão de tokens de saída e deixa o Nemotron da NVIDIA para trás em preço, IQ e velocidade em quase todos os eixos.
Gemini 2.5 Flash Lite Preview cobra US$ 0,40 por milhão de saída: vale trocar?
Modelo leve da Google chega seis dias atrás com preço agressivo, mas sem nota de inteligência publicada e sem benchmark aberto.
gpt-oss-20b cobra US$ 0,13 e entrega 2x a inteligência do Command A
Comparativo frente a frente entre o modelo aberto da OpenAI e o canadense da Cohere, com 76x de diferença no preço de saída.