Arquivo — 2025-10
56 reportagens neste mês.
Qwen3 VL 30B sai por US$ 0,60 sem nota de IQ publicada
Três dias depois do lançamento, o multimodal da Qwen já tem tabela de cobrança mas nenhum benchmark público no catálogo. Para um modelo de visão, isso muda como você decide.
Llama 4 Maverick custa 5x mais que Nemotron Nano 9B V2 e não raciocina
O modelo da Meta tem 1M de contexto e aceita imagem, mas o da NVIDIA cobra uma fração do preço e entrega raciocínio nativo.
GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída
Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.
Nano Banana chega ao catálogo a US$ 2,50 por milhão de tokens de saída
Google libera Gemini 2.5 Flash Image com foco em geração e edição de imagens, mas sem índice de inteligência publicado e sem preço de entrada divulgado.
GPT-5 Pro custa US$ 120 por milhão de saída — vale para quem?
Lançado ontem pela OpenAI, o modelo topo de linha cobra 15 vezes mais caro na saída do que o o3 e fica sem nota pública de inteligência no catálogo.
GPT-5 Pro chega a US$ 120 por milhão de tokens de saída
OpenAI lança a versão Pro do GPT-5 com contexto de 400 mil e cobra 15 vezes mais caro que o o3 na saída — vale para quem precisa do topo, não para o resto.
Qwen lança VL 30B Thinking a US$ 2,40 por milhão de saída
Modelo multimodal da Alibaba custa quase 4× menos que o o3 da OpenAI por token gerado, mas ainda não tem nota de inteligência no catálogo.
Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos
A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.
GLM 4.6 cobra US$ 1,75 por milhão de saída e mira o topo da Z.ai
Cinco dias após o lançamento, o modelo chinês de 200K de contexto entra num catálogo onde o3 lidera disparado — e a conta precisa fazer sentido.
Maverick custa 37% menos e pontua 63% mais que o ERNIE 4.5
O MoE americano de 17B ativos vence o chinês de 47B em quase tudo — exceto quando idioma, recência ou jurisdição pesam.
Llama 4 Maverick custa menos que o dobro do ERNIE 4.5 — e entrega bem mais
Comparativo entre dois MoEs open-weights deMeta e Baidu mostra que preço de entrada não conta a história inteira quando o assunto é inteligência por dólar.
Llama 4 Maverick custa o dobro do Qwen3 Next e entrega só 5% mais IQ
Comparativo frente a frente entre dois modelos abertos com arquitetura MoE: um americano de 402B e um chinês de 80B que cobram preços muito diferentes pelo mesmo tipo de tarefa.
gpt-oss-20b custa 13 vezes menos que o Nemotron 70B e ainda é mais inteligente
Modelo aberto da OpenAI sai por US$ 0,13 por milhão de tokens de saída e deixa o Nemotron da NVIDIA para trás em preço, IQ e velocidade em quase todos os eixos.
DeepSeek V3.2 Exp cobra US$ 0,41 por milhão de saída e entra sem nota de IQ
Modelo experimental chinês lançado há três dias traz atenção esparsa nova, mas não aparece no ranking de inteligência do catálogo — e isso muda o cálculo.
Gemini 2.5 Flash Lite Preview cobra US$ 0,40 por milhão de saída: vale trocar?
Modelo leve da Google chega seis dias atrás com preço agressivo, mas sem nota de inteligência publicada e sem benchmark aberto.
gpt-oss-20b cobra US$ 0,13 e entrega 2x a inteligência do Command A
Comparativo frente a frente entre o modelo aberto da OpenAI e o canadense da Cohere, com 76x de diferença no preço de saída.