FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (22)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-10

56 reportagens neste mês.

Análise

Qwen3 VL 30B sai por US$ 0,60 sem nota de IQ publicada

Três dias depois do lançamento, o multimodal da Qwen já tem tabela de cobrança mas nenhum benchmark público no catálogo. Para um modelo de visão, isso muda como você decide.

Análise

Llama 4 Maverick custa 5x mais que Nemotron Nano 9B V2 e não raciocina

O modelo da Meta tem 1M de contexto e aceita imagem, mas o da NVIDIA cobra uma fração do preço e entrega raciocínio nativo.

Análise

GPT-5 Pro batch custa US$ 60 por milhão de tokens de saída

Para workloads pequenos em que cada resposta pesa muito, faz sentido testar. Para todo o resto, o3 e os modelos open-weight cobram uma fração do preço sem abrir mão de raciocínio.

Lançamentos

Nano Banana chega ao catálogo a US$ 2,50 por milhão de tokens de saída

Google libera Gemini 2.5 Flash Image com foco em geração e edição de imagens, mas sem índice de inteligência publicado e sem preço de entrada divulgado.

Análise

GPT-5 Pro custa US$ 120 por milhão de saída — vale para quem?

Lançado ontem pela OpenAI, o modelo topo de linha cobra 15 vezes mais caro na saída do que o o3 e fica sem nota pública de inteligência no catálogo.

Lançamentos

GPT-5 Pro chega a US$ 120 por milhão de tokens de saída

OpenAI lança a versão Pro do GPT-5 com contexto de 400 mil e cobra 15 vezes mais caro que o o3 na saída — vale para quem precisa do topo, não para o resto.

Lançamentos

Qwen lança VL 30B Thinking a US$ 2,40 por milhão de saída

Modelo multimodal da Alibaba custa quase 4× menos que o o3 da OpenAI por token gerado, mas ainda não tem nota de inteligência no catálogo.

Retrospectiva

Quatro modelos em sete dias: Anthropic repete o golpe e DeepSeek testa preço de saldos

A semana fechou com dois movimentos da Anthropic, uma nova aposta da DeepSeek e a entrada da Z.ai — todos mirando a mesma faixa de preço.

Análise

GLM 4.6 cobra US$ 1,75 por milhão de saída e mira o topo da Z.ai

Cinco dias após o lançamento, o modelo chinês de 200K de contexto entra num catálogo onde o3 lidera disparado — e a conta precisa fazer sentido.

Análise

Maverick custa 37% menos e pontua 63% mais que o ERNIE 4.5

O MoE americano de 17B ativos vence o chinês de 47B em quase tudo — exceto quando idioma, recência ou jurisdição pesam.

Análise

Llama 4 Maverick custa menos que o dobro do ERNIE 4.5 — e entrega bem mais

Comparativo entre dois MoEs open-weights deMeta e Baidu mostra que preço de entrada não conta a história inteira quando o assunto é inteligência por dólar.

Análise

Llama 4 Maverick custa o dobro do Qwen3 Next e entrega só 5% mais IQ

Comparativo frente a frente entre dois modelos abertos com arquitetura MoE: um americano de 402B e um chinês de 80B que cobram preços muito diferentes pelo mesmo tipo de tarefa.

Análise

gpt-oss-20b custa 13 vezes menos que o Nemotron 70B e ainda é mais inteligente

Modelo aberto da OpenAI sai por US$ 0,13 por milhão de tokens de saída e deixa o Nemotron da NVIDIA para trás em preço, IQ e velocidade em quase todos os eixos.

Análise

DeepSeek V3.2 Exp cobra US$ 0,41 por milhão de saída e entra sem nota de IQ

Modelo experimental chinês lançado há três dias traz atenção esparsa nova, mas não aparece no ranking de inteligência do catálogo — e isso muda o cálculo.

Análise

Gemini 2.5 Flash Lite Preview cobra US$ 0,40 por milhão de saída: vale trocar?

Modelo leve da Google chega seis dias atrás com preço agressivo, mas sem nota de inteligência publicada e sem benchmark aberto.

Análise

gpt-oss-20b cobra US$ 0,13 e entrega 2x a inteligência do Command A

Comparativo frente a frente entre o modelo aberto da OpenAI e o canadense da Cohere, com 76x de diferença no preço de saída.

← anteriores página 3 de 3