FalaVIP IA quinta-feira, 03 de setembro de 2026

Análise

396 reportagens de análise sobre modelos de inteligência artificial.

Análise

O Qwen3 Next Instruct cobra US$ 1,10 por milhão e perde do próprio irmão

Lançado ontem pela Alibaba, o modelo aberto de 80B/3B ativos aposta em velocidade e contexto de 256k — mas o preço de saída e o IQ abaixo da variante Thinking dificultam a conta.

Análise

Qwen3 Thinking estreia cobrando 9× mais que gpt-oss-20b no token de saída

Modelo de raciocínio chinês tem 80B de parâmetros totais e só 3B ativos. A conta sai cara, mas há um nicho onde a conta fecha.

Análise

Nemotron Nano 9B V2 perde em IQ e em preço para o gpt-oss-20b

Lançado há 5 dias pela NVIDIA, o modelo de 9B cobra US$ 0,16 por milhão de tokens de saída — e ainda fica atrás do open-weight da OpenAI no índice de inteligência.

Análise

Nemotron Nano 9B V2 é grátis, mas falta dado para você comparar

Lançado em 5 de setembro pela NVIDIA, o modelo entra sem índice de inteligência nem benchmark de coding — e disputa o slot free com modelos que já têm nota no catálogo.

Análise

gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês

Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.

Análise

Kimi K2 0905 entra sem benchmark no catálogo, a US$ 2,50 por milhão

A revisão de setembro da MoonshotAI entrega 1 trilhão de parâmetros e 262 mil tokens de contexto, mas deixa em branco as notas que permitiriam comparar.

Análise

Qwen3 30B Thinking custa 70% menos que o o3 — mas só se você usar tudo

Modelo MoE de raciocínio da Alibaba entra no catálogo com preço agressivo de saída e contexto de 82 mil tokens; entenda onde ele ganha e onde perde.

Análise

Grok Code Fast 1 custa US$ 1,50 por milhão na saída e US$ 0,02 no cache

A xAI vendeu o modelo como “rápido e econômico” para coding agêntico, mas a economia de verdade está num número que o release não destaca primeiro: o cache.

Análise

gpt-oss-20b custa 5,5x menos e bate Llama 3.3 70B em inteligência

No comparativo direto, o modelo open-weight da OpenAI ganha em preço, velocidade, raciocínio e no índice de inteligência. Llama 3.3 70B sobrevive só em nichos específicos.

Análise

DeepSeek V3.1 cobra US$ 0,95 por milhão de saída e fica no meio do caminho

Modelo híbrido da DeepSeek tem modo thinking e contexto gigante, mas o preço o coloca numa posição estranha no catálogo de 222 modelos.

Análise

Nemotron Nano 9B V2 custa US$ 0,16 por milhão de saída e entrega raciocínio de 9 bilhões de parâmetros

Modelo da NVIDIA chega com pesos abertos, contexto de 131k e preço de commodity — mas o índice de inteligência lembra o de um carro popular em pista de Fórmula 1.

Análise

GPT-4o Audio custa US$ 10 por milhão de saída e não tem nota de IQ

Modelo multimodal de áudio da OpenAI estreou em agosto sem benchmark de inteligência publicado e cobra 25 vezes mais que o o3 para gerar áudio.

Análise

gpt-oss-20b cobra metade do preço, mas a janela de contexto muda tudo

OpenAI e Meta disputam a faixa de modelos abertos pequenos; um vence em custo, o outro em multimodal e contexto.

Análise

Mistral Medium 3.1 em modo batch custa um quinto do preço cheio

A versão assíncrona do medium da Mistral chega três semanas depois do lançamento cobrando US$ 1 por milhão de tokens de saída — mas sem nota pública de inteligência no catálogo.

Análise

gpt-oss-20b custa 5x menos que o Llama 4 Maverick — e quase empata em inteligência

Dois modelos abertos, preços opostos, capacidade parecida. Qual deles cabe no seu pipeline?

Análise

Baidu ERNIE 4.5 VL 28B A3B, 21 dias sem benchmark publicado

Modelo multimodal da Baidu cobra US$ 0,14 de entrada e US$ 0,56 de saída, mas o catálogo ainda não publicou índice de inteligência, coding ou agentic.

← anteriores página 20 de 20