FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (22)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2025-09

58 reportagens neste mês.

Análise

Nemotron Nano 9B V2 é grátis, mas falta dado para você comparar

Lançado em 5 de setembro pela NVIDIA, o modelo entra sem índice de inteligência nem benchmark de coding — e disputa o slot free com modelos que já têm nota no catálogo.

Análise

Nemotron Nano 9B V2 perde em IQ e em preço para o gpt-oss-20b

Lançado há 5 dias pela NVIDIA, o modelo de 9B cobra US$ 0,16 por milhão de tokens de saída — e ainda fica atrás do open-weight da OpenAI no índice de inteligência.

Análise

gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês

Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.

Análise

Kimi K2 0905 entra sem benchmark no catálogo, a US$ 2,50 por milhão

A revisão de setembro da MoonshotAI entrega 1 trilhão de parâmetros e 262 mil tokens de contexto, mas deixa em branco as notas que permitiriam comparar.

Análise

Qwen3 30B Thinking custa 70% menos que o o3 — mas só se você usar tudo

Modelo MoE de raciocínio da Alibaba entra no catálogo com preço agressivo de saída e contexto de 82 mil tokens; entenda onde ele ganha e onde perde.

Lançamentos

Qwen Plus 0728 thinking chega a US$ 0,78 por milhão de saída e pressiona o meio do ranking

Versão híbrida com 1 milhão de contexto da Alibaba custa 10 vezes menos que o o3 da OpenAI na saída, mas não tem índice de inteligência publicado.

Retrospectiva

Três modelos, dois criadores, zero corte de preço na semana

Kimi K2 0905 e dois Nemotron Nano chegam ao catálogo entre 1 e 7 de setembro, enquanto a tabela de preços ficou intacta.

Análise

Grok Code Fast 1 custa US$ 1,50 por milhão na saída e US$ 0,02 no cache

A xAI vendeu o modelo como “rápido e econômico” para coding agêntico, mas a economia de verdade está num número que o release não destaca primeiro: o cache.

Análise

DeepSeek V3.1 cobra US$ 0,95 por milhão de saída e fica no meio do caminho

Modelo híbrido da DeepSeek tem modo thinking e contexto gigante, mas o preço o coloca numa posição estranha no catálogo de 222 modelos.

Análise

gpt-oss-20b custa 5,5x menos e bate Llama 3.3 70B em inteligência

No comparativo direto, o modelo open-weight da OpenAI ganha em preço, velocidade, raciocínio e no índice de inteligência. Llama 3.3 70B sobrevive só em nichos específicos.

Lançamentos

NVIDIA Nemotron Nano 9B V2: 9B de reasoning a US$ 0,16/M de saída

Pesos abertos e cabe em GPU única — mas o índice de inteligência fica abaixo de modelos pequenos rivais da OpenAI

Análise

Nemotron Nano 9B V2 custa US$ 0,16 por milhão de saída e entrega raciocínio de 9 bilhões de parâmetros

Modelo da NVIDIA chega com pesos abertos, contexto de 131k e preço de commodity — mas o índice de inteligência lembra o de um carro popular em pista de Fórmula 1.

Lançamentos

Kimi K2 0905 chega por US$ 2,50 por milhão de saída e fica abaixo do o3

Atualização de setembro da Moonshot AI cobra 3,2 vezes menos que o modelo da OpenAI no token de saída, mas ainda sem nota de inteligência publicada.

Análise

GPT-4o Audio custa US$ 10 por milhão de saída e não tem nota de IQ

Modelo multimodal de áudio da OpenAI estreou em agosto sem benchmark de inteligência publicado e cobra 25 vezes mais que o o3 para gerar áudio.

Análise

Mistral Medium 3.1 em modo batch custa um quinto do preço cheio

A versão assíncrona do medium da Mistral chega três semanas depois do lançamento cobrando US$ 1 por milhão de tokens de saída — mas sem nota pública de inteligência no catálogo.

Análise

gpt-oss-20b cobra metade do preço, mas a janela de contexto muda tudo

OpenAI e Meta disputam a faixa de modelos abertos pequenos; um vence em custo, o outro em multimodal e contexto.

Análise

Baidu ERNIE 4.5 VL 28B A3B, 21 dias sem benchmark publicado

Modelo multimodal da Baidu cobra US$ 0,14 de entrada e US$ 0,56 de saída, mas o catálogo ainda não publicou índice de inteligência, coding ou agentic.

Análise

gpt-oss-20b custa 5x menos que o Llama 4 Maverick — e quase empata em inteligência

Dois modelos abertos, preços opostos, capacidade parecida. Qual deles cabe no seu pipeline?

← anteriores página 3 de 3