Arquivo — 2025-09
58 reportagens neste mês.
Nemotron Nano 9B V2 é grátis, mas falta dado para você comparar
Lançado em 5 de setembro pela NVIDIA, o modelo entra sem índice de inteligência nem benchmark de coding — e disputa o slot free com modelos que já têm nota no catálogo.
Nemotron Nano 9B V2 perde em IQ e em preço para o gpt-oss-20b
Lançado há 5 dias pela NVIDIA, o modelo de 9B cobra US$ 0,16 por milhão de tokens de saída — e ainda fica atrás do open-weight da OpenAI no índice de inteligência.
gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês
Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.
Kimi K2 0905 entra sem benchmark no catálogo, a US$ 2,50 por milhão
A revisão de setembro da MoonshotAI entrega 1 trilhão de parâmetros e 262 mil tokens de contexto, mas deixa em branco as notas que permitiriam comparar.
Qwen3 30B Thinking custa 70% menos que o o3 — mas só se você usar tudo
Modelo MoE de raciocínio da Alibaba entra no catálogo com preço agressivo de saída e contexto de 82 mil tokens; entenda onde ele ganha e onde perde.
Qwen Plus 0728 thinking chega a US$ 0,78 por milhão de saída e pressiona o meio do ranking
Versão híbrida com 1 milhão de contexto da Alibaba custa 10 vezes menos que o o3 da OpenAI na saída, mas não tem índice de inteligência publicado.
Três modelos, dois criadores, zero corte de preço na semana
Kimi K2 0905 e dois Nemotron Nano chegam ao catálogo entre 1 e 7 de setembro, enquanto a tabela de preços ficou intacta.
Grok Code Fast 1 custa US$ 1,50 por milhão na saída e US$ 0,02 no cache
A xAI vendeu o modelo como “rápido e econômico” para coding agêntico, mas a economia de verdade está num número que o release não destaca primeiro: o cache.
DeepSeek V3.1 cobra US$ 0,95 por milhão de saída e fica no meio do caminho
Modelo híbrido da DeepSeek tem modo thinking e contexto gigante, mas o preço o coloca numa posição estranha no catálogo de 222 modelos.
gpt-oss-20b custa 5,5x menos e bate Llama 3.3 70B em inteligência
No comparativo direto, o modelo open-weight da OpenAI ganha em preço, velocidade, raciocínio e no índice de inteligência. Llama 3.3 70B sobrevive só em nichos específicos.
NVIDIA Nemotron Nano 9B V2: 9B de reasoning a US$ 0,16/M de saída
Pesos abertos e cabe em GPU única — mas o índice de inteligência fica abaixo de modelos pequenos rivais da OpenAI
Nemotron Nano 9B V2 custa US$ 0,16 por milhão de saída e entrega raciocínio de 9 bilhões de parâmetros
Modelo da NVIDIA chega com pesos abertos, contexto de 131k e preço de commodity — mas o índice de inteligência lembra o de um carro popular em pista de Fórmula 1.
Kimi K2 0905 chega por US$ 2,50 por milhão de saída e fica abaixo do o3
Atualização de setembro da Moonshot AI cobra 3,2 vezes menos que o modelo da OpenAI no token de saída, mas ainda sem nota de inteligência publicada.
GPT-4o Audio custa US$ 10 por milhão de saída e não tem nota de IQ
Modelo multimodal de áudio da OpenAI estreou em agosto sem benchmark de inteligência publicado e cobra 25 vezes mais que o o3 para gerar áudio.
Mistral Medium 3.1 em modo batch custa um quinto do preço cheio
A versão assíncrona do medium da Mistral chega três semanas depois do lançamento cobrando US$ 1 por milhão de tokens de saída — mas sem nota pública de inteligência no catálogo.
gpt-oss-20b cobra metade do preço, mas a janela de contexto muda tudo
OpenAI e Meta disputam a faixa de modelos abertos pequenos; um vence em custo, o outro em multimodal e contexto.
Baidu ERNIE 4.5 VL 28B A3B, 21 dias sem benchmark publicado
Modelo multimodal da Baidu cobra US$ 0,14 de entrada e US$ 0,56 de saída, mas o catálogo ainda não publicou índice de inteligência, coding ou agentic.
gpt-oss-20b custa 5x menos que o Llama 4 Maverick — e quase empata em inteligência
Dois modelos abertos, preços opostos, capacidade parecida. Qual deles cabe no seu pipeline?