Análise
396 reportagens de análise sobre modelos de inteligência artificial.
O Qwen3 Next Instruct cobra US$ 1,10 por milhão e perde do próprio irmão
Lançado ontem pela Alibaba, o modelo aberto de 80B/3B ativos aposta em velocidade e contexto de 256k — mas o preço de saída e o IQ abaixo da variante Thinking dificultam a conta.
Qwen3 Thinking estreia cobrando 9× mais que gpt-oss-20b no token de saída
Modelo de raciocínio chinês tem 80B de parâmetros totais e só 3B ativos. A conta sai cara, mas há um nicho onde a conta fecha.
Nemotron Nano 9B V2 perde em IQ e em preço para o gpt-oss-20b
Lançado há 5 dias pela NVIDIA, o modelo de 9B cobra US$ 0,16 por milhão de tokens de saída — e ainda fica atrás do open-weight da OpenAI no índice de inteligência.
Nemotron Nano 9B V2 é grátis, mas falta dado para você comparar
Lançado em 5 de setembro pela NVIDIA, o modelo entra sem índice de inteligência nem benchmark de coding — e disputa o slot free com modelos que já têm nota no catálogo.
gpt-oss-20b da OpenAI custa um oitavo do ERNIE 4.5 chinês
Mesmo modelo de raciocínio, fração da conta: a diferença de preço entre os dois MoEs abertos passa de oito vezes nos tokens de saída.
Kimi K2 0905 entra sem benchmark no catálogo, a US$ 2,50 por milhão
A revisão de setembro da MoonshotAI entrega 1 trilhão de parâmetros e 262 mil tokens de contexto, mas deixa em branco as notas que permitiriam comparar.
Qwen3 30B Thinking custa 70% menos que o o3 — mas só se você usar tudo
Modelo MoE de raciocínio da Alibaba entra no catálogo com preço agressivo de saída e contexto de 82 mil tokens; entenda onde ele ganha e onde perde.
Grok Code Fast 1 custa US$ 1,50 por milhão na saída e US$ 0,02 no cache
A xAI vendeu o modelo como “rápido e econômico” para coding agêntico, mas a economia de verdade está num número que o release não destaca primeiro: o cache.
gpt-oss-20b custa 5,5x menos e bate Llama 3.3 70B em inteligência
No comparativo direto, o modelo open-weight da OpenAI ganha em preço, velocidade, raciocínio e no índice de inteligência. Llama 3.3 70B sobrevive só em nichos específicos.
DeepSeek V3.1 cobra US$ 0,95 por milhão de saída e fica no meio do caminho
Modelo híbrido da DeepSeek tem modo thinking e contexto gigante, mas o preço o coloca numa posição estranha no catálogo de 222 modelos.
Nemotron Nano 9B V2 custa US$ 0,16 por milhão de saída e entrega raciocínio de 9 bilhões de parâmetros
Modelo da NVIDIA chega com pesos abertos, contexto de 131k e preço de commodity — mas o índice de inteligência lembra o de um carro popular em pista de Fórmula 1.
GPT-4o Audio custa US$ 10 por milhão de saída e não tem nota de IQ
Modelo multimodal de áudio da OpenAI estreou em agosto sem benchmark de inteligência publicado e cobra 25 vezes mais que o o3 para gerar áudio.
gpt-oss-20b cobra metade do preço, mas a janela de contexto muda tudo
OpenAI e Meta disputam a faixa de modelos abertos pequenos; um vence em custo, o outro em multimodal e contexto.
Mistral Medium 3.1 em modo batch custa um quinto do preço cheio
A versão assíncrona do medium da Mistral chega três semanas depois do lançamento cobrando US$ 1 por milhão de tokens de saída — mas sem nota pública de inteligência no catálogo.
gpt-oss-20b custa 5x menos que o Llama 4 Maverick — e quase empata em inteligência
Dois modelos abertos, preços opostos, capacidade parecida. Qual deles cabe no seu pipeline?
Baidu ERNIE 4.5 VL 28B A3B, 21 dias sem benchmark publicado
Modelo multimodal da Baidu cobra US$ 0,14 de entrada e US$ 0,56 de saída, mas o catálogo ainda não publicou índice de inteligência, coding ou agentic.