Arquivo
749 reportagens desde setembro de 2025.
Nemotron 3 Ultra cobra US$ 2,40/M, mas perde em inteligência para rivais mais baratos
Modelo da NVIDIA chega com 55B ativos em MoE de 550B, pesos abertos e arquitetura Transformer-Mamba, mas o índice de inteligência de 38,319 fica quase 10 pontos abaixo do Gemini 3.1 Pro.
Nemotron 3 Ultra chega a US$ 2,40 de saída e mira coding, não topo de inteligência
Modelo aberto da NVIDIA estreia com 55B ativos em 550B totais, preço competitivo e foco em código e agentes — mas fica abaixo do pelotão de elite em IQ
Qwen3.7 Plus cobra US$ 1,28 por milhão de saída — e fica fora do top 5
Lançamento da Alibaba entra no catálogo com preço baixo, mas índice de inteligência 6 pontos abaixo do líder e 8 abaixo do M3, da própria MiniMax.
Qwen3.7 Plus cobra US$ 1,28 por milhão de saída e perde em raciocínio para o que já existia
Modelo da Alibaba entra no catálogo com preço de intermediário, mas fica abaixo de Xiaomi, DeepSeek e Gemini em agente e coding.
Claude Opus 4.8 cobra US$ 25 por milhão de saída: vale o que cobra?
Anthropic mantém o preço da família Opus, mas o catálogo já mostra alternativas com IQ acima de 45 por uma fração do custo.
Opus 4.8 a US$ 50, M3 grátis: a semana dos três preços
Anthropic e MiniMax lançaram três variantes de cada flagship em quatro dias. O catálogo segue com 454 modelos e 61 criadores, sem corte de preço — mas o chão da categoria IQ 45+ mudou.
MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex
Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.
Qwen3.7 Max cobra US$ 4,42 por milhão com IQ ainda em branco
Nove dias após o lançamento, o flagship da Alibaba ainda não tem nota oficial de inteligência no catálogo. O que ele tem é um preço no meio do caminho entre DeepSeek e Gemini.
Xiaomi MiMo-V2.5 cobra US$ 0,28 e vence Sonnet 4.6 em IQ
Modelo chinês de 310B parâmetros abertos custa um quinto do Anthropic e lidera em inteligência geral — mas o Claude segue melhor onde o trabalho é longo e estruturado.
Grok Build 0.1 cobra caro para ser rápido no código
A SpaceXAI estreia em agentic coding com preço de modelo premium e ficha técnica sem benchmark público — o que isso entrega e para quem não compensa.
MiMo-V2.5 custa nove vezes menos que o Grok 4.3 e ainda marca mais no IQ
Preço e inteligência bruta vão para a Xiaomi. Mas quando o gargalo é latência ou conhecimento factual sem RAG, o Grok 4.3 da SpaceXAI ainda cobra caro porque entrega — não inventa.
Step 3.7 Flash quer brigar com Gemma multimodal, mas cobra 3,4 vezes mais
Modelo da StepFun é multimodal e open weights, roda a 92,9 de velocidade — mas o IQ 30,9 e o preço de US$ 1,15 de saída enfraquecem o argumento.
StepFun entra no catálogo com modelo de 196B a US$ 1,15 por milhão de tokens
Step 3.7 Flash é multimodal e tem pesos abertos, mas fica longe do topo de inteligência — e isso muda o cálculo de quem paga a API.
Gemini 3.5 Flash em modo batch custa metade do Flash comum — vale migrar?
A Google lançou uma variante assíncrona do Flash com corte agressivo de preço; o ganho real está no tipo certo de carga, não em qualquer chamada.
Gemini 3.5 Flash batch custa metade do Flash normal: vale migrar
A Google cortou a conta pela metade em troca de uma fila de processamento. Para quem aguenta esperar, o cálculo muda; para quem precisa de resposta na hora, não.
Claude Opus 4.7 Fast cobra 6x mais caro para responder mais rápido
A Anthropic lançou uma variante 'rápida' do Opus 4.7 com janela de 1M de tokens e preço premium. Vale para quem precisa de velocidade — e só para esses.
MiMo-V2.5 custa US$ 0,28 e Qwen3.6 27B cobra US$ 3,60 pelo mesmo milhão de tokens
Dois modelos chineses open weights lançados em abril de 2026 disputam a faixa barata do catálogo — e a diferença de preço é maior que a de capacidade.
Um modelo de 1 trilhão de parâmetros gratuito? O que o Ring-2.6-1T entrega de verdade
A inclusionAI abriu um tier grátis com 63B ativos e 262K de contexto. Veja para quem isso muda alguma coisa — e para quem continua igual.
Gemini 3.5 Flash cobra 10x mais por token que o MiMo chinês — vale a diferença?
O modelo do Google entrega mais inteligência bruta; o da Xiaomi cobra uma fração e ainda abre o peso. Veja em que cenário cada um ganha.
Gemini 3.1 Flash Lite cobra 8x menos que o Pro — e ainda não tem nota de QI
Há 17 dias no catálogo, a versão Lite da família 3.1 traz 1 milhão de contexto e multimodalidade por US$ 1,50 por milhão de tokens de saída. O verdadeiro destaque está no preço do cache.