Arquivo — 2026-05
58 reportagens neste mês.
MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex
Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.
Opus 4.8 a US$ 50, M3 grátis: a semana dos três preços
Anthropic e MiniMax lançaram três variantes de cada flagship em quatro dias. O catálogo segue com 454 modelos e 61 criadores, sem corte de preço — mas o chão da categoria IQ 45+ mudou.
Qwen3.7 Max cobra US$ 4,42 por milhão com IQ ainda em branco
Nove dias após o lançamento, o flagship da Alibaba ainda não tem nota oficial de inteligência no catálogo. O que ele tem é um preço no meio do caminho entre DeepSeek e Gemini.
Xiaomi MiMo-V2.5 cobra US$ 0,28 e vence Sonnet 4.6 em IQ
Modelo chinês de 310B parâmetros abertos custa um quinto do Anthropic e lidera em inteligência geral — mas o Claude segue melhor onde o trabalho é longo e estruturado.
MiMo-V2.5 custa nove vezes menos que o Grok 4.3 e ainda marca mais no IQ
Preço e inteligência bruta vão para a Xiaomi. Mas quando o gargalo é latência ou conhecimento factual sem RAG, o Grok 4.3 da SpaceXAI ainda cobra caro porque entrega — não inventa.
Grok Build 0.1 cobra caro para ser rápido no código
A SpaceXAI estreia em agentic coding com preço de modelo premium e ficha técnica sem benchmark público — o que isso entrega e para quem não compensa.
Step 3.7 Flash quer brigar com Gemma multimodal, mas cobra 3,4 vezes mais
Modelo da StepFun é multimodal e open weights, roda a 92,9 de velocidade — mas o IQ 30,9 e o preço de US$ 1,15 de saída enfraquecem o argumento.
StepFun entra no catálogo com modelo de 196B a US$ 1,15 por milhão de tokens
Step 3.7 Flash é multimodal e tem pesos abertos, mas fica longe do topo de inteligência — e isso muda o cálculo de quem paga a API.
Gemini 3.5 Flash batch custa metade do Flash normal: vale migrar
A Google cortou a conta pela metade em troca de uma fila de processamento. Para quem aguenta esperar, o cálculo muda; para quem precisa de resposta na hora, não.
Gemini 3.5 Flash em modo batch custa metade do Flash comum — vale migrar?
A Google lançou uma variante assíncrona do Flash com corte agressivo de preço; o ganho real está no tipo certo de carga, não em qualquer chamada.
MiMo-V2.5 custa US$ 0,28 e Qwen3.6 27B cobra US$ 3,60 pelo mesmo milhão de tokens
Dois modelos chineses open weights lançados em abril de 2026 disputam a faixa barata do catálogo — e a diferença de preço é maior que a de capacidade.
Claude Opus 4.7 Fast cobra 6x mais caro para responder mais rápido
A Anthropic lançou uma variante 'rápida' do Opus 4.7 com janela de 1M de tokens e preço premium. Vale para quem precisa de velocidade — e só para esses.
Um modelo de 1 trilhão de parâmetros gratuito? O que o Ring-2.6-1T entrega de verdade
A inclusionAI abriu um tier grátis com 63B ativos e 262K de contexto. Veja para quem isso muda alguma coisa — e para quem continua igual.
Gemini 3.5 Flash cobra 10x mais por token que o MiMo chinês — vale a diferença?
O modelo do Google entrega mais inteligência bruta; o da Xiaomi cobra uma fração e ainda abre o peso. Veja em que cenário cada um ganha.
Gemini 3.1 Flash Lite cobra 8x menos que o Pro — e ainda não tem nota de QI
Há 17 dias no catálogo, a versão Lite da família 3.1 traz 1 milhão de contexto e multimodalidade por US$ 1,50 por milhão de tokens de saída. O verdadeiro destaque está no preço do cache.
Quatro lançamentos em sete dias e zero corte de preço
Google, SpaceXAI e Qwen entraram em campo na mesma semana; o catálogo passou de 440 modelos sem mexer nas tabelas.
Gemini 3.1 Flash Lite em modo batch custa quase nada — e expõe uma escolha
A versão batch do modelo mais barato do Google entra em produção com janela de 1M de tokens e preço de centavos. Vale trocar o que você roda hoje?
Gemini 3.5 Flash cobra 9 dólares por milhão; DeepSeek V4 Pro cobra 1,74
A diferença de inteligência é de 1,4 ponto; a diferença na fatura é de mais de cinco vezes. Eis quando cada um vence.
Gemini 3.5 Flash cobra US$ 9, GPT-5.3-Codex cobra US$ 14: vale a diferença?
O Flash da Google chega mais barato, mais rápido e com índice de inteligência maior que o Codex da OpenAI — mas a janela de contexto e a especialização contam.
GPT Chat Latest: o que sobra depois que a vitrine da OpenAI
A API estável que aponta para o Instant da casa custa 30 dólares por milhão de tokens de saída — e não aparece no ranking de inteligência.