FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-05

58 reportagens neste mês.

Lançamentos

MiniMax M3 chega ao top 4 cobrando 11 vezes menos que o GPT-5.3-Codex

Modelo chinês de 428 bilhões de parâmetros (23 bilhões ativos por inferência) entra com pesos abertos, multimodal e IQ 45,397 — e o que mais chama atenção na fatura é o US$ 1,20 por milhão de tokens de saída.

Retrospectiva

Opus 4.8 a US$ 50, M3 grátis: a semana dos três preços

Anthropic e MiniMax lançaram três variantes de cada flagship em quatro dias. O catálogo segue com 454 modelos e 61 criadores, sem corte de preço — mas o chão da categoria IQ 45+ mudou.

Análise

Qwen3.7 Max cobra US$ 4,42 por milhão com IQ ainda em branco

Nove dias após o lançamento, o flagship da Alibaba ainda não tem nota oficial de inteligência no catálogo. O que ele tem é um preço no meio do caminho entre DeepSeek e Gemini.

Análise

Xiaomi MiMo-V2.5 cobra US$ 0,28 e vence Sonnet 4.6 em IQ

Modelo chinês de 310B parâmetros abertos custa um quinto do Anthropic e lidera em inteligência geral — mas o Claude segue melhor onde o trabalho é longo e estruturado.

Análise

MiMo-V2.5 custa nove vezes menos que o Grok 4.3 e ainda marca mais no IQ

Preço e inteligência bruta vão para a Xiaomi. Mas quando o gargalo é latência ou conhecimento factual sem RAG, o Grok 4.3 da SpaceXAI ainda cobra caro porque entrega — não inventa.

Análise

Grok Build 0.1 cobra caro para ser rápido no código

A SpaceXAI estreia em agentic coding com preço de modelo premium e ficha técnica sem benchmark público — o que isso entrega e para quem não compensa.

Análise

Step 3.7 Flash quer brigar com Gemma multimodal, mas cobra 3,4 vezes mais

Modelo da StepFun é multimodal e open weights, roda a 92,9 de velocidade — mas o IQ 30,9 e o preço de US$ 1,15 de saída enfraquecem o argumento.

Lançamentos

StepFun entra no catálogo com modelo de 196B a US$ 1,15 por milhão de tokens

Step 3.7 Flash é multimodal e tem pesos abertos, mas fica longe do topo de inteligência — e isso muda o cálculo de quem paga a API.

Análise

Gemini 3.5 Flash batch custa metade do Flash normal: vale migrar

A Google cortou a conta pela metade em troca de uma fila de processamento. Para quem aguenta esperar, o cálculo muda; para quem precisa de resposta na hora, não.

Análise

Gemini 3.5 Flash em modo batch custa metade do Flash comum — vale migrar?

A Google lançou uma variante assíncrona do Flash com corte agressivo de preço; o ganho real está no tipo certo de carga, não em qualquer chamada.

Análise

MiMo-V2.5 custa US$ 0,28 e Qwen3.6 27B cobra US$ 3,60 pelo mesmo milhão de tokens

Dois modelos chineses open weights lançados em abril de 2026 disputam a faixa barata do catálogo — e a diferença de preço é maior que a de capacidade.

Análise

Claude Opus 4.7 Fast cobra 6x mais caro para responder mais rápido

A Anthropic lançou uma variante 'rápida' do Opus 4.7 com janela de 1M de tokens e preço premium. Vale para quem precisa de velocidade — e só para esses.

Análise

Um modelo de 1 trilhão de parâmetros gratuito? O que o Ring-2.6-1T entrega de verdade

A inclusionAI abriu um tier grátis com 63B ativos e 262K de contexto. Veja para quem isso muda alguma coisa — e para quem continua igual.

Análise

Gemini 3.5 Flash cobra 10x mais por token que o MiMo chinês — vale a diferença?

O modelo do Google entrega mais inteligência bruta; o da Xiaomi cobra uma fração e ainda abre o peso. Veja em que cenário cada um ganha.

Análise

Gemini 3.1 Flash Lite cobra 8x menos que o Pro — e ainda não tem nota de QI

Há 17 dias no catálogo, a versão Lite da família 3.1 traz 1 milhão de contexto e multimodalidade por US$ 1,50 por milhão de tokens de saída. O verdadeiro destaque está no preço do cache.

Retrospectiva

Quatro lançamentos em sete dias e zero corte de preço

Google, SpaceXAI e Qwen entraram em campo na mesma semana; o catálogo passou de 440 modelos sem mexer nas tabelas.

Análise

Gemini 3.1 Flash Lite em modo batch custa quase nada — e expõe uma escolha

A versão batch do modelo mais barato do Google entra em produção com janela de 1M de tokens e preço de centavos. Vale trocar o que você roda hoje?

Análise

Gemini 3.5 Flash cobra 9 dólares por milhão; DeepSeek V4 Pro cobra 1,74

A diferença de inteligência é de 1,4 ponto; a diferença na fatura é de mais de cinco vezes. Eis quando cada um vence.

Análise

Gemini 3.5 Flash cobra US$ 9, GPT-5.3-Codex cobra US$ 14: vale a diferença?

O Flash da Google chega mais barato, mais rápido e com índice de inteligência maior que o Codex da OpenAI — mas a janela de contexto e a especialização contam.

Análise

GPT Chat Latest: o que sobra depois que a vitrine da OpenAI

A API estável que aponta para o Instant da casa custa 30 dólares por milhão de tokens de saída — e não aparece no ranking de inteligência.

página 1 de 3 próximas →