FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (20)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo

749 reportagens desde setembro de 2025.

Retrospectiva

Quatro lançamentos em sete dias e zero corte de preço

Google, SpaceXAI e Qwen entraram em campo na mesma semana; o catálogo passou de 440 modelos sem mexer nas tabelas.

Análise

Gemini 3.5 Flash cobra 9 dólares por milhão; DeepSeek V4 Pro cobra 1,74

A diferença de inteligência é de 1,4 ponto; a diferença na fatura é de mais de cinco vezes. Eis quando cada um vence.

Análise

Gemini 3.1 Flash Lite em modo batch custa quase nada — e expõe uma escolha

A versão batch do modelo mais barato do Google entra em produção com janela de 1M de tokens e preço de centavos. Vale trocar o que você roda hoje?

Análise

Gemini 3.5 Flash cobra US$ 9, GPT-5.3-Codex cobra US$ 14: vale a diferença?

O Flash da Google chega mais barato, mais rápido e com índice de inteligência maior que o Codex da OpenAI — mas a janela de contexto e a especialização contam.

Análise

GPT Chat Latest: o que sobra depois que a vitrine da OpenAI

A API estável que aponta para o Instant da casa custa 30 dólares por milhão de tokens de saída — e não aparece no ranking de inteligência.

Lançamentos

Qwen3.7 Max estreia a US$ 4,42 por milhão de saída sem índice de inteligência

Preço coloca o flagship da Alibaba entre o DeepSeek V4 Pro e o Gemini 3.5 Flash, mas a nota do Artificial Analysis ainda não foi divulgada — e isso muda o cálculo de quem escolhe modelo.

Lançamentos

Gemini 3.5 Flash chega a US$ 9 por milhão, a 1 ponto do Pro

Multimodal, com 1 milhão de contexto e raciocínio habilitado. Dentro da casa da Google é o mais barato acima de IQ 45 — mas o DeepSeek V4 Pro cobra 5 vezes menos por IQ quase igual.

Análise

Qwen3.6 Flash custa US$ 1,125 por milhão de saída, mas sem nota de IQ

Modelo da Alibaba aceita vídeo e tem 1M de contexto, mas o catálogo não publicou benchmark nenhum — nem IQ, nem código, nem agentic.

Análise

MiMo-V2.5-Pro custa 17 vezes menos que Claude Sonnet 4.6 e lidera em inteligência

Mesmo assim, o Sonnet mantém dois trunfos que o modelo chinês ainda não entrega.

Retrospectiva

Dois lançamentos no mesmo dia, cem vezes de diferença de preço

Perceptron Mk1 a US$ 1,50 e Claude Opus 4.7 Fast a US$ 150 estrearam juntos em 12 de maio. O resto do catálogo não se mexeu.

Análise

Qwen3.6 35B A3B chega sem benchmark e cobra US$ 0,90 por milhão

Multimodal open-weight da Alibaba Cloud tem 35B parâmetros, 3B ativos por token e 262 mil de contexto — só que a régua de IQ ainda não foi publicada.

Análise

Qwen3.6 Max Preview cobra US$ 6 por milhão de saída e chega sem nota de IQ

Modelo da Alibaba com 1 trilhão de parâmetros entra no catálogo como preview caro, sem benchmark publicado e contra três concorrentes que custam até sete vezes menos para gerar texto.

Análise

MiMo-V2.5-Pro cobra US$ 0,87 por milhão de saída; Grok 4.3, US$ 2,50

Mesmo recorte de raciocínio, dois preços. O chinês da Xiaomi entrega 18% mais IQ por token e abre os pesos; o americano da SpaceXAI é multimodal e quase três vezes mais rápido.

Análise

DeepSeek V4 Flash free: o que o preço zero esconde

Modelo gratuito da DeepSeek tem 1M de contexto e 284B de parâmetros, mas o catálogo não publica benchmark. Para quem ele serve — e quando fugir.

Análise

MiMo-V2.5-Pro custa US$ 0,87 e bate Qwen3.6 27B em quase tudo

Comparativo frente a frente entre dois modelos chineses open-weight lançados em abril de 2026: quem entrega mais por menos token de saída?

Análise

DeepSeek V4 Pro custa metade do preço do Qwen3.6 27B no token de saída

Dois modelos chineses open-weights lançados com três dias de diferença em abril. A economia do input barato do Qwen evapora quando a geração entra na conta — e o DeepSeek ainda é 7,5 pontos mais inteligente.

Análise

Um trilhão de parâmetros por zero dólares: vale o quê?

A inclusionAI abriu um modelo de 1T como grátis — mas sem benchmark, sem preço pago e sem país declarado, o que se leva para casa de fato?

Análise

Tencent Hy3 preview: o que dá para tirar de um modelo gratuito da Tencent

Tem 21 dias, é gratuito e tem 262 mil tokens de contexto — mas não tem nota de inteligência publicada e não diz de que país vem.

Análise

DeepSeek V4 Pro custa 6x mais que MiMo-V2.5 — vale a diferença?

Dois modelos chineses lançados em abril de 2026 disputam o mesmo terreno: raciocínio forte, pesos abertos e preços em escala industrial. Um deles entrega mais IQ por dólar.

Lançamentos

Anthropic cobra 6x por velocidade no Opus 4.7 Fast

A variante rápida do modelo mais caro da casa custa US$ 150 por milhão de tokens de saída — e chega sem nota de inteligência no catálogo.

← anteriores página 13 de 38 próximas →