FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (17)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-04

57 reportagens neste mês.

Lançamentos

Kimi K2.6 chega cobrando US$ 4 por milhão de saída — e abre família gratuita

MoonshotAI lança o K2.6 multimodal focado em coding longo e multi-agente, com variante gratuita no mesmo dia. O preço de saída cabe entre o MiMo da Xiaomi e o Gemini Pro da Google.

Análise

Opus 4.6 Fast custa 6x mais caro e o catálogo não mediu o IQ

Anthropic lança variante rápida do Opus 4.6 com preço premium, sem benchmark de inteligência e concorrendo com Gemini 3.1 Pro e GPT-5.3-Codex no topo.

Retrospectiva

Semana de um lançamento só: Anthropic coloca Opus 4.7 no catálogo

O catálogo fechou a semana com 392 modelos e nenhum corte de preço — só a Anthropic mexeu, duas vezes, no mesmo produto.

Análise

Gemma 4 custa 14× menos que Haiku 4.5 por milhão de tokens

O Gemma 4 é multimodal com vídeo, mais barato e tem pesos abertos. O Haiku 4.5 cobra quase 15× mais, mas entrega quase 50% a mais em agentic — vale para fluxos longos.

Análise

GLM 5.1 mira coding longo a US$ 3 por milhão, sem score público

Lançado há onze dias pela Z.ai, o modelo entra no catálogo vazio de IQ, coding e agentic score — só com descrição ambiciosa e cache entre os mais baratos.

Análise

Gemma 4 26B gratuito tem 262 mil de contexto e nenhum benchmark publicado

É multimodal de imagem e vídeo, custa US$ 0 de entrada e saída, e a Google não publicou índice de inteligência, coding nem agentic.

Análise

Mesmo QI, conta 15 vezes menor no embate Haiku 4.5 e Gemma 4 31B

Os dois modelos entregam inteligência praticamente idêntica, mas cobram preços em universos distintos — e cada um abre portas que o outro não abre.

Análise

Gemma 4 31B batch custa centavos e abre 256K de contexto

Modelo da Google chega em modo assíncrono com preço de fundo de poço — mas sem nota de inteligência publicada, ele vira coringa só para quem sabe o que está comprando.

Análise

Gemma 4 31B é grátis, mas o catálogo não mediu seu QI

Trinta bilhões de parâmetros do Google DeepMind, 256K de contexto e multimodalidade — sem benchmark público e sem nota de inteligência para comparar.

Análise

o3 cobra US$ 8 por milhão; Gemma 4 26B cobra US$ 0,34 — vale a troca?

Comparativo frente a frente mostra uma diferença de 23x no preço de saída e 5 pontos de IQ entre os dois modelos da OpenAI e do Google.

Análise

o3 cobra 23 vezes mais que o Gemma 4 31B por 4,5% de IQ

O Gemma 4 31B não vence só no preço — também abre vídeo, libera os 30,7 bilhões de parâmetros para download e estica a janela de contexto. O o3 só leva a melhor quando o ser humano está esperando o próximo token.

Análise

o3 um ano depois: ainda vale pagar 23× o preço do Gemma 4 31B?

Veterano da OpenAI cobra US$ 8 por milhão de tokens de saída; o modelo de 30,7B do Google, lançado há doze dias, cobra US$ 0,34 e devolve a diferença em janela de contexto, multimodalidade e pesos abertos.

Análise

Qwen 122B é 26% mais inteligente que Gemma 26B — e custa 7x mais

Dois modelos abertos e multimodais disputam o meio do mercado em abril de 2026. O chinês leva em código e agente; o americano, em volume barato.

Análise

GLM 5V Turbo chegou há 12 dias e ainda não publicou nenhum benchmark

Z.ai diz que é o primeiro modelo agente multimodal nativo. A pergunta é se os US$ 4 por milhão de saída compensam a ausência de nota de IQ.

Retrospectiva

Dois lançamentos no mesmo dia, 50 vezes de distância no preço

Z.ai publicou GLM 5.1 a US$ 3 por milhão de tokens de saída; Anthropic respondeu com Claude Opus 4.6 Fast a US$ 150 em 7 de abril.

Análise

Grok 4.20 Multi-Agent cobra US$ 2,50 por milhão, mas não tem IQ publicado

Lançado há 12 dias pela SpaceXAI, o modelo chega como peça de orquestração agentic com preço competitivo, mas sem nota de inteligência, coding ou agentic no catálogo atual.

Análise

Gemma 4 31B custa 7 vezes menos que Qwen3.5-122B na saída

Dois modelos abertos multimodal com a mesma janela de 256K, mas preços e perfis de uso bem diferentes.

Análise

Grok 4.20 cobra US$ 4,40 por milhão de saída — vale sem nota de IQ?

SpaceXAI promete o modelo mais rápido e menos alucinador do mercado, mas o catálogo ainda não publicou índice de inteligência. Veja contra quem ele compete e quando não compensa.

Análise

Lyria 3 Pro Preview é grátis no catálogo — mas a conta vem em outra moeda

Google lança família de música no Gemini API com 1M de contexto e cobrança por faixa, não por token.

Análise

MiMo-V2-Flash e Gemma 4 26B A4B: dois MoE baratos que brigam por nichos diferentes

Ambos custam menos de US$ 0,40 por milhão de tokens de saída, mas o chinês da Xiaomi entrega mais raciocínio e o da Google entende imagem e vídeo.

← anteriores página 2 de 3 próximas →