FalaVIP IA sexta-feira, 04 de setembro de 2026
2026-09 (22)2026-08 (96)2026-07 (57)2026-06 (52)2026-05 (58)2026-04 (57)2026-03 (61)2026-02 (55)2026-01 (59)2025-12 (61)2025-11 (59)2025-10 (56)2025-09 (58)

Arquivo — 2026-04

57 reportagens neste mês.

Análise

Lyria 3 Clip Preview cobra por música, não por token — e isso muda a conta

Modelo de áudio do Google sai do preço por milhão de tokens e entra no preço por clipe de 30 segundos. Para quem usa, a comparação com Lyria 2 e com Suno deixa de ser óbvia.

Análise

MiMo-V2-Pro custa 50% mais que o Omni sem publicar IQ

Modelo agentic da Xiaomi entra no catálogo há 21 dias com 1 trilhão de parâmetros e contexto de 1 milhão — mas sem nota de inteligência publicada

Análise

Mesma fatura, 7x menos tokens: Qwen 3.5 397B vs Gemma 4 31B

Qwen ganha em qualidade e velocidade; Gemma custa quase sete vezes menos e tem cache publicado. O caso de uso decide qual vale a pena.

Lançamentos

GLM 5.1 da Z.ai sai a um quarto do preço do Codex

Catálogo lista o modelo a US$ 3 por milhão de tokens de saída, mas sem nota de inteligência publicada — você está comprando o release, não a régua.

Lançamentos

GLM 5.1 da Z.ai entra a US$ 3 por milhão; falta o IQ

Modelo focado em agente de código chega a um quarto do preço do Gemini Pro e do GPT-5.3-Codex, mas sem nota de inteligência publicada no catálogo.

Análise

Claude Sonnet 4.6 vs Gemma 4 31B: 44x mais caro na saída

A diferença de preço é absurda, mas contexto de 1M tokens, raciocínio configurável e pesos abertos mudam o cálculo — veja quando cada um vence.

Análise

Modelo grátis da MiniMax tem 196K de contexto — e o resto é silêncio

Lançado em março sem preço e sem benchmark, o M2.7 só entrega uma coisa óbvia: zero na fatura. Vale para quem está testando, não para quem está produzindo.

Retrospectiva

Google soltou 7 modelos em 7 dias; o mais barato sai a US$ 0,34/M

A conta da API não caiu nesta semana, mas o piso de preço do catálogo mudou — o Gemma 4 31B a US$ 0,34/M redefine o que cabe no orçamento mensal.

Análise

Trinity Large Thinking cobra US$ 0,80 por milhão e tropeça em agente

Modelo aberto da Arcee AI é o mais rápido entre os pares comparáveis, mas o agentic score de 3,7 desmente o nome e cobra caro por isso.

Análise

MiMo-V2-Omni cobra 6 vezes mais caro que o Gemma 4 31B

Omni-modal da Xiaomi entrega mais inteligência, mas o modelo aberto do Google cobra US$ 0,34 por milhão de tokens de saída.

Análise

Gemma 4 26B A4B custa o mesmo que a irmã 31B — e entrega menos

O MoE 26B A4B saiu um dia depois do Gemma 4 31B densa. Mesma fatura de saída, menos IQ, menos coding. A estratégia da Google parece clara — mas o preço não ajuda o usuário.

Análise

Gemma 4 31B custa US$ 0,34 por milhão de tokens de saída

Modelo aberto do Google estreia com multimodal nativo e preço de entrada, mas fica longe do topo de inteligência.

Lançamentos

Gemma 4 26B A4B chega a US$ 0,34/M com pesos abertos — 35x mais barato que o Gemini Pro

Google lança modelo MoE com 3,8B de parâmetros ativos por token. Preço muda o jogo na faixa de baixo custo, mas o índice de inteligência mostra o tamanho da distância até o topo.

Lançamentos

Qwen3.6 Plus chega a US$ 1,95 por milhão de saída e mira o meio do mercado

Modelo multimodal da Alibaba entra no catálogo com preço de token entre os menores do topo, mas sem índice de inteligência publicado

Lançamentos

Gemma 4 31B custa 35 vezes menos que Gemini 3.1 Pro Preview

Google libera hoje um modelo aberto multimodal de 30,7B parâmetros com preço de saída de US$ 0,34 por milhão de tokens — e abre uma versão gratuita.

Lançamentos

GLM 5V Turbo a US$ 4 por milhão, mas sem benchmark de inteligência

Modelo da Z.ai é o primeiro multimodal nativo da empresa e custa um terço do Gemini 3.1 Pro — só que o catálogo não publicou índice de inteligência para comparar.

Lançamentos

Arcee AI lança Trinity Large Thinking por US$ 0,80 por milhão de saída

Modelo de raciocínio aberto, com 399B de parâmetros e 13B ativos, mira custo baixo — mas fica bem abaixo do topo em inteligência.

← anteriores página 3 de 3