FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Gemma 4 26B gratuito tem 262 mil de contexto e nenhum benchmark publicado

É multimodal de imagem e vídeo, custa US$ 0 de entrada e saída, e a Google não publicou índice de inteligência, coding nem agentic.

Redação FalaVIP IA 3 min de leitura
US$ 0por milhão de tokens de entrada e de saída
262.144 tokensde janela de contexto
3,8 bilhõesde parâmetros ativos em 25,2B totais (MoE)

A Google tem hoje dois produtos com o mesmo sobrenome em lados opostos da vitrine. De um lado, o Gemini 3.1 Pro Preview comanda o topo do catálogo, com IQ 47,7 e preço de US$ 12 por milhão de tokens de saída. Do outro, a mesma empresa oferece, há duas semanas, o Gemma 4 26B A4B com a tag free — entrada zero, saída zero, cache nem publicado. Vale quanto um modelo que custa nada?

O pacote do "free": o que está dentro

O Gemma 4 26B A4B é um MoE — mixture of experts — com 25,2 bilhões de parâmetros no total, mas só 3,8 bilhões ativos por token. Pense num restaurante com 25 chefs no quadro, dos quais 4 cozinham seu prato de cada vez: a cozinha roda mais barata, e o cliente mal percebe. A descrição oficial da Google fala em "qualidade próxima de 31B" justamente por causa dessa arquitetura.

Os outros números da ficha são menos ambíguos. A janela de contexto é de 262.144 tokens — espaço de sobra para uma codebase inteira, um PDF de 600 páginas ou um vídeo longo em uma única chamada. E a modalidade é texto + imagem + vídeo → texto: o modelo entende vídeo no input, mas devolve só texto. Aceitar multimodal já não é mais diferencial — é o piso da nova geração.

O silêncio dos benchmarks

Pareceu interessante até você abrir a ficha de qualidade. Índice de inteligência? Não publicado. Coding? Não publicado. Agentic? Não publicado. A Google DeepMind não disponibilizou nenhuma das três notas que o catálogo costuma usar para ordenar modelos.

Em 17 de abril de 2026, o catálogo soma 392 modelos de 54 criadores, com 19 novidades só nos últimos 30 dias. Os cinco mais bem medidos formam um ranking claro: Gemini 3.1 Pro Preview (47,7), GPT-5.3-Codex (45,5), MiMo-V2-Omni (35,8), Claude Sonnet 4.6 (35,1) e Qwen3.5 397B A17B (34,2). Os únicos dois acima de IQ 45 custam US$ 12 e US$ 14 por milhão de tokens de saída, respectivamente. E o Gemma 4, sem nota, fica numa prateleira separada: a dos "use por sua conta e risco".

Para quem o grátis faz sentido

Três perfis se dão bem com o Gemma 4 free:

  • Prototipagem e demo. Quer mostrar um produto multimodal com vídeo no input sem abrir a carteira? Coloque o Gemma 4 e itere à vontade, ajustando prompt e arquitetura até virar negócio.
  • Aprendizado e experimentação. Para entender como um MoE se comporta na prática, ou para estressar pipelines longos com 262 mil tokens, sem medo da fatura no fim do mês.
  • Workloads de baixo risco. Classificação simples, extração de texto, transcrição, resumos descartáveis. O custo de errar é baixo, e o volume de chamadas pode ser enorme — é aqui que US$ 0 por milhão pesa de verdade.

Para quem o grátis não muda nada

Se você roda um agente em produção que depende de tool-use consistente, a ausência de nota agentic pesa. Sem números publicados, você está apostando na arquitetura em vez de comprar previsibilidade. Para workloads pagos que rodam em Gemini 3.1 Pro ou GPT-5.3-Codex, a própria fatura é a melhor defesa: a economia vem de onde a qualidade é importante, não de onde ela é descartável.

E se você precisa gerar imagem, áudio ou vídeo na saída, o Gemma 4 devolve só texto. Não substitui os modelos generativos multimodais.

O que fazer com isso hoje

Trate o Gemma 4 26B A4B free como caixa de areia, não como motor de produção. Use o contexto gigante para testar limites que você não testaria em um modelo pago. Antes de mover qualquer fluxo crítico para a versão gratuita, extraia amostras do seu workload real e compare lado a lado com o que você já paga. Se a diferença for marginal, economiza. Se não for, paga — porque o custo de pagar é menor que o custo de errar.

Ficha técnica — Gemma 4 26B A4B (free)
CampoValor
Identificadorgoogle/gemma-4-26b-a4b-it:free
Criadorgoogle
Preço de entradaUS$ 0.000 / M tokens
Preço de saídaUS$ 0.000 / M tokens
Janela de contexto262k
Modalidadetext+image+video->text
O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 392 modelos disponíveis no catálogo nesta data.
Em uma frase

Use o Gemma 4 26B free como caixa de areia: bom para prototipar multimodal e estressar 262 mil de contexto, ruim para mover produção crítica sem medir antes.

Perguntas frequentes

O Gemma 4 26B é realmente grátis na API?

Sim, o catálogo lista US$ 0 por milhão de tokens de entrada e US$ 0 por milhão de tokens de saída. O preço de cache não foi publicado pelo provedor, então não há como comparar esse pedaço da conta.

Ele pode substituir o Gemini 3.1 Pro?

Não. São produtos diferentes: o Gemini 3.1 Pro Preview é o modelo de topo do catálogo (IQ 47,7, US$ 12/M de saída). O Gemma 4 free não tem índice de inteligência, nota de coding ou de agentic publicada, então não entra na mesma régua de comparação.

Quando vale usar o Gemma 4 free em vez de um modelo pago?

Para prototipagem, demos, aprendizado de MoE e workloads de baixo risco, onde o custo de errar é baixo e o volume de chamadas é alto. Para agentes em produção, geração multimodal na saída ou tarefas críticas, a economia não compensa o risco de operar no escuro.

Leia também