Gemma 4 26B gratuito tem 262 mil de contexto e nenhum benchmark publicado
É multimodal de imagem e vídeo, custa US$ 0 de entrada e saída, e a Google não publicou índice de inteligência, coding nem agentic.
A Google tem hoje dois produtos com o mesmo sobrenome em lados opostos da vitrine. De um lado, o Gemini 3.1 Pro Preview comanda o topo do catálogo, com IQ 47,7 e preço de US$ 12 por milhão de tokens de saída. Do outro, a mesma empresa oferece, há duas semanas, o Gemma 4 26B A4B com a tag free — entrada zero, saída zero, cache nem publicado. Vale quanto um modelo que custa nada?
O pacote do "free": o que está dentro
O Gemma 4 26B A4B é um MoE — mixture of experts — com 25,2 bilhões de parâmetros no total, mas só 3,8 bilhões ativos por token. Pense num restaurante com 25 chefs no quadro, dos quais 4 cozinham seu prato de cada vez: a cozinha roda mais barata, e o cliente mal percebe. A descrição oficial da Google fala em "qualidade próxima de 31B" justamente por causa dessa arquitetura.
Os outros números da ficha são menos ambíguos. A janela de contexto é de 262.144 tokens — espaço de sobra para uma codebase inteira, um PDF de 600 páginas ou um vídeo longo em uma única chamada. E a modalidade é texto + imagem + vídeo → texto: o modelo entende vídeo no input, mas devolve só texto. Aceitar multimodal já não é mais diferencial — é o piso da nova geração.
O silêncio dos benchmarks
Pareceu interessante até você abrir a ficha de qualidade. Índice de inteligência? Não publicado. Coding? Não publicado. Agentic? Não publicado. A Google DeepMind não disponibilizou nenhuma das três notas que o catálogo costuma usar para ordenar modelos.
Em 17 de abril de 2026, o catálogo soma 392 modelos de 54 criadores, com 19 novidades só nos últimos 30 dias. Os cinco mais bem medidos formam um ranking claro: Gemini 3.1 Pro Preview (47,7), GPT-5.3-Codex (45,5), MiMo-V2-Omni (35,8), Claude Sonnet 4.6 (35,1) e Qwen3.5 397B A17B (34,2). Os únicos dois acima de IQ 45 custam US$ 12 e US$ 14 por milhão de tokens de saída, respectivamente. E o Gemma 4, sem nota, fica numa prateleira separada: a dos "use por sua conta e risco".
Para quem o grátis faz sentido
Três perfis se dão bem com o Gemma 4 free:
- Prototipagem e demo. Quer mostrar um produto multimodal com vídeo no input sem abrir a carteira? Coloque o Gemma 4 e itere à vontade, ajustando prompt e arquitetura até virar negócio.
- Aprendizado e experimentação. Para entender como um MoE se comporta na prática, ou para estressar pipelines longos com 262 mil tokens, sem medo da fatura no fim do mês.
- Workloads de baixo risco. Classificação simples, extração de texto, transcrição, resumos descartáveis. O custo de errar é baixo, e o volume de chamadas pode ser enorme — é aqui que US$ 0 por milhão pesa de verdade.
Para quem o grátis não muda nada
Se você roda um agente em produção que depende de tool-use consistente, a ausência de nota agentic pesa. Sem números publicados, você está apostando na arquitetura em vez de comprar previsibilidade. Para workloads pagos que rodam em Gemini 3.1 Pro ou GPT-5.3-Codex, a própria fatura é a melhor defesa: a economia vem de onde a qualidade é importante, não de onde ela é descartável.
E se você precisa gerar imagem, áudio ou vídeo na saída, o Gemma 4 devolve só texto. Não substitui os modelos generativos multimodais.
O que fazer com isso hoje
Trate o Gemma 4 26B A4B free como caixa de areia, não como motor de produção. Use o contexto gigante para testar limites que você não testaria em um modelo pago. Antes de mover qualquer fluxo crítico para a versão gratuita, extraia amostras do seu workload real e compare lado a lado com o que você já paga. Se a diferença for marginal, economiza. Se não for, paga — porque o custo de pagar é menor que o custo de errar.
| Campo | Valor |
|---|---|
| Identificador | google/gemma-4-26b-a4b-it:free |
| Criador | |
| Preço de entrada | US$ 0.000 / M tokens |
| Preço de saída | US$ 0.000 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image+video->text |
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
Use o Gemma 4 26B free como caixa de areia: bom para prototipar multimodal e estressar 262 mil de contexto, ruim para mover produção crítica sem medir antes.
Perguntas frequentes
O Gemma 4 26B é realmente grátis na API?
Sim, o catálogo lista US$ 0 por milhão de tokens de entrada e US$ 0 por milhão de tokens de saída. O preço de cache não foi publicado pelo provedor, então não há como comparar esse pedaço da conta.
Ele pode substituir o Gemini 3.1 Pro?
Não. São produtos diferentes: o Gemini 3.1 Pro Preview é o modelo de topo do catálogo (IQ 47,7, US$ 12/M de saída). O Gemma 4 free não tem índice de inteligência, nota de coding ou de agentic publicada, então não entra na mesma régua de comparação.
Quando vale usar o Gemma 4 free em vez de um modelo pago?
Para prototipagem, demos, aprendizado de MoE e workloads de baixo risco, onde o custo de errar é baixo e o volume de chamadas é alto. Para agentes em produção, geração multimodal na saída ou tarefas críticas, a economia não compensa o risco de operar no escuro.