FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Gemma 4 26B A4B chega a US$ 0,34/M com pesos abertos — 35x mais barato que o Gemini Pro

Google lança modelo MoE com 3,8B de parâmetros ativos por token. Preço muda o jogo na faixa de baixo custo, mas o índice de inteligência mostra o tamanho da distância até o topo.

Redação FalaVIP IA 3 min de leitura
US$ 0,34por milhão de tokens de saída
3,8B / 25,2Bparâmetros ativos por token / total
IQ 26,066vs 47,738 do Gemini 3.1 Pro Preview

O mesmo criador, preços 35x diferentes

A Google colocou no ar hoje o Gemma 4 26B A4B IT, e o número que chama atenção não é o do índice de inteligência — é o da fatura. O modelo sai a US$ 0,07 por milhão de tokens de entrada e US$ 0,34 por milhão de tokens de saída. O Gemini 3.1 Pro Preview, da mesma Google, cobra US$ 12 por milhão de saída. Trinta e cinco vezes mais caro, mesmo criador.

Preço de saída (US$ por milhão de tokens)
Gemma 4 26B A4B 0,34Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

A pergunta que fica: por que pagar 35x mais? A resposta está no que cada um entrega.

O truque do MoE em números

O Gemma 4 26B A4B tem 25,2 bilhões de parâmetros totais, mas só 3,8 bilhões são ativados por token durante a inferência. É a arquitetura Mixture-of-Experts fazendo o que promete: você carrega o modelo grande, mas só paga o custo computacional de um modelo pequeno. A descrição oficial fala em qualidade próxima a um modelo de 31B — com o custo de um bem menor.

Ficha técnica — Gemma 4 26B A4B
CampoValor
Identificadorgoogle/gemma-4-26b-a4b-it
Criadorgoogle
Preço de entradaUS$ 0.070 / M tokens
Preço de saídaUS$ 0.340 / M tokens
Janela de contexto262k
Modalidadetext+image+video->text
Índice de inteligência (AA)26.1
Índice de código39.3
Índice agêntico11.0
Parâmetros25.2B (3.8B ativos por token)
Pesosabertos
Raciocíniosim (gasta tokens de saída pensando)

Os pesos são abertos. Isso significa que você pode baixar, hospedar em infraestrutura própria e fazer fine-tuning sem depender da API da Google. Para quem roda volume alto, isso muda a equação de custo fixo versus variável de um jeito que nenhum modelo fechado nessa faixa de preço costuma oferecer.

O modelo também é multimodal na entrada: aceita texto, imagem e vídeo, e devolve só texto. Contexto de 262K tokens.

Onde ele não chega

O índice de inteligência Artificial Analysis marca o Gemma 4 26B A4B em 26,066. O Gemini 3.1 Pro Preview está em 47,738. O GPT-5.3-Codex, da OpenAI, em 45,512. A diferença não é de nuance — é quase o dobro.

Índice de inteligência (Artificial Analysis)
Gemma 4 26B A4B 26,1Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis

Em codificação, o Gemma marca 39,316. Em tarefas agentic, cai para 11,036. Esse último número é o que importa para quem está construindo agentes: o Gemma 4 26B A4B não foi feito para encadear ferramentas, tomar decisões autônomas ou manter coerência em fluxos longos com várias etapas.

Inteligência × preço de saída
Gemma 4 26B A4B Gemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Gemma 4 26B A4B (o novo)26.10.070.34262k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

A versão gratuita no mesmo dia

Junto com a versão paga, a Google soltou o Gemma 4 26B A4B free. Mesma arquitetura, mesmo contexto de 262K tokens, preço zero. Para prototipar, testar prompts e validar casos de uso antes de colocar em produção, é o caminho sem custo.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Gemma 4 26B A4B (free)00262k

Para quem faz sentido — e para quem não

Se você roda classificação em massa, sumarização, extração de informação ou qualquer tarefa em que o volume de tokens domina a fatura e a qualidade "boa o suficiente" resolve, o Gemma 4 26B A4B entra como opção séria. Os pesos abertos permitem tirar a Google do meio e rodar onde for mais barato.

Se você precisa de raciocínio pesado, código complexo ou fluxos agentic confiáveis, o Gemini 3.1 Pro Preview continua sendo o mínimo da categoria — e os US$ 12 por milhão de saída são o preço de entrada.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
MiMo-V2-Omni35.92
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
Entre os 388 modelos disponíveis no catálogo nesta data.

O tabuleiro hoje

O catálogo tem 388 modelos listados, de 54 criadores diferentes. Nos últimos 30 dias, 35 modelos foram lançados. A Google acabou de colocar mais uma peça na faixa de baixo custo — dessa vez com a credencial MoE e pesos abertos, o que não é comum nessa faixa de preço.

A implicação é direta: se você vinha usando Gemini Pro para tarefas que não exigem o topo da inteligência, vale testar o Gemma 4 26B A4B. A economia na fatura pode ser de uma ordem de grandeza, e a queda de qualidade pode ser aceitável dependendo do caso.

Em uma frase

Se você roda tarefas de alto volume onde 'bom o suficiente' resolve, teste o Gemma 4 26B A4B antes de pagar Gemini Pro — a economia é de uma ordem de grandeza e os pesos abertos permitem tirar a Google do meio.

Perguntas frequentes

Gemma 4 26B A4B substitui o Gemini 3.1 Pro?

Não. O índice de inteligência do Gemma é 26,066, quase metade dos 47,738 do Gemini 3.1 Pro Preview. Em tarefas agentic, a diferença é ainda maior — 11,036 contra 15 do Pro. São modelos para perfis de uso diferentes.

Dá para rodar o Gemma 4 26B A4B localmente?

Sim, os pesos são abertos. Você pode hospedar em infraestrutura própria e fazer fine-tuning, o que muda a equação de custo para quem roda volume alto e quer tirar a API do meio.

Qual a diferença entre a versão paga e a free?

Mesma arquitetura e mesmo contexto de 262K tokens. A versão free tem preço zero; a paga custa US$ 0,07 por milhão de tokens de entrada e US$ 0,34 por milhão de saída.

Leia também