Gemma 4 26B A4B chega a US$ 0,34/M com pesos abertos — 35x mais barato que o Gemini Pro
Google lança modelo MoE com 3,8B de parâmetros ativos por token. Preço muda o jogo na faixa de baixo custo, mas o índice de inteligência mostra o tamanho da distância até o topo.
O mesmo criador, preços 35x diferentes
A Google colocou no ar hoje o Gemma 4 26B A4B IT, e o número que chama atenção não é o do índice de inteligência — é o da fatura. O modelo sai a US$ 0,07 por milhão de tokens de entrada e US$ 0,34 por milhão de tokens de saída. O Gemini 3.1 Pro Preview, da mesma Google, cobra US$ 12 por milhão de saída. Trinta e cinco vezes mais caro, mesmo criador.
A pergunta que fica: por que pagar 35x mais? A resposta está no que cada um entrega.
O truque do MoE em números
O Gemma 4 26B A4B tem 25,2 bilhões de parâmetros totais, mas só 3,8 bilhões são ativados por token durante a inferência. É a arquitetura Mixture-of-Experts fazendo o que promete: você carrega o modelo grande, mas só paga o custo computacional de um modelo pequeno. A descrição oficial fala em qualidade próxima a um modelo de 31B — com o custo de um bem menor.
| Campo | Valor |
|---|---|
| Identificador | google/gemma-4-26b-a4b-it |
| Criador | |
| Preço de entrada | US$ 0.070 / M tokens |
| Preço de saída | US$ 0.340 / M tokens |
| Janela de contexto | 262k |
| Modalidade | text+image+video->text |
| Índice de inteligência (AA) | 26.1 |
| Índice de código | 39.3 |
| Índice agêntico | 11.0 |
| Parâmetros | 25.2B (3.8B ativos por token) |
| Pesos | abertos |
| Raciocínio | sim (gasta tokens de saída pensando) |
Os pesos são abertos. Isso significa que você pode baixar, hospedar em infraestrutura própria e fazer fine-tuning sem depender da API da Google. Para quem roda volume alto, isso muda a equação de custo fixo versus variável de um jeito que nenhum modelo fechado nessa faixa de preço costuma oferecer.
O modelo também é multimodal na entrada: aceita texto, imagem e vídeo, e devolve só texto. Contexto de 262K tokens.
Onde ele não chega
O índice de inteligência Artificial Analysis marca o Gemma 4 26B A4B em 26,066. O Gemini 3.1 Pro Preview está em 47,738. O GPT-5.3-Codex, da OpenAI, em 45,512. A diferença não é de nuance — é quase o dobro.
Em codificação, o Gemma marca 39,316. Em tarefas agentic, cai para 11,036. Esse último número é o que importa para quem está construindo agentes: o Gemma 4 26B A4B não foi feito para encadear ferramentas, tomar decisões autônomas ou manter coerência em fluxos longos com várias etapas.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Gemma 4 26B A4B (o novo) | 26.1 | 0.07 | 0.34 | 262k |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| MiMo-V2-Omni | 35.9 | 0.4 | 2 | 262k |
A versão gratuita no mesmo dia
Junto com a versão paga, a Google soltou o Gemma 4 26B A4B free. Mesma arquitetura, mesmo contexto de 262K tokens, preço zero. Para prototipar, testar prompts e validar casos de uso antes de colocar em produção, é o caminho sem custo.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Gemma 4 26B A4B (free) | 0 | 0 | 262k |
Para quem faz sentido — e para quem não
Se você roda classificação em massa, sumarização, extração de informação ou qualquer tarefa em que o volume de tokens domina a fatura e a qualidade "boa o suficiente" resolve, o Gemma 4 26B A4B entra como opção séria. Os pesos abertos permitem tirar a Google do meio e rodar onde for mais barato.
Se você precisa de raciocínio pesado, código complexo ou fluxos agentic confiáveis, o Gemini 3.1 Pro Preview continua sendo o mínimo da categoria — e os US$ 12 por milhão de saída são o preço de entrada.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| MiMo-V2-Omni | 35.9 | 2 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
O tabuleiro hoje
O catálogo tem 388 modelos listados, de 54 criadores diferentes. Nos últimos 30 dias, 35 modelos foram lançados. A Google acabou de colocar mais uma peça na faixa de baixo custo — dessa vez com a credencial MoE e pesos abertos, o que não é comum nessa faixa de preço.
A implicação é direta: se você vinha usando Gemini Pro para tarefas que não exigem o topo da inteligência, vale testar o Gemma 4 26B A4B. A economia na fatura pode ser de uma ordem de grandeza, e a queda de qualidade pode ser aceitável dependendo do caso.
Se você roda tarefas de alto volume onde 'bom o suficiente' resolve, teste o Gemma 4 26B A4B antes de pagar Gemini Pro — a economia é de uma ordem de grandeza e os pesos abertos permitem tirar a Google do meio.
Perguntas frequentes
Gemma 4 26B A4B substitui o Gemini 3.1 Pro?
Não. O índice de inteligência do Gemma é 26,066, quase metade dos 47,738 do Gemini 3.1 Pro Preview. Em tarefas agentic, a diferença é ainda maior — 11,036 contra 15 do Pro. São modelos para perfis de uso diferentes.
Dá para rodar o Gemma 4 26B A4B localmente?
Sim, os pesos são abertos. Você pode hospedar em infraestrutura própria e fazer fine-tuning, o que muda a equação de custo para quem roda volume alto e quer tirar a API do meio.
Qual a diferença entre a versão paga e a free?
Mesma arquitetura e mesmo contexto de 262K tokens. A versão free tem preço zero; a paga custa US$ 0,07 por milhão de tokens de entrada e US$ 0,34 por milhão de saída.