FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Gemma 4 31B custa 35 vezes menos que Gemini 3.1 Pro Preview

Google libera hoje um modelo aberto multimodal de 30,7B parâmetros com preço de saída de US$ 0,34 por milhão de tokens — e abre uma versão gratuita.

Redação FalaVIP IA 3 min de leitura
US$ 0,34por milhão de tokens de saída
30,7Bparâmetros densos
262.144tokens de contexto

O que está em jogo hoje

A conta da API é o que separa marketing de decisão. A Google soltou nesta quarta-feira (2) o Gemma 4 31B, um modelo de 30,7 bilhões de parâmetros, aberto, multimodal, com 262 mil tokens de contexto — e a primeira coisa que o desenvolvedor precisa olhar não é o release, é o preço: US$ 0,09 por milhão de tokens de entrada e US$ 0,34 por milhão de tokens de saída. Com cache, a entrada cai para US$ 0,05. Para colocar em perspectiva, o Gemini 3.1 Pro Preview da própria Google, que lidera o índice de inteligência hoje, cobra US$ 12 por milhão de tokens de saída. São 35 vezes mais caro no output.

Preço de saída (US$ por milhão de tokens)
Gemma 4 31B0,34Gemini 3.1 Pro Preview12GPT-5.3-Codex14MiMo-V2-Omni2US$/M
Fonte: OpenRouter

A linha completa do lançamento

A Google não soltou um modelo, soltou três variações da mesma arquitetura. A versão padrão é a google/gemma-4-31b-it, com os preços acima. Existe também a google/gemma-4-31b-it:free, sem cobrança — o que dá para testar antes de colocar em produção. E a google/gemma-4-31b-it:batch, voltada para processamento assíncrono em lote, que na verdade é mais cara (US$ 0,39 de entrada e US$ 0,97 de saída por milhão). É o oposto do que costuma acontecer: o batch costuma ser desconto, aqui é premium. Vale checar se a diferença de latência justifica, porque em volume grande a conta muda.

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Gemma 4 31B (batch)0.390.97262k
Gemma 4 31B (free)00262k

Onde o Gemma 4 31B se encaixa

O índice de inteligência do Gemma 4 31B hoje é 29,7. O Gemini 3.1 Pro Preview está em 47,7. A diferença existe e não é pequena — estamos falando de quase 18 pontos de distância. Em coding, o Gemma marca 43,4; em agentic, só 14,4. Ou seja: o modelo serve bem para tarefas de programação assistida, mas não é a escolha para fluxos agentic longos, onde o Sonnet 4.6 da Anthropic (15 no agentic) e o GPT-5.3-Codex da OpenAI ainda dominam. A velocidade reportada é 35 tokens por segundo, número modesto se comparado ao que se vê em modelos menores.

Índice de inteligência (Artificial Analysis)
Gemma 4 31B29,7Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5MiMo-V2-Omni35,9índice
Fonte: Artificial Analysis
Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Gemma 4 31B (o novo)29.70.090.34262k
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
MiMo-V2-Omni35.90.42262k
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale e para quem não muda nada

O Gemma 4 31B faz sentido se você precisa de multimodalidade barata — texto, imagem e vídeo como entrada, texto como saída — em um setup que aceite rodar ou consumir pesos abertos. É um caso forte para empresas que já têm infraestrutura de inferência e querem cortar a fatura da API proprietária. A versão :free é uma porta de entrada sem custo para prototipagem.

Não muda nada para quem já está no topo da cadeia. Se o seu produto depende de raciocínio agentic ou de coding de fronteira, o Gemini 3.1 Pro Preview e o GPT-5.3-Codex continuam sendo as referências. E se o seu gargalo é custo por inteligência pura, o scatter de custo-benefício mostra que o Gemma 4 está longe de ser o melhor negócio do catálogo — ele é barato, mas também é menos capaz.

Inteligência × preço de saída
Gemma 4 31BGemini 3.1 Pro PreviewGPT-5.3-CodexMiMo-V2-OmniUS$ por milhão (saída, escala log)índice de inteligência
Ficha técnica — Gemma 4 31B
CampoValor
Identificadorgoogle/gemma-4-31b-it
Criadorgoogle
Preço de entradaUS$ 0.090 / M tokens
Preço de saídaUS$ 0.340 / M tokens
Janela de contexto262k
Modalidadetext+image+video->text
Leitura de cacheUS$ 0.050 / M (44% de desconto)
Índice de inteligência (AA)29.7
Índice de código43.4
Índice agêntico14.4
Parâmetros30.7B (30.7B ativos por token)
Pesosabertos
Velocidade de saída35 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

O tabuleiro nesta data

O catálogo de modelos listados hoje passa de 386, com 54 criadores diferentes. Nos últimos 30 dias, 34 modelos foram lançados — e o ritmo não está diminuindo. O topo do índice continua com Google e OpenAI, mas a Xiaomi entrou no top 3 com o MiMo-V2-Omni, e a Qwen segue colocando modelos com boa relação custo-benefício. O Gemma 4 31B não disputa a ponta, mas ocupa um espaço que estava vazio: multimodal aberto, barato, com contexto longo.

O que fazer com isso

Se você roda um produto que consome milhões de tokens por mês em tarefas que não exigem raciocínio pesado, teste a versão :free do Gemma 4 31B hoje. Se o resultado segurar, a migração do Gemini Pro para Gemma 4 corta a conta de saída em 97%. Quem está no tier agentic ou coding de ponta continua onde está — o lançamento de hoje não muda o topo, muda o chão.

Em uma frase

Teste a versão free do Gemma 4 31B em fluxos de alto volume e baixa exigência de raciocínio; se passar, a economia sobre o Gemini Pro é de 97% no token de saída.

Perguntas frequentes

Quanto custa o Gemma 4 31B da Google?

US$ 0,09 por milhão de tokens de entrada e US$ 0,34 por milhão de tokens de saída. Com cache, a entrada cai para US$ 0,05. Há versão gratuita e versão batch (mais cara) no mesmo endpoint.

O Gemma 4 31B é melhor que o Gemini 3.1 Pro Preview?

Não. O índice de inteligência do Gemma 4 31B está em 29,7, contra 47,7 do Gemini 3.1 Pro Preview. O Gemma é multimodal e aberto; o Gemini Pro é a referência da própria Google em raciocínio e coding.

O Gemma 4 31B serve para coding e agentic?

Serve razoavelmente para coding assistido (nota 43,4), mas é fraco em agentic (14,4). Para fluxos agentic longos, o Claude Sonnet 4.6 e o GPT-5.3-Codex seguem como opções superiores.

Leia também