FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Gemini Custom Tools cobra US$ 12/M e não publica benchmark

Variante do Gemini 3.1 Pro Preview, top-1 do IQ hoje. Sai pelo mesmo preço, mas sem score medido de código nem de agentic.

Redação FalaVIP IA 3 min de leitura
US$ 12por milhão de tokens de saída
US$ 0,20por milhão de tokens em cache
1.048.576tokens de contexto

5 dias depois do lançamento, a Google colocou no catálogo uma variante do Gemini 3.1 Pro Preview que cobra exatamente o mesmo que o pai — US$ 12 por milhão de tokens de saída, US$ 2 por milhão de entrada, US$ 0,20 por milhão de cache. Só que este aqui não tem IQ publicado, nem benchmark de código, nem de agentic, nem score blended. Você paga o preço de topo do mercado e leva... uma promessa de comportamento.

Lançada em 25 de fevereiro, a Custom Tools é descrita pela Google como uma versão do Gemini 3.1 Pro que "melhora a seleção de ferramentas evitando o uso excessivo do bash geral quando há ferramentas de terceiros mais eficientes". Traduzindo: o modelo parou de tentar resolver tudo no terminal e passou a escolher a ferramenta certa para cada tarefa.

O que muda na prática (e o que não muda)

A conta é idêntica à do Gemini 3.1 Pro Preview "padrão". Mesma janela de contexto de 1.048.576 tokens, mesma multimodalidade completa — texto, imagem, arquivo, áudio e vídeo na entrada; só texto na saída. Mesma precificação, com um detalhe que pesa em agentic loops: o cache de contexto sai por US$ 0,20 o milhão, dez vezes mais barato que o input.

Ficha técnica — Gemini 3.1 Pro Preview Custo
CampoValor
Identificadorgoogle/gemini-3.1-pro-preview-customtools
Criadorgoogle
Preço de entradaUS$ 2.00 / M tokens
Preço de saídaUS$ 12.00 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file+audio+video->text
Leitura de cacheUS$ 0.200 / M (90% de desconto)

Numa execução típica de agente, em que o system prompt e a lista de ferramentas ficam sendo reenviados a cada turno, esse cache é onde mora a economia real. Se você repete 1 milhão de tokens de prompt em cem chamadas, são US$ 20 — uma fração do que pagaria sem cache.

O que muda, então, é a política de escolha. O modelo pai é o atual líder de IQ no catálogo (47,738 na medição atual do índice, mesmo método usado para todos os outros modelos listados), e a Custom Tools herda a base. Mas a Google não republicou os números desta variante. Você está pagando o preço do líder e apostando que a alteração de comportamento não derrubou a régua — coisa que ninguém mediu e publicou até agora.

Para quem vale (e para quem é indiferente)

Se você está montando um agente com uma dúzia de ferramentas de terceiros — busca, SQL, navegador, calendário, e-mail, Jira, GitHub — e nota que o modelo queima budget usando bash quando havia uma chamada específica que custava menos e entregava mais, esta variante foi feita para esse caso. É um ajuste fino de UX da camada de raciocínio.

Para quem está só chamando o modelo para gerar texto, resumir PDF ou responder chat, não muda nada. Pegue o Gemini 3.1 Pro Preview normal e gaste o token que economiza; o diferencial desta versão é invisível fora de fluxos agentic.

E para quem precisa de benchmark antes de escolher, este não é o lugar: vá de Sonnet 4.6 (IQ 35,108, US$ 15/M saída) ou do próprio Gemini 3.1 Pro padrão, que têm número medido. A Custom Tools entra na conta como aposta — não cega, mas como variante que precisa de teste A/B no seu workload específico antes de virar default.

O tabuleiro em 2 de março

O catálogo passa de 350 modelos listados hoje, vindos de 52 criadores. Nos últimos 30 dias, foram 24 lançamentos — o ritmo não parou. No topo do índice de inteligência hoje, a ordem é Google (47,738 / US$ 12/M), OpenAI (45,512 / US$ 14/M), Anthropic (35,108 / US$ 15/M), Qwen (34,262 / US$ 2,34/M) e Xiaomi (34,024 / US$ 0,30/M).

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
GPT-5.3-Codex45.514
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
Entre os 350 modelos disponíveis no catálogo nesta data.

Repare em Qwen3.5 397B A17B e MiMo-V2-Flash: custam uma fração do top-3 e entregam IQ na casa de 34, contra 47 do líder. Para a maioria dos casos de uso, eles são a resposta racional — não em qualidade absoluta, mas em IQ por dólar. A Custom Tools só entra na conta se você já decidiu que precisa do Gemini 3.1 Pro E tem um problema específico de escolha de ferramenta que o padrão não resolve.

O que fazer agora

Se você roda agente em produção, crie dois ambientes idênticos — um com Gemini 3.1 Pro Preview padrão, outro com a Custom Tools —, coloque as mesmas ferramentas e meça duas coisas: (1) quantas vezes cada modelo cai no bash genérico em vez da ferramenta dedicada, e (2) o custo total por tarefa concluída. Se a Custom Tools reduzir o uso de bash e mantiver (ou melhorar) a taxa de sucesso, a conta fecha no fim do mês. Se não, você fica com o pai — que tem número, é o líder, e custa a mesma coisa.

Em uma frase

Só vale o teste A/B se você roda agente com várias ferramentas; fora disso, fique com o Gemini 3.1 Pro padrão, que tem benchmark e custa o mesmo.

Perguntas frequentes

Qual a diferença entre Gemini 3.1 Pro Preview e a versão Custom Tools?

A Custom Tools ajusta o comportamento de seleção de ferramentas para evitar o uso excessivo do bash genérico quando há ferramentas de terceiros mais eficientes. A base do modelo, o preço e a janela de contexto são os mesmos da versão padrão.

Quanto custa a Gemini 3.1 Pro Preview Custom Tools?

US$ 2 por milhão de tokens de entrada, US$ 12 por milhão de tokens de saída e US$ 0,20 por milhão em cache de contexto — tabela idêntica à do Gemini 3.1 Pro Preview padrão.

Quando a Custom Tools não vale a pena?

Para qualquer uso fora de fluxos agentic com várias ferramentas — geração de texto, resumo, Q&A — o diferencial é invisível. Use o Gemini 3.1 Pro padrão e gaste a economia em outro lugar.

Leia também