Gemini Custom Tools cobra US$ 12/M e não publica benchmark
Variante do Gemini 3.1 Pro Preview, top-1 do IQ hoje. Sai pelo mesmo preço, mas sem score medido de código nem de agentic.
5 dias depois do lançamento, a Google colocou no catálogo uma variante do Gemini 3.1 Pro Preview que cobra exatamente o mesmo que o pai — US$ 12 por milhão de tokens de saída, US$ 2 por milhão de entrada, US$ 0,20 por milhão de cache. Só que este aqui não tem IQ publicado, nem benchmark de código, nem de agentic, nem score blended. Você paga o preço de topo do mercado e leva... uma promessa de comportamento.
Lançada em 25 de fevereiro, a Custom Tools é descrita pela Google como uma versão do Gemini 3.1 Pro que "melhora a seleção de ferramentas evitando o uso excessivo do bash geral quando há ferramentas de terceiros mais eficientes". Traduzindo: o modelo parou de tentar resolver tudo no terminal e passou a escolher a ferramenta certa para cada tarefa.
O que muda na prática (e o que não muda)
A conta é idêntica à do Gemini 3.1 Pro Preview "padrão". Mesma janela de contexto de 1.048.576 tokens, mesma multimodalidade completa — texto, imagem, arquivo, áudio e vídeo na entrada; só texto na saída. Mesma precificação, com um detalhe que pesa em agentic loops: o cache de contexto sai por US$ 0,20 o milhão, dez vezes mais barato que o input.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-pro-preview-customtools |
| Criador | |
| Preço de entrada | US$ 2.00 / M tokens |
| Preço de saída | US$ 12.00 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.200 / M (90% de desconto) |
Numa execução típica de agente, em que o system prompt e a lista de ferramentas ficam sendo reenviados a cada turno, esse cache é onde mora a economia real. Se você repete 1 milhão de tokens de prompt em cem chamadas, são US$ 20 — uma fração do que pagaria sem cache.
O que muda, então, é a política de escolha. O modelo pai é o atual líder de IQ no catálogo (47,738 na medição atual do índice, mesmo método usado para todos os outros modelos listados), e a Custom Tools herda a base. Mas a Google não republicou os números desta variante. Você está pagando o preço do líder e apostando que a alteração de comportamento não derrubou a régua — coisa que ninguém mediu e publicou até agora.
Para quem vale (e para quem é indiferente)
Se você está montando um agente com uma dúzia de ferramentas de terceiros — busca, SQL, navegador, calendário, e-mail, Jira, GitHub — e nota que o modelo queima budget usando bash quando havia uma chamada específica que custava menos e entregava mais, esta variante foi feita para esse caso. É um ajuste fino de UX da camada de raciocínio.
Para quem está só chamando o modelo para gerar texto, resumir PDF ou responder chat, não muda nada. Pegue o Gemini 3.1 Pro Preview normal e gaste o token que economiza; o diferencial desta versão é invisível fora de fluxos agentic.
E para quem precisa de benchmark antes de escolher, este não é o lugar: vá de Sonnet 4.6 (IQ 35,108, US$ 15/M saída) ou do próprio Gemini 3.1 Pro padrão, que têm número medido. A Custom Tools entra na conta como aposta — não cega, mas como variante que precisa de teste A/B no seu workload específico antes de virar default.
O tabuleiro em 2 de março
O catálogo passa de 350 modelos listados hoje, vindos de 52 criadores. Nos últimos 30 dias, foram 24 lançamentos — o ritmo não parou. No topo do índice de inteligência hoje, a ordem é Google (47,738 / US$ 12/M), OpenAI (45,512 / US$ 14/M), Anthropic (35,108 / US$ 15/M), Qwen (34,262 / US$ 2,34/M) e Xiaomi (34,024 / US$ 0,30/M).
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| GPT-5.3-Codex | 45.5 | 14 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
Repare em Qwen3.5 397B A17B e MiMo-V2-Flash: custam uma fração do top-3 e entregam IQ na casa de 34, contra 47 do líder. Para a maioria dos casos de uso, eles são a resposta racional — não em qualidade absoluta, mas em IQ por dólar. A Custom Tools só entra na conta se você já decidiu que precisa do Gemini 3.1 Pro E tem um problema específico de escolha de ferramenta que o padrão não resolve.
O que fazer agora
Se você roda agente em produção, crie dois ambientes idênticos — um com Gemini 3.1 Pro Preview padrão, outro com a Custom Tools —, coloque as mesmas ferramentas e meça duas coisas: (1) quantas vezes cada modelo cai no bash genérico em vez da ferramenta dedicada, e (2) o custo total por tarefa concluída. Se a Custom Tools reduzir o uso de bash e mantiver (ou melhorar) a taxa de sucesso, a conta fecha no fim do mês. Se não, você fica com o pai — que tem número, é o líder, e custa a mesma coisa.
Só vale o teste A/B se você roda agente com várias ferramentas; fora disso, fique com o Gemini 3.1 Pro padrão, que tem benchmark e custa o mesmo.
Perguntas frequentes
Qual a diferença entre Gemini 3.1 Pro Preview e a versão Custom Tools?
A Custom Tools ajusta o comportamento de seleção de ferramentas para evitar o uso excessivo do bash genérico quando há ferramentas de terceiros mais eficientes. A base do modelo, o preço e a janela de contexto são os mesmos da versão padrão.
Quanto custa a Gemini 3.1 Pro Preview Custom Tools?
US$ 2 por milhão de tokens de entrada, US$ 12 por milhão de tokens de saída e US$ 0,20 por milhão em cache de contexto — tabela idêntica à do Gemini 3.1 Pro Preview padrão.
Quando a Custom Tools não vale a pena?
Para qualquer uso fora de fluxos agentic com várias ferramentas — geração de texto, resumo, Q&A — o diferencial é invisível. Use o Gemini 3.1 Pro padrão e gaste a economia em outro lugar.