Gemini 3.1 Pro Preview cobra US$ 12 por milhão e lidera ranking de inteligência
É o modelo mais caro entre os cinco primeiros do catálogo, mas também o único acima de IQ 45 — e a diferença é grande.
A Google colocou hoje o Gemini 3.1 Pro Preview no catálogo com uma proposta clara: ser o modelo mais inteligente disponível — e cobrar caro por isso. Entre os cinco mais bem posicionados do índice de inteligência, ele é o único que passa de 45. Os outros quatro (Claude Sonnet 4.6, Qwen 3.5 397B A17B, MiMo-V2-Flash e o3) se apertam numa faixa entre 31 e 35.
O preço que você paga pela liderança
O custo de saída é US$ 12 por milhão de tokens. É mais que o dobro do Qwen 3.5 397B A17B (US$ 2,34) e quarenta vezes o MiMo-V2-Flash, da Xiaomi (US$ 0,30). Em relação ao Claude Sonnet 4.6, principal rival da Anthropic, o Gemini 3.1 Pro Preview é 20% mais barato no output — mas a diferença de capacidade não é de 20%.
A entrada custa US$ 2 por milhão e o cache de leitura sai por US$ 0,20. Isso é o detalhe que costuma escapar do release: se o seu agente relê o mesmo contexto repetidas vezes, o custo efetivo cai bastante. Vale fazer a conta antes de comparar com a concorrência.
O que ele faz melhor (e o que não faz)
O índice de inteligência de 47,74 vem acompanhado de um número que importa para quem escreve código: 68,83 em coding. É o ponto mais alto da ficha. Já o agentic, em 23,05, é mais modesto — surpreende para um modelo que a Google descreve como voltado a "fluxos agentic confiáveis".
A janela de contexto é de um milhão de tokens e a modalidade cobre texto, imagem, arquivo, áudio e vídeo convertendo tudo para texto na saída. É o pacote multimodial completo, sem restrições aparentes.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-pro-preview |
| Criador | |
| Preço de entrada | US$ 2.00 / M tokens |
| Preço de saída | US$ 12.00 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.200 / M (90% de desconto) |
| Índice de inteligência (AA) | 47.7 |
| Índice de código | 68.8 |
| Índice agêntico | 23.0 |
| Pesos | fechados |
| Velocidade de saída | 103 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Onde ele se encaixa no tabuleiro
Olhando o topo do catálogo hoje, a fotografia é esta: o Gemini 3.1 Pro Preview está numa faixa própria, bem acima dos demais. O Claude Sonnet 4.6, da Anthropic (EUA), lidera o pelotão intermediário a US$ 15 por milhão de tokens — mais caro e menos inteligente segundo o índice. Logo atrás vêm dois modelos chineses: o Qwen 3.5 397B A17B, da Alibaba, e o MiMo-V2-Flash, da Xiaomi, ambos com IQ próximo de 34 e preços que variam de US$ 0,30 a US$ 2,34 por milhão.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Gemini 3.1 Pro Preview (o novo) | 47.7 | 2 | 12 | 1.05M |
| Claude Sonnet 4.6 | 35.1 | 3 | 15 | 1M |
| Qwen3.5 397B A17B | 34.3 | 0.55 | 3.5 | 262k |
| MiMo-V2-Flash | 34.0 | 0.1 | 0.3 | 262k |
Em outras palavras: se você quer o melhor em capacidade de raciocínio e está disposto a pagar, o Gemini 3.1 Pro Preview é a única opção acima de IQ 45 hoje. Se orçamento é variável dominante, o Qwen 3.5 397B A17B entrega 72% da inteligência por um quinto do preço. E se você só precisa de um modelo rápido e barato para tarefas simples, o MiMo-V2-Flash continua imbatível em custo.
A linha completa do lançamento
Junto com o preview principal, a Google disponibilizou a versão batch do mesmo modelo. A conta é simples: metade do preço (US$ 1 de entrada, US$ 6 de saída), em troca de latência maior. É a opção para quem roda processamento em volume e pode esperar — relatórios noturnos, pipelines de ETL, geração em massa.
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Gemini 3.1 Pro Preview (batc | 1 | 6 | 1.05M |
Para quem vale — e para quem não muda nada
Vale trocar para o Gemini 3.1 Pro Preview se: você roda agentes complexos, precisa de janela de contexto de um milhão de tokens, ou está extraindo o máximo de um modelo frontier e o salto de capacidade justifica o custo. Pagar US$ 12 em vez de US$ 15 por algo 36% mais inteligente, no caso do Sonnet 4.6, é uma troca razoável.
Não muda nada se: você já usa o Gemini 3 Pro anterior e está satisfeito, ou se o seu caso de uso cabe no Qwen 3.5 397B A17B ou no MiMo-V2-Flash sem perda perceptível. Para chatbots de atendimento, classificação simples e geração curta, a diferença de IQ raramente aparece no produto final — e a diferença na fatura aparece todo mês.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
Se raciocínio e coding são gargalo, migre para o Gemini 3.1 Pro Preview e meça o ganho real antes de comemorar — o índice de 47,74 só se paga em workloads que exploram a fronteira. Para o resto, o Qwen 3.5 397B A17B segue sendo o melhor custo-benefício do catálogo.
Perguntas frequentes
Quanto custa o Gemini 3.1 Pro Preview?
US$ 2 por milhão de tokens de entrada e US$ 12 por milhão de tokens de saída. O cache de leitura sai por US$ 0,20 por milhão. A versão batch custa metade: US$ 1 de entrada e US$ 6 de saída.
O Gemini 3.1 Pro Preview é melhor que o Claude Sonnet 4.6?
Segundo o índice de inteligência atual, sim — 47,74 contra 35,11. Na prática, isso significa vantagem em raciocínio e coding (68,83 contra valores não publicados para o Sonnet 4.6 nesta base). O Sonnet 4.6, porém, cobra US$ 15 por milhão de saída, US$ 3 a mais.
Vale a pena trocar do Gemini 3 Pro para o 3.1 Pro Preview?
Depende do seu caso. O salto de capacidade é real, mas o preço é o mesmo tier (US$ 12 por milhão de saída). Se você já extrai o máximo do 3 Pro e o gargalo não é raciocínio, a economia de não migrar pode ser zero — avalie antes de trocar.