FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Gemini 3.1 Pro Preview estreia a US$ 12 por milhão de saída

Frente reasoning da Google custa o mesmo que o o3 da OpenAI e desbota a vantagem de preço que a Anthropic vinha mostrando.

Redação FalaVIP IA 3 min de leitura
US$ 12por milhão de tokens de saída
1.048.576tokens de contexto
68,826nota de coding

Saiu por US$ 12 o milhão de tokens de saída. É o mesmo preço que a OpenAI cobra pelo o3. Para quem paga a conta no fim do mês, esse número vale mais do que qualquer comunicado à imprensa: é ele que diz onde o Gemini 3.1 Pro Preview entra no roteiro.

O que a Googlebotou na mesa

O Preview chega com 47,738 de índice de inteligência — única casa decimal que importa, porque é a maior nota da categoria "acima de IQ 45" no catálogo de hoje, em um cardápio com 340 modelos de 52 criadores. Atrás dele, em ordem, aparecem Claude Sonnet 4.6 (35,108), Qwen3.5 397B A17B (34,262), o MiMo-V2-Flash da Xiaomi (34,024) e o3 (31,096). Ou seja: do segundo colocado para o primeiro, são mais de 12 pontos. É um salto incomum entre modelos do mesmo segmento.

A janela de contexto é de 1.048.576 tokens, multimodal de ponta a ponta (texto, imagem, arquivo, áudio e vídeo entrando; só texto saindo). É modelo com raciocínio habilitado e pesos fechados.

A conta que importa

Vamos ao que sobra na fatura. Entrada: US$ 2 por milhão. Saída: US$ 12 por milhão. Cache: US$ 0,20 por milhão. Em um workload típico — pense em 4 entradas para cada saída, com metade das entradas reaproveitadas via cache —, o custo blended fica em torno de US$ 4,50 por milhão de tokens processados. É a régua usada para comparar o que parece caro com o que é caro de verdade.

Ficha técnica — Gemini 3.1 Pro Preview
CampoValor
Identificadorgoogle/gemini-3.1-pro-preview
Criadorgoogle
Preço de entradaUS$ 2.00 / M tokens
Preço de saídaUS$ 12.00 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file+audio+video->text
Leitura de cacheUS$ 0.200 / M (90% de desconto)
Índice de inteligência (AA)47.7
Índice de código68.8
Índice agêntico23.0
Pesosfechados
Velocidade de saída103 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

Em tradução: o Sonnet 4.6 custa US$ 15 de saída; o3 cobra US$ 8. O Gemini entra a US$ 12, mais barato que o Claude, mais caro que o o3. Se você vinha movendo carga para o Sonnet porque "o top vale o preço", o argumento perdeu força. Se você já estava no o3 pela economia, a conta agora inclui um novo motivo para testar.

Onde ele ganha e onde ele não ganha

A nota de coding do Preview é 68,826 — a mais alta do recorte atual entre os modelos reasoning listados, e coincide com o discurso de "enhanced software engineering performance" do release. Em agentic, fica em 23,045. Esse número é o que vai te dizer se vale a pena para fluxos longos com ferramentas e planejamento: é a média entre Benchmark que mede navegação, tool use e execução multi-etapa. Não é o pico da categoria — está longe do Sonnet em cargas agentic pesadas, segundo o que o próprio catálogo mostra em outros índices.

Velocidade: 102,52 tokens por segundo. É rápido para a categoria, mas vale lembrar que raciocínio tem custo de latência — quanto mais o modelo "pensa", mais tempo ele consome antes de te entregar o primeiro token.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Claude Sonnet 4.635.115
Qwen3.5 397B A17B34.33.5
MiMo-V2-Flash34.00.3
o331.18
Entre os 340 modelos disponíveis no catálogo nesta data.

Para quem vale

Vale se você está construindo ferramentas de software que dependem de código de alta qualidade e quer a maior janela de contexto do mercado com multimodal completo. Vale se o seu gargalo é qualidade de saída por dólar, não latência. Vale se você está rodando o Sonnet 4.6 por hábito e quer saber se a diferença compensa os 25% a mais na fatura.

Para quem não muda nada

Não muda nada se você está no o3 pela economia pura e o coding atual atende. Não muda nada se o seu fluxo é agentic pesado e multi-etapa — o Sonnet 4.6 segue mais indicado nesse recorte. Não muda nada se você roda local ou precisa de pesos abertos: o Gemini é API da Google, sem opção self-hosted.

O tabuleiro em 19 de fevereiro de 2026

O catálogo tem 340 modelos, 52 criadores, e 20 foram lançados nos últimos 30 dias. O Gemini 3.1 Pro Preview entra no dia da estreia com a maior nota de inteligência e o maior preço de saída entre os modelos de raciocínio — um posicionamento raro: topo absoluto da régua técnica sem cobrar o absurdo. Não é o mais barato, mas é o mais capaz por dólar entre os fronteira. Para o desenvolvedor que decide na terça e vê a fatura na sexta, é a novidade que precisa de teste nesta semana.

Em uma frase

Teste o Gemini 3.1 Pro Preview em coding e fluxos com contexto longo; se o Sonnet 4.6 já te serve em agentic, continue nele.

Perguntas frequentes

Quanto custa o Gemini 3.1 Pro Preview na API?

US$ 2 por milhão de tokens de entrada, US$ 12 por milhão de saída e US$ 0,20 por milhão em cache. É modelo pago, sem tier gratuito.

Gemini 3.1 Pro Preview é melhor que Claude Sonnet 4.6?

No índice agregado do catálogo atual, sim — 47,738 contra 35,108. Em agentic, o Sonnet segue à frente. A diferença vai depender do tipo de carga que você roda.

Tem versão gratuita do Gemini 3.1 Pro Preview?

Não. O catálogo indica free = false; o acesso é pago via API.

Leia também