Gemini 3.1 Pro Preview estreia a US$ 12 por milhão de saída
Frente reasoning da Google custa o mesmo que o o3 da OpenAI e desbota a vantagem de preço que a Anthropic vinha mostrando.
Saiu por US$ 12 o milhão de tokens de saída. É o mesmo preço que a OpenAI cobra pelo o3. Para quem paga a conta no fim do mês, esse número vale mais do que qualquer comunicado à imprensa: é ele que diz onde o Gemini 3.1 Pro Preview entra no roteiro.
O que a Googlebotou na mesa
O Preview chega com 47,738 de índice de inteligência — única casa decimal que importa, porque é a maior nota da categoria "acima de IQ 45" no catálogo de hoje, em um cardápio com 340 modelos de 52 criadores. Atrás dele, em ordem, aparecem Claude Sonnet 4.6 (35,108), Qwen3.5 397B A17B (34,262), o MiMo-V2-Flash da Xiaomi (34,024) e o3 (31,096). Ou seja: do segundo colocado para o primeiro, são mais de 12 pontos. É um salto incomum entre modelos do mesmo segmento.
A janela de contexto é de 1.048.576 tokens, multimodal de ponta a ponta (texto, imagem, arquivo, áudio e vídeo entrando; só texto saindo). É modelo com raciocínio habilitado e pesos fechados.
A conta que importa
Vamos ao que sobra na fatura. Entrada: US$ 2 por milhão. Saída: US$ 12 por milhão. Cache: US$ 0,20 por milhão. Em um workload típico — pense em 4 entradas para cada saída, com metade das entradas reaproveitadas via cache —, o custo blended fica em torno de US$ 4,50 por milhão de tokens processados. É a régua usada para comparar o que parece caro com o que é caro de verdade.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.1-pro-preview |
| Criador | |
| Preço de entrada | US$ 2.00 / M tokens |
| Preço de saída | US$ 12.00 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.200 / M (90% de desconto) |
| Índice de inteligência (AA) | 47.7 |
| Índice de código | 68.8 |
| Índice agêntico | 23.0 |
| Pesos | fechados |
| Velocidade de saída | 103 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
Em tradução: o Sonnet 4.6 custa US$ 15 de saída; o3 cobra US$ 8. O Gemini entra a US$ 12, mais barato que o Claude, mais caro que o o3. Se você vinha movendo carga para o Sonnet porque "o top vale o preço", o argumento perdeu força. Se você já estava no o3 pela economia, a conta agora inclui um novo motivo para testar.
Onde ele ganha e onde ele não ganha
A nota de coding do Preview é 68,826 — a mais alta do recorte atual entre os modelos reasoning listados, e coincide com o discurso de "enhanced software engineering performance" do release. Em agentic, fica em 23,045. Esse número é o que vai te dizer se vale a pena para fluxos longos com ferramentas e planejamento: é a média entre Benchmark que mede navegação, tool use e execução multi-etapa. Não é o pico da categoria — está longe do Sonnet em cargas agentic pesadas, segundo o que o próprio catálogo mostra em outros índices.
Velocidade: 102,52 tokens por segundo. É rápido para a categoria, mas vale lembrar que raciocínio tem custo de latência — quanto mais o modelo "pensa", mais tempo ele consome antes de te entregar o primeiro token.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Claude Sonnet 4.6 | 35.1 | 15 |
| Qwen3.5 397B A17B | 34.3 | 3.5 |
| MiMo-V2-Flash | 34.0 | 0.3 |
| o3 | 31.1 | 8 |
Para quem vale
Vale se você está construindo ferramentas de software que dependem de código de alta qualidade e quer a maior janela de contexto do mercado com multimodal completo. Vale se o seu gargalo é qualidade de saída por dólar, não latência. Vale se você está rodando o Sonnet 4.6 por hábito e quer saber se a diferença compensa os 25% a mais na fatura.
Para quem não muda nada
Não muda nada se você está no o3 pela economia pura e o coding atual atende. Não muda nada se o seu fluxo é agentic pesado e multi-etapa — o Sonnet 4.6 segue mais indicado nesse recorte. Não muda nada se você roda local ou precisa de pesos abertos: o Gemini é API da Google, sem opção self-hosted.
O tabuleiro em 19 de fevereiro de 2026
O catálogo tem 340 modelos, 52 criadores, e 20 foram lançados nos últimos 30 dias. O Gemini 3.1 Pro Preview entra no dia da estreia com a maior nota de inteligência e o maior preço de saída entre os modelos de raciocínio — um posicionamento raro: topo absoluto da régua técnica sem cobrar o absurdo. Não é o mais barato, mas é o mais capaz por dólar entre os fronteira. Para o desenvolvedor que decide na terça e vê a fatura na sexta, é a novidade que precisa de teste nesta semana.
Teste o Gemini 3.1 Pro Preview em coding e fluxos com contexto longo; se o Sonnet 4.6 já te serve em agentic, continue nele.
Perguntas frequentes
Quanto custa o Gemini 3.1 Pro Preview na API?
US$ 2 por milhão de tokens de entrada, US$ 12 por milhão de saída e US$ 0,20 por milhão em cache. É modelo pago, sem tier gratuito.
Gemini 3.1 Pro Preview é melhor que Claude Sonnet 4.6?
No índice agregado do catálogo atual, sim — 47,738 contra 35,108. Em agentic, o Sonnet segue à frente. A diferença vai depender do tipo de carga que você roda.
Tem versão gratuita do Gemini 3.1 Pro Preview?
Não. O catálogo indica free = false; o acesso é pago via API.