FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Gemini 3.5 Flash chega a US$ 9 por milhão, a 1 ponto do Pro

Multimodal, com 1 milhão de contexto e raciocínio habilitado. Dentro da casa da Google é o mais barato acima de IQ 45 — mas o DeepSeek V4 Pro cobra 5 vezes menos por IQ quase igual.

Redação FalaVIP IA 3 min de leitura
US$ 9,00por milhão de tokens de saída
1,07 pontode IQ abaixo do Gemini 3.1 Pro Preview
5,17×o preço do DeepSeek V4 Pro pelo mesmo tipo de IQ

O que o release promete — e o que o número diz

A ficha técnica diz, em bom marketing: "near-Pro level coding and reasoning at Flash-tier cost and speed". Traduzindo: você paga preço de Flash e leva raciocínio de Pro. O índice de inteligência atual coloca o Gemini 3.5 Flash em 46,673 — exatamente 1,07 ponto abaixo do 3.1 Pro Preview (47,738), que é da mesma casa. "Near-Pro" não é força de expressão, é literalmente o que o número entrega.

Índice de inteligência (Artificial Analysis)
Gemini 3.5 Flash46,7Gemini 3.1 Pro Preview47,7GPT-5.3-Codex45,5DeepSeek V4 Pro 042345,3índice
Fonte: Artificial Analysis

Onde a conta muda de figura é o preço. US$ 9 por milhão de tokens de saída, frente a US$ 12 do Pro — uma queda de 25% dentro da própria família. Cai também frente ao GPT-5.3-Codex, da OpenAI, a US$ 14 pelo mesmo milhão, com IQ de 45,512. Dentro do eixo EUA, a narrativa fecha.

Onde o "barato" da Google para de ser barato

Compare com quem está fora desse eixo. O DeepSeek V4 Pro 0423, modelo chinês, cobra US$ 1,74 por milhão de tokens de saída — 5,17 vezes menos que o Gemini 3.5 Flash — e marca IQ 45,268, apenas 1,4 ponto abaixo. Para workloads que toleram esse delta, o Flash novo da Google não compete em preço.

Inteligência × preço de saída
Gemini 3.5 FlashGemini 3.1 Pro PreviewGPT-5.3-CodexDeepSeek V4 Pro 0423US$ por milhão (saída, escala log)índice de inteligência

A diferença não é só de tabela. O 3.5 Flash é multimodal completo: aceita texto, imagem, arquivo, áudio e vídeo como entrada e devolve texto, com janela de 1.048.576 tokens. A velocidade reportada é 194,53 tokens por segundo, entre as mais altas do portfólio da casa. É um produto com ambição diferente — só não é mais barato que o chinês que faz 90% do trabalho.

A versão batch e o resto do pacote

No mesmo lançamento, a Google subiu o Gemini 3.5 Flash em modo batch: US$ 0,75 por milhão de tokens de entrada e US$ 4,50 por milhão de saída — exatamente metade do preço do modelo padrão. Batch é como lavar louça no horário fora de pico: a louça é a mesma, só muda quando e a que tarifa. Para reprocessamento noturno, classificação em massa e jobs de embedding, vale o registro.

Como se compara com o que já estava disponível
ModeloInteligênciaEntrada US$/MSaída US$/MContexto
Gemini 3.5 Flash (o novo)46.71.591.05M
Gemini 3.1 Pro Preview47.72121.05M
GPT-5.3-Codex45.51.7514400k
DeepSeek V4 Pro 042345.31.04232.08451.05M
Preços do catálogo do OpenRouter na data. Inteligência pelo Artificial Analysis.

Para quem vale — e para quem não muda nada

Vale se você roda muito código agêntico em paralelo, precisa do pacote multimodal completo num único endpoint e quer manter latência baixa com raciocínio habilitado. Para esse perfil, dentro da família Google, é a escolha óbvia.

Não muda nada para quem já migrou orçamento para o DeepSeek V4 Pro e tolera 1,4 ponto de IQ a menos. Não muda nada para quem precisa do Pro de verdade — 47,738 contra 46,673 pesa em benchmarks longos de raciocínio. E não muda nada para workloads onde batch já é caminho natural: a versão batch de qualquer outro modelo resolve.

Onde isso te deixa em 19 de maio

O catálogo lista mais de 445 modelos de 61 criadores. Nos últimos 30 dias entraram 53 modelos novos — não é semana de calmaria. O topo do ranking atual: 1º Gemini 3.1 Pro Preview (47,738), 2º Gemini 3.5 Flash (46,673), 3º GPT-5.3-Codex (45,512), 4º DeepSeek V4 Pro (45,268), 5º Xiaomi MiMo-V2.5-Pro (42,88). A Google ocupa duas das cinco primeiras posições com famílias diferentes — e o Flash de hoje é o produto mais barato da casa entre os que passam de IQ 45.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
Entre os 445 modelos disponíveis no catálogo nesta data.

A pergunta antes de trocar de modelo não é "este é mais barato que o Pro?". É "este é mais barato que o DeepSeek?". Porque o Flash novo empurra o teto de preço da Google para baixo sem mexer no teto do mercado.

Em uma frase

Se multimodal completo e latência baixa dentro do ecossistema Google pesam, troque do Pro Preview para o Flash e corte 25% da conta de saída; se orçamento manda, o DeepSeek V4 Pro segue entregando IQ quase igual por uma fração do preço.

Perguntas frequentes

Quanto custa o Gemini 3.5 Flash por token?

US$ 1,50 por milhão de tokens de entrada, US$ 9,00 por milhão de tokens de saída e US$ 0,15 por milhão para leitura em cache. Na versão batch, todos esses valores caem pela metade.

Qual a diferença entre Gemini 3.5 Flash e Gemini 3.1 Pro Preview?

O Flash marca IQ 46,673 contra 47,738 do Pro Preview — 1,07 ponto a menos. Em troca, cobra US$ 9 por milhão de tokens de saída, 25% mais barato que os US$ 12 do Pro. Janela de contexto, multimodalidade e suporte a raciocínio são os mesmos.

Gemini 3.5 Flash ou DeepSeek V4 Pro: qual compensa mais?

Se o multimodal completo da Google não for requisito e você aceita 1,4 ponto de IQ a menos, o DeepSeek V4 Pro entrega IQ 45,268 a US$ 1,74 por milhão de tokens de saída — 5,17 vezes mais barato. Para workloads sensíveis a custo, é a escolha óbvia.

Leia também