FalaVIP IA quinta-feira, 03 de setembro de 2026
Análise

Gemini 3.5 Flash cobra 9 dólares por milhão; DeepSeek V4 Pro cobra 1,74

A diferença de inteligência é de 1,4 ponto; a diferença na fatura é de mais de cinco vezes. Eis quando cada um vence.

Redação FalaVIP IA 3 min de leitura
US$ 9,00preço de saída do Gemini 3.5 Flash por milhão de tokens
US$ 1,74preço de saída do DeepSeek V4 Pro por milhão de tokens
46,673 vs 45,268índice de inteligência Artificial Analysis

O jogo dos 5x

Você olha o índice de inteligência e vê dois números quase iguais: 46,673 de um lado, 45,268 do outro. Aí você olha a fatura e descobre que está pagando mais de cinco vezes mais caro pelo modelo que entrega 1,4 ponto a mais de IQ. É exatamente essa a tensão entre o Google Gemini 3.5 Flash, lançado em 19 de maio, e o DeepSeek V4 Pro 0423, disponível desde 24 de abril. Os dois estão no clube restrito de modelos com IQ acima de 45, os dois têm janela de um milhão de tokens e os dois raciocinam. O resto é decisão de bolso.

Índice de inteligência (Artificial Analysis)
Gemini 3.5 Flash46,7DeepSeek V4 Pro 042345,3índice
Fonte: Artificial Analysis

O que o preço de 9 dólares realmente cobre

Quando o catálogo diz que o Gemini 3.5 Flash cobra US$ 9 por milhão de tokens de saída, o número é exato. O de entrada é US$ 1,50 e o cache, US$ 0,15. Multiplique isso pelo que você consome e some com o que sai, e a média ponderada típica — o tal blended — fica em US$ 3,375 por milhão. Esse é o Flash com pretensão de Pro: multimodal de verdade (texto, imagem, arquivo, áudio e vídeo na entrada, só texto na saída), raciocínio nativo e uma velocidade de 194,53 tokens por segundo. É o modelo mais rápido entre os cinco do topo hoje.

Preço de saída (US$ por milhão de tokens)
Gemini 3.5 Flash9DeepSeek V4 Pro 04232,0845US$/M
Fonte: OpenRouter

O que o preço de 1,74 dólares está pagando

Do outro lado, o DeepSeek V4 Pro é outra filosofia. É um Mixture-of-Experts com 1,6 trilhão de parâmetros totais, mas só 49 bilhões ativos por token. O preço de saída é US$ 1,74 por milhão, o de entrada US$ 0,87 e o cache US$ 0,0725 — quase 15 vezes menor que o do Flash. O blended cai para US$ 0,54375 por milhão, o menor entre os modelos acima de 45 de IQ. É chinês, tem pesos abertos e uma velocidade de 57,82 tokens por segundo, um terço da do Flash. O IQ de omniscience é negativo, -10,733: ele inventa mais do que o Gemini quando não sabe.

Gemini 3.5 Flash × DeepSeek V4 Pro 0423
CritérioGemini 3.5 FlashDeepSeek V4 Pro 0423
Índice de inteligência46.745.3
Entrada US$/M1.51.0423
Saída US$/M92.0845
Contexto1.05M1.05M
Pesos abertosnãosim
Velocidade (tok/s)19558
Índice de código59.4
Índice agêntico37.8

Onde cada um ganha — e onde nenhum brilha

Pensa assim: você está cozinhando um lote grande de código, com chamadas longas e repetidas, e quer pagar o menos possível sem descer do IQ 45. DeepSeek V4 Pro. O cache a US$ 0,0725 transforma qualquer fluxo de agente em conta barata, e os 49B ativos por token ainda entregam raciocínio de verdade. Você quer velocidade para algo iterativo — um chatbot no produto, um agente que precisa responder em tempo real, multimodalidade sem ter que montar pipeline. Gemini 3.5 Flash. Os 194 tokens por segundo mudam a experiência do usuário, e a leitura de vídeo, áudio e arquivo vem de fábrica.

O topo do mercado nesta data
ModeloInteligênciaSaída US$/M
Gemini 3.1 Pro Preview47.712
Gemini 3.5 Flash46.79
GPT-5.3-Codex45.514
DeepSeek V4 Pro 042345.32.0845
MiMo-V2.5-Pro42.90.87
Entre os 447 modelos disponíveis no catálogo nesta data.

Onde nenhum dos dois ganha? Em tarefas que dependem de conhecimento factual denso — o Flash tem cutoff em janeiro de 2025 e o DeepSeek não publicou o dele. Se o seu caso precisa de ancoragem em fatos recentes semRetrieval, suba para o Gemini 3.1 Pro Preview (IQ 47,738), que custa US$ 12 de saída. E se você não pode usar modelo fechado nem chinês, hoje, os dois caem fora — o DeepSeek é aberto, mas é da China; o Gemini é dos EUA e proprietário.

O detalhe que ninguém olha

O Gemini 3.5 Flash não publicou benchmark de coding nem de agentic. O DeepSeek publicou: 59,363 em coding e 37,807 em agentic. Isso não quer dizer que o Flash é pior nessas frentes — quer dizer que você está comprando sem ver o número. Para um CTO que precisa justificar a escolha no relatório trimestral, o DeepSeek entrega a prova; o Flash entrega a velocidade.

Em uma frase

Coloque o DeepSeek V4 Pro no caminho crítico de agentes e geração em lote onde cada centavo conta; reserve o Gemini 3.5 Flash para o que é visível ao usuário e precisa de multimodalidade e baixa latência.

Perguntas frequentes

Qual a diferença de preço entre Gemini 3.5 Flash e DeepSeek V4 Pro?

O Gemini 3.5 Flash cobra US$ 9 por milhão de tokens de saída, contra US$ 1,74 do DeepSeek V4 Pro — mais de cinco vezes mais caro. No preço de entrada, a diferença cai para US$ 1,50 contra US$ 0,87 por milhão.

Qual dos dois tem índice de inteligência maior?

O Gemini 3.5 Flash lidera com IQ 46,673, contra 45,268 do DeepSeek V4 Pro, uma diferença de 1,4 ponto na medição da Artificial Analysis. Ambos estão acima de 45, o topo do mercado nesta data.

DeepSeek V4 Pro é modelo aberto?

Sim. O DeepSeek V4 Pro é open weights, com 1,6 trilhão de parâmetros totais e 49 bilhões ativos por token (arquitetura Mixture-of-Experts). É desenvolvido pela DeepSeek, da China.

Leia também