Gemini 3.5 Flash chega a US$ 9 por milhão, a 1 ponto do Pro
Multimodal, com 1 milhão de contexto e raciocínio habilitado. Dentro da casa da Google é o mais barato acima de IQ 45 — mas o DeepSeek V4 Pro cobra 5 vezes menos por IQ quase igual.
O que o release promete — e o que o número diz
A ficha técnica diz, em bom marketing: "near-Pro level coding and reasoning at Flash-tier cost and speed". Traduzindo: você paga preço de Flash e leva raciocínio de Pro. O índice de inteligência atual coloca o Gemini 3.5 Flash em 46,673 — exatamente 1,07 ponto abaixo do 3.1 Pro Preview (47,738), que é da mesma casa. "Near-Pro" não é força de expressão, é literalmente o que o número entrega.
Onde a conta muda de figura é o preço. US$ 9 por milhão de tokens de saída, frente a US$ 12 do Pro — uma queda de 25% dentro da própria família. Cai também frente ao GPT-5.3-Codex, da OpenAI, a US$ 14 pelo mesmo milhão, com IQ de 45,512. Dentro do eixo EUA, a narrativa fecha.
Onde o "barato" da Google para de ser barato
Compare com quem está fora desse eixo. O DeepSeek V4 Pro 0423, modelo chinês, cobra US$ 1,74 por milhão de tokens de saída — 5,17 vezes menos que o Gemini 3.5 Flash — e marca IQ 45,268, apenas 1,4 ponto abaixo. Para workloads que toleram esse delta, o Flash novo da Google não compete em preço.
A diferença não é só de tabela. O 3.5 Flash é multimodal completo: aceita texto, imagem, arquivo, áudio e vídeo como entrada e devolve texto, com janela de 1.048.576 tokens. A velocidade reportada é 194,53 tokens por segundo, entre as mais altas do portfólio da casa. É um produto com ambição diferente — só não é mais barato que o chinês que faz 90% do trabalho.
A versão batch e o resto do pacote
No mesmo lançamento, a Google subiu o Gemini 3.5 Flash em modo batch: US$ 0,75 por milhão de tokens de entrada e US$ 4,50 por milhão de saída — exatamente metade do preço do modelo padrão. Batch é como lavar louça no horário fora de pico: a louça é a mesma, só muda quando e a que tarifa. Para reprocessamento noturno, classificação em massa e jobs de embedding, vale o registro.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Gemini 3.5 Flash (o novo) | 46.7 | 1.5 | 9 | 1.05M |
| Gemini 3.1 Pro Preview | 47.7 | 2 | 12 | 1.05M |
| GPT-5.3-Codex | 45.5 | 1.75 | 14 | 400k |
| DeepSeek V4 Pro 0423 | 45.3 | 1.0423 | 2.0845 | 1.05M |
Para quem vale — e para quem não muda nada
Vale se você roda muito código agêntico em paralelo, precisa do pacote multimodal completo num único endpoint e quer manter latência baixa com raciocínio habilitado. Para esse perfil, dentro da família Google, é a escolha óbvia.
Não muda nada para quem já migrou orçamento para o DeepSeek V4 Pro e tolera 1,4 ponto de IQ a menos. Não muda nada para quem precisa do Pro de verdade — 47,738 contra 46,673 pesa em benchmarks longos de raciocínio. E não muda nada para workloads onde batch já é caminho natural: a versão batch de qualquer outro modelo resolve.
Onde isso te deixa em 19 de maio
O catálogo lista mais de 445 modelos de 61 criadores. Nos últimos 30 dias entraram 53 modelos novos — não é semana de calmaria. O topo do ranking atual: 1º Gemini 3.1 Pro Preview (47,738), 2º Gemini 3.5 Flash (46,673), 3º GPT-5.3-Codex (45,512), 4º DeepSeek V4 Pro (45,268), 5º Xiaomi MiMo-V2.5-Pro (42,88). A Google ocupa duas das cinco primeiras posições com famílias diferentes — e o Flash de hoje é o produto mais barato da casa entre os que passam de IQ 45.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| Gemini 3.1 Pro Preview | 47.7 | 12 |
| Gemini 3.5 Flash | 46.7 | 9 |
| GPT-5.3-Codex | 45.5 | 14 |
| DeepSeek V4 Pro 0423 | 45.3 | 2.0845 |
| MiMo-V2.5-Pro | 42.9 | 0.87 |
A pergunta antes de trocar de modelo não é "este é mais barato que o Pro?". É "este é mais barato que o DeepSeek?". Porque o Flash novo empurra o teto de preço da Google para baixo sem mexer no teto do mercado.
Se multimodal completo e latência baixa dentro do ecossistema Google pesam, troque do Pro Preview para o Flash e corte 25% da conta de saída; se orçamento manda, o DeepSeek V4 Pro segue entregando IQ quase igual por uma fração do preço.
Perguntas frequentes
Quanto custa o Gemini 3.5 Flash por token?
US$ 1,50 por milhão de tokens de entrada, US$ 9,00 por milhão de tokens de saída e US$ 0,15 por milhão para leitura em cache. Na versão batch, todos esses valores caem pela metade.
Qual a diferença entre Gemini 3.5 Flash e Gemini 3.1 Pro Preview?
O Flash marca IQ 46,673 contra 47,738 do Pro Preview — 1,07 ponto a menos. Em troca, cobra US$ 9 por milhão de tokens de saída, 25% mais barato que os US$ 12 do Pro. Janela de contexto, multimodalidade e suporte a raciocínio são os mesmos.
Gemini 3.5 Flash ou DeepSeek V4 Pro: qual compensa mais?
Se o multimodal completo da Google não for requisito e você aceita 1,4 ponto de IQ a menos, o DeepSeek V4 Pro entrega IQ 45,268 a US$ 1,74 por milhão de tokens de saída — 5,17 vezes mais barato. Para workloads sensíveis a custo, é a escolha óbvia.