FalaVIP IA quinta-feira, 03 de setembro de 2026
Lançamentos

Google solta quatro Gemini de uma vez, e o Flash perde em preço

Gemini 3.6 Flash custa US$ 3,75 por milhão de tokens de saída, mas o GPT-5.6 Luna, da OpenAI, cobra US$ 1,20 e marca IQ maior.

Redação FalaVIP IA 3 min de leitura
US$ 3,75por milhão de tokens de saída no Gemini 3.6 Flash
US$ 1,20preço do GPT-5.6 Luna, mais barato e com IQ maior
IQ 51,6índice de inteligência do 3.6 Flash

"Flash" já não é sinônimo de mais barato nem de mais esperto

Quatro variantes da linha Gemini entraram no catálogo hoje (21 de julho de 2026), todas no mesmo dia. O carro-chefe é o Gemini 3.6 Flash, modelo com 1 milhão de tokens de contexto, suporte a texto, imagem, arquivo, áudio e vídeo como entrada, saída em texto, e raciocínio ativado. Custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de saída. É multimodal de verdade, incluindo vídeo — coisa que pouquíssimos concorrentes do catálogo aceitam hoje.

Ficha técnica — Gemini 3.6 Flash
CampoValor
Identificadorgoogle/gemini-3.6-flash
Criadorgoogle
Preço de entradaUS$ 0.750 / M tokens
Preço de saídaUS$ 3.75 / M tokens
Janela de contexto1.05M
Modalidadetext+image+file+audio+video->text
Leitura de cacheUS$ 0.075 / M (90% de desconto)
Índice de inteligência (AA)51.6
Índice de código69.2
Índice agêntico40.5
Pesosfechados
Velocidade de saída170 tokens/s
Raciocíniosim (gasta tokens de saída pensando)

O que o release diz e o que o número mostra

A descrição oficial chama o 3.6 Flash de "modelo de alta eficiência para codificação, fluxos agênticos e desenvolvimento web e app", e promete saídas mais polidas com menos edições desnecessárias. O número de codificação bate 69,2, alto entre os disponíveis hoje. Só que o índice agêntico marca 40,5, apenas mediano. Traduzindo: o modelo escreve código bem, mas não é a peça que você colocaria para orquestrar agentes autônomos do começo ao fim — pelo menos não pelos números de hoje.

A família completa anunciada hoje

Não veio um modelo só, veio uma linha:

Os outros modelos anunciados no mesmo dia
ModeloEntrada US$/MSaída US$/MContexto
Gemini 3.5 Flash Lite (batch0.151.251.05M
Gemini 3.5 Flash Lite0.32.51.05M
Gemini 3.6 Flash (batch)0.3751.8751.05M

A versão em batch do 3.6 Flash, com 50% de desconto, sai a US$ 1,875 por milhão de saída. É a que de fato compete de frente com Luna e DeepSeek no preço. O Gemini 3.5 Flash Lite, em batch, é ainda mais barato: US$ 1,25 por milhão de saída, só que sem o multimodal de vídeo nem a mesma régua de codificação.

E aqui está a primeira armadilha: o 3.6 Flash não é nem a opção mais barata da própria casa Google. O 3.5 Flash Lite padrão, a US$ 2,50 por milhão de saída, já sai mais em conta.

IQ 51,6 e o parente mais esperto e mais barato

Inteligência × preço de saída
Gemini 3.6 FlashClaude Fable 5GPT-5.6 SolKimi K3MiniMax M3GPT-5.6 LunaUS$ por milhão (saída, escala log)índice de inteligência

No índice geral de inteligência, o 3.6 Flash marca 51,6. Para um Flash da linha principal, é o esperado. O problema é que, em 21 de julho, a OpenAI já publicou um concorrente que custa um terço do preço de saída e ainda marca IQ maior. O GPT-5.6 Luna cobra US$ 1,20 por milhão de tokens de saída e registra 52,3 de IQ — mais barato, um pouco mais esperto, e já estava no catálogo antes de hoje. Se você não precisa de vídeo como entrada, o Luna come o Flash no almoço. O Claude Fable 5, da Anthropic, lidera o ranking geral com 62,1, mas cobra US$ 50 por milhão de saída — outra prateleira, fora do mesmo ticket.

Para quem vale e para quem não muda nada

Vale para o seu projeto se:

  • Vídeo como entrada é requisito — são raros os modelos do catálogo que aceitam isso hoje.
  • Você já está no ecossistema Google (Vertex AI, AI Studio, Workspace) e quer integração nativa.
  • O volume é alto e o modo batch (US$ 1,875/M de saída) resolve a sua latência.
  • Você precisa de cache de leitura agressivo: US$ 0,075 por milhão de tokens, dez vezes mais barato que o preço de entrada.

Não muda nada se:

  • Você já paga API de outra casa e multimodal sem vídeo basta.
  • O objetivo é o melhor IQ por dólar: o Luna entrega 52,3 a US$ 1,20/M.
  • Você quer raciocínio pesado: Fable 5 (62,1), Sol (60,9) e Kimi K3 (59,7) estão acima, entre US$ 10 e US$ 50 por milhão de saída.
  • Você busca open weights — o 3.6 Flash é fechado.

O que sobra na fatura

O Gemini 3.6 Flash é um cavalo de trabalho honesto: multimodal completo, raciocínio, contexto grande, preço de Flash. Só que "preço de Flash" parou de ser sinônimo de "menor preço" — a OpenAI já entrega mais IQ por menos token, e dentro do próprio Google o 3.5 Flash Lite é mais barato. O 3.6 Flash vale pelo vídeo como entrada, pelo cache de leitura a US$ 0,075 por milhão de tokens e pelo nome Google no stack. No resto, o catálogo de pelo menos 516 modelos já oferece opção mais barata ou mais inteligente para a mesma tarefa.

Em uma frase

Se você não precisa de vídeo como entrada, o GPT-5.6 Luna entrega IQ maior por um terço do preço; o 3.6 Flash vale pelo multimodal completo e pelo cache de leitura a US$ 0,075 por milhão de tokens, não pelo preço de saída.

Perguntas frequentes

Gemini 3.6 Flash é o modelo mais barato lançado pelo Google hoje?

Não. O mais barato do pacote de hoje é o Gemini 3.5 Flash Lite em batch, a US$ 1,25 por milhão de tokens de saída. O 3.6 Flash em batch sai a US$ 1,875 e a versão sem batch fica em US$ 3,75 — mais cara que o 3.5 Flash Lite padrão, a US$ 2,50.

O Gemini 3.6 Flash aceita vídeo?

Sim. O 3.6 Flash é multimodal completo: aceita texto, imagem, arquivo, áudio e vídeo como entrada, com saída em texto e raciocínio ativado. Esse é hoje o principal diferencial prático dele frente ao GPT-5.6 Luna e ao Claude Fable 5.

Vale trocar o GPT-5.6 Luna pelo Gemini 3.6 Flash?

Só se você precisa de entrada de vídeo ou de cache de leitura muito barato (US$ 0,075 por milhão de tokens). Em IQ geral, o Luna marca 52,3 contra 51,6 do Flash e custa US$ 1,20 por milhão de saída — menos de um terço do preço do 3.6 Flash padrão.

Leia também