Google solta quatro Gemini de uma vez, e o Flash perde em preço
Gemini 3.6 Flash custa US$ 3,75 por milhão de tokens de saída, mas o GPT-5.6 Luna, da OpenAI, cobra US$ 1,20 e marca IQ maior.
"Flash" já não é sinônimo de mais barato nem de mais esperto
Quatro variantes da linha Gemini entraram no catálogo hoje (21 de julho de 2026), todas no mesmo dia. O carro-chefe é o Gemini 3.6 Flash, modelo com 1 milhão de tokens de contexto, suporte a texto, imagem, arquivo, áudio e vídeo como entrada, saída em texto, e raciocínio ativado. Custa US$ 0,75 por milhão de tokens de entrada e US$ 3,75 por milhão de saída. É multimodal de verdade, incluindo vídeo — coisa que pouquíssimos concorrentes do catálogo aceitam hoje.
| Campo | Valor |
|---|---|
| Identificador | google/gemini-3.6-flash |
| Criador | |
| Preço de entrada | US$ 0.750 / M tokens |
| Preço de saída | US$ 3.75 / M tokens |
| Janela de contexto | 1.05M |
| Modalidade | text+image+file+audio+video->text |
| Leitura de cache | US$ 0.075 / M (90% de desconto) |
| Índice de inteligência (AA) | 51.6 |
| Índice de código | 69.2 |
| Índice agêntico | 40.5 |
| Pesos | fechados |
| Velocidade de saída | 170 tokens/s |
| Raciocínio | sim (gasta tokens de saída pensando) |
O que o release diz e o que o número mostra
A descrição oficial chama o 3.6 Flash de "modelo de alta eficiência para codificação, fluxos agênticos e desenvolvimento web e app", e promete saídas mais polidas com menos edições desnecessárias. O número de codificação bate 69,2, alto entre os disponíveis hoje. Só que o índice agêntico marca 40,5, apenas mediano. Traduzindo: o modelo escreve código bem, mas não é a peça que você colocaria para orquestrar agentes autônomos do começo ao fim — pelo menos não pelos números de hoje.
A família completa anunciada hoje
Não veio um modelo só, veio uma linha:
| Modelo | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|
| Gemini 3.5 Flash Lite (batch | 0.15 | 1.25 | 1.05M |
| Gemini 3.5 Flash Lite | 0.3 | 2.5 | 1.05M |
| Gemini 3.6 Flash (batch) | 0.375 | 1.875 | 1.05M |
A versão em batch do 3.6 Flash, com 50% de desconto, sai a US$ 1,875 por milhão de saída. É a que de fato compete de frente com Luna e DeepSeek no preço. O Gemini 3.5 Flash Lite, em batch, é ainda mais barato: US$ 1,25 por milhão de saída, só que sem o multimodal de vídeo nem a mesma régua de codificação.
E aqui está a primeira armadilha: o 3.6 Flash não é nem a opção mais barata da própria casa Google. O 3.5 Flash Lite padrão, a US$ 2,50 por milhão de saída, já sai mais em conta.
IQ 51,6 e o parente mais esperto e mais barato
No índice geral de inteligência, o 3.6 Flash marca 51,6. Para um Flash da linha principal, é o esperado. O problema é que, em 21 de julho, a OpenAI já publicou um concorrente que custa um terço do preço de saída e ainda marca IQ maior. O GPT-5.6 Luna cobra US$ 1,20 por milhão de tokens de saída e registra 52,3 de IQ — mais barato, um pouco mais esperto, e já estava no catálogo antes de hoje. Se você não precisa de vídeo como entrada, o Luna come o Flash no almoço. O Claude Fable 5, da Anthropic, lidera o ranking geral com 62,1, mas cobra US$ 50 por milhão de saída — outra prateleira, fora do mesmo ticket.
Para quem vale e para quem não muda nada
Vale para o seu projeto se:
- Vídeo como entrada é requisito — são raros os modelos do catálogo que aceitam isso hoje.
- Você já está no ecossistema Google (Vertex AI, AI Studio, Workspace) e quer integração nativa.
- O volume é alto e o modo batch (US$ 1,875/M de saída) resolve a sua latência.
- Você precisa de cache de leitura agressivo: US$ 0,075 por milhão de tokens, dez vezes mais barato que o preço de entrada.
Não muda nada se:
- Você já paga API de outra casa e multimodal sem vídeo basta.
- O objetivo é o melhor IQ por dólar: o Luna entrega 52,3 a US$ 1,20/M.
- Você quer raciocínio pesado: Fable 5 (62,1), Sol (60,9) e Kimi K3 (59,7) estão acima, entre US$ 10 e US$ 50 por milhão de saída.
- Você busca open weights — o 3.6 Flash é fechado.
O que sobra na fatura
O Gemini 3.6 Flash é um cavalo de trabalho honesto: multimodal completo, raciocínio, contexto grande, preço de Flash. Só que "preço de Flash" parou de ser sinônimo de "menor preço" — a OpenAI já entrega mais IQ por menos token, e dentro do próprio Google o 3.5 Flash Lite é mais barato. O 3.6 Flash vale pelo vídeo como entrada, pelo cache de leitura a US$ 0,075 por milhão de tokens e pelo nome Google no stack. No resto, o catálogo de pelo menos 516 modelos já oferece opção mais barata ou mais inteligente para a mesma tarefa.
Se você não precisa de vídeo como entrada, o GPT-5.6 Luna entrega IQ maior por um terço do preço; o 3.6 Flash vale pelo multimodal completo e pelo cache de leitura a US$ 0,075 por milhão de tokens, não pelo preço de saída.
Perguntas frequentes
Gemini 3.6 Flash é o modelo mais barato lançado pelo Google hoje?
Não. O mais barato do pacote de hoje é o Gemini 3.5 Flash Lite em batch, a US$ 1,25 por milhão de tokens de saída. O 3.6 Flash em batch sai a US$ 1,875 e a versão sem batch fica em US$ 3,75 — mais cara que o 3.5 Flash Lite padrão, a US$ 2,50.
O Gemini 3.6 Flash aceita vídeo?
Sim. O 3.6 Flash é multimodal completo: aceita texto, imagem, arquivo, áudio e vídeo como entrada, com saída em texto e raciocínio ativado. Esse é hoje o principal diferencial prático dele frente ao GPT-5.6 Luna e ao Claude Fable 5.
Vale trocar o GPT-5.6 Luna pelo Gemini 3.6 Flash?
Só se você precisa de entrada de vídeo ou de cache de leitura muito barato (US$ 0,075 por milhão de tokens). Em IQ geral, o Luna marca 52,3 contra 51,6 do Flash e custa US$ 1,20 por milhão de saída — menos de um terço do preço do 3.6 Flash padrão.