Nano Banana chega ao catálogo a US$ 2,50 por milhão de tokens de saída
Google libera Gemini 2.5 Flash Image com foco em geração e edição de imagens, mas sem índice de inteligência publicado e sem preço de entrada divulgado.
O nome é bizarro, a conta é o que importa
Você provavelmente viu alguém chamando de "Nano Banana" e pensou que era meme. É nome de modelo mesmo: a Google batizou o Gemini 2.5 Flash Image assim, e ele entrou no catálogo hoje, 7 de outubro. O que interessa para quem paga a API não é o codinome — é o que ele faz, quanto custa e em que fila ele se encaixa.
A primeira coisa que você precisa saber: este é um modelo de imagem que entra e devolve imagem, não um LLM comum. A modalidade é text+image->text+image, ou seja, você manda texto, ou texto com imagem, e recebe texto e imagem na resposta. É uma ferramenta de geração e edição com entendimento de contexto, não um chatbot que escreve redação.
Preço: o que ficou caro e o que sumiu da nota
A tabela de preços do catálogo mostra três números:
- Entrada: US$ 0,30 por milhão de tokens
- Saída: US$ 2,50 por milhão de tokens
- Cache: US$ 0,03 por milhão de tokens
| Campo | Valor |
|---|---|
| Identificador | google/gemini-2.5-flash-image |
| Criador | |
| Preço de entrada | US$ 0.300 / M tokens |
| Preço de saída | US$ 2.50 / M tokens |
| Janela de contexto | 33k |
| Modalidade | text+image->text+image |
| Leitura de cache | US$ 0.030 / M (90% de desconto) |
O detalhe que pega desavisado: o catálogo não publicou preço de entrada separado para imagens, nem diferenciou tokens de texto e tokens de imagem na fatura. Como a modalidade é multimodal nos dois lados, a conta vai misturar os dois tipos de token na mesma medição. Quem já queimou fatura com geração de imagem sabe: imagem custa muito mais token que texto, então o número de US$ 2,50 por milhão é referência, não orçamento final.
Para efeito de comparação, o topo do catálogo hoje em preço de saída é o gpt-oss-120b, da própria OpenAI, a US$ 0,17 por milhão — quase 15 vezes mais barato por token de saída. Mas comparar os dois pelo número cru é comparar banana com laranja: um é modelo de raciocínio em texto, o outro é gerador de imagem.
Onde ele se encaixa no tabuleiro
O catálogo tem 249 modelos listados hoje, vindos de 40 criadores. O Nano Banana é mais um da Google, que já tinha outros Gemini no cardápio. O topo do índice de inteligência hoje é o o3, da OpenAI, com IQ 31,096 e saída a US$ 8 por milhão. Logo abaixo vem o gpt-oss-120b (IQ 24,126, US$ 0,17) e o Qwen3 Next 80B A3B Thinking (IQ 16,867, US$ 1,20).
O problema: o Nano Banana não tem índice de inteligência publicado. Os campos iq, coding, agentic e blended vieram vazios. Isso não quer dizer que ele é ruim — quer dizer que ninguém rodou o benchmark padronizado do catálogo contra ele ainda. Você está comprando no escuro em capacidade bruta, e só vai saber o que ele entrega quando colocar para rodar no seu caso de uso.
| Modelo | Inteligência | Saída US$/M |
|---|---|---|
| o3 | 31.1 | 8 |
| gpt-oss-120b | 24.1 | 0.17 |
| Qwen3 Next 80B A3B Thinking | 16.9 | 1.2 |
| gpt-oss-20b | 15.2 | 0.13 |
| Llama 4 Maverick | 14.5 | 0.696 |
Para quem vale e para quem não muda nada
Vale para você se: você já está pagando API de geração de imagem em outro fornecedor e quer testar uma alternativa da Google sem trocar de stack; se o seu fluxo é "mando uma imagem e peço para editar" e você quer um modelo que entende contexto em vez de só gerar do zero; se cache barato (US$ 0,03 por milhão) faz sentido no seu padrão de chamadas repetidas.
Não muda nada para você se: seu produto é chatbot de texto puro, porque você vai pagar caro por capacidade de imagem que não usa; se você precisa de benchmark publicado para justificar a escolha internamente, porque este modelo não tem nota de inteligência no catálogo; se você está otimizando para o menor custo por token em texto — para isso existem opções 10 vezes mais baratas.
O que fazer com isso amanhã
Se você tem um fluxo de imagem em produção, o movimento prático é simples: rode o Nano Banana em um lote pequeno do seu workload real, meça custo por imagem gerada e compare com o que você paga hoje. O preço de tabela é promessa; a sua fatura é verdade. E enquanto o índice de inteligência não aparece, trate a escolha como decisão de produto, não de benchmark.
| Modelo | Inteligência | Entrada US$/M | Saída US$/M | Contexto |
|---|---|---|---|---|
| Nano Banana (Gemini 2.5 Flas (o novo) | — | 0.3 | 2.5 | 33k |
| o3 | 31.1 | 2 | 8 | 200k |
| gpt-oss-120b | 24.1 | 0.037 | 0.17 | 131k |
| Qwen3 Next 80B A3B Thinking | 16.9 | 0.15 | 1.2 | 262k |
Teste o Nano Banana em lote pequeno do seu workload de imagem e meça custo por imagem gerada antes de migrar — o preço de tabela é referência, e o índice de inteligência ainda não foi publicado.
Perguntas frequentes
Quanto custa usar o Nano Banana da Google?
O catálogo lista US$ 0,30 por milhão de tokens de entrada, US$ 2,50 por milhão de tokens de saída e US$ 0,03 por milhão de tokens em cache. Como o modelo é multimodal (texto e imagem), a fatura mistura os dois tipos de token, então o custo real por imagem tende a ser maior que a simples multiplicação sugere.
O Nano Banana tem benchmark de inteligência?
Não. No catálogo, os campos de índice de inteligência, coding e agentic vieram vazios para este modelo. Isso significa que o benchmark padronizado ainda não foi rodado contra ele, e você não tem como comparar diretamente com o o3 ou o gpt-oss-120b só pela tabela.
Nano Banana substitui um modelo de texto como o o3?
Não. São produtos diferentes: o o3 é um modelo de raciocínio em texto com IQ 31,096 e saída a US$ 8 por milhão; o Nano Banana é um gerador e editor de imagem com entendimento de contexto. Comparar os dois pelo preço é comparar coisas que fazem trabalhos diferentes.