Se você já procurou como gerar imagens no Gemini, provavelmente esbarrou em uma confusão de nomes: Nano Banana, Nano Banana 2, Nano Banana Pro, Gemini 3.1 Flash Image. Parecem produtos diferentes e não são — Nano Banana é simplesmente o nome da geração de imagens nativa do Gemini, e os demais são versões dela.
Esse esclarecimento importa porque a escolha do modelo é a decisão que mais afeta o resultado. Um infográfico com texto denso feito no modelo rápido sai com letras tortas; o mesmo pedido no modelo Pro sai legível. Saber qual usar em cada caso economiza tentativas e cota diária.
Este guia cobre os três modelos e quando usar cada um, o passo a passo de geração, como escrever prompts do jeito que o Gemini aproveita melhor, a edição conversacional que é o principal diferencial da ferramenta, e as limitações reais.
O que é Nano Banana
Nano Banana é o nome da capacidade nativa de geração e edição de imagens do Gemini. Nativa significa que o modelo de imagem está integrado ao próprio Gemini, e não acionado como um sistema separado — ele entende o pedido no mesmo contexto da conversa, incluindo imagens que você enviou e o que já foi dito antes.
Em fevereiro de 2026 o Nano Banana 2 passou a ser o caminho padrão de geração de imagens nas principais superfícies do Google, incluindo o app do Gemini. O Nano Banana Pro continua existindo como opção de alta fidelidade, principalmente para quem tem plano pago.
Os três modelos e quando usar cada um
Dentro do Gemini, o menu de modelos aparece com nomes de comportamento — Rápido, Raciocínio e Pro. Por baixo, correspondem a três modelos distintos.
| Modelo | Perfil | Use quando |
|---|---|---|
| Nano Banana 2 Lite (Rápido) | O mais veloz e econômico | Testes, variações rápidas, imagens simples de uma cena só |
| Nano Banana 2 (Raciocínio) | O generalista, padrão para quase tudo | A maior parte dos casos: cenas, retratos, produtos, ilustrações |
| Nano Banana Pro | Alta fidelidade, texto e layout complexos | Infográficos, cartazes com texto denso, peças de produção |
Uma característica útil do fluxo: você pode gerar primeiro no modelo padrão e, se o resultado pedir mais detalhe, refazer a mesma imagem no Pro. Nos planos pagos, a opção aparece no menu de três pontos da imagem gerada, como "Refazer com o Pro". A limitação é que, ao esgotar a cota diária do modelo padrão, a refação no Pro também deixa de estar disponível.
💡 Estratégia de cota: use o modelo rápido para descobrir a composição que funciona e só então refaça no Pro. Gastar as gerações do modelo mais caro em testes é o erro que mais desperdiça cota diária.
Como gerar sua primeira imagem
- Abra o Gemini. No computador, acesse pelo navegador; no celular, pelo aplicativo.
- Entre na área de imagens. Na barra lateral existe uma seção de Imagens; alternativamente, no menu de ferramentas há a opção de criar imagens.
- Escolha o modelo. Rápido, Raciocínio ou Pro, conforme a tabela acima. Se estiver em dúvida, comece pelo padrão.
- Escreva o pedido em linguagem natural. Frases completas funcionam melhor que listas de palavras separadas por vírgula.
- Peça ajustes na mesma conversa. "Deixe o fundo mais escuro", "mude para o fim da tarde", "tire a planta do canto". Ele mantém a imagem e altera só o que foi pedido.
- Baixe em resolução cheia. Use o botão de download, nunca captura de tela.
Resolução: o que você consegue baixar
A resolução de download depende do plano. Sem plano pago do Google com IA, o download sai em 1K. Com plano, é possível baixar em 2K. O Nano Banana Pro é o caminho para saídas de fidelidade mais alta, incluindo material com texto e layout que precisa aguentar ampliação.
Na prática isso significa que, para uso digital comum — post, thumbnail, imagem de blog, apresentação — o que o Gemini entrega já resolve. Para impressão em tamanho grande ou monitor de alta resolução, você vai precisar ampliar depois da geração. Dá para aumentar a resolução da imagem sem perder qualidade, e o resultado costuma ser bom quando a imagem é limpa e pouco detalhada.
Como escrever prompts para o Gemini
O próprio Google sugere uma fórmula inicial simples: peça a criação de uma imagem indicando o sujeito, a ação e a cena. É um bom ponto de partida — e o passo seguinte é justamente expandi-la.
Comece pela fórmula, depois detalhe
Um pedido mínimo funcionaria assim:
Já dá resultado. Mas cada camada adicional aproxima o resultado do que você imaginou:
Escreva em prosa, não em tags
Esta é a diferença mais importante em relação a ferramentas como o Midjourney. O Gemini é conversacional e aproveita melhor frases completas do que listas de termos separados por vírgula. Escreva como se estivesse explicando a cena para alguém.
Diga a proporção
Se você não indicar, o modelo escolhe. Diga "formato vertical para stories", "quadrado para Instagram", "horizontal widescreen" ou a proporção diretamente.
Coloque o texto entre aspas
Quando a imagem precisa conter palavras, escreva-as literalmente entre aspas e indique a posição. Sem isso, o modelo pode parafrasear ou colocar onde achar melhor.
Itere em vez de reescrever
Se algo saiu errado, peça a correção específica em vez de reescrever tudo. "Mantenha a composição e troque só a cor do casaco para verde" preserva o que já estava bom. Reescrever o prompt inteiro gera uma imagem nova sem relação com a anterior.
Edição conversacional: o principal diferencial
É aqui que o Gemini se destaca. Você envia uma imagem — gerada por ele ou sua — e descreve a alteração em palavras, sem máscara, camada ou seleção.
Trocar o fundo
Manter o sujeito e substituir o ambiente atrás dele. Útil para retratos, produtos e peças de marketing.
Mudar o clima e o horário
Transformar um dia ensolarado em noite, adicionar chuva, trocar o outono pelo inverno. A mesma cena com outra atmosfera.
Alterar o ângulo de câmera
Pedir a mesma cena vista de outro ponto. Não é perfeito, porque o modelo precisa inventar o que não estava visível, mas funciona bem em cenas com espaço.
Transferir estilo de uma referência
Um dos recursos mais úteis e menos conhecidos: enviar duas imagens e pedir que a textura, a cor ou o estilo de uma seja aplicada à outra. É a forma mais rápida de testar estéticas sem começar do zero.
Adicionar ou remover elementos
Tirar um objeto indesejado, acrescentar uma planta, incluir uma pessoa ao fundo. Funciona bem com elementos claramente delimitados; remoções em áreas de textura complexa às vezes deixam marcas.
Trabalhar com imagens de referência
Enviar imagens junto com o pedido é onde o Gemini mostra mais força, e vale entender as três formas de usar isso.
Referência de sujeito. Você envia a foto de uma pessoa, produto ou personagem e pede que ele apareça em uma cena nova. O modelo tenta preservar a identidade do sujeito e trocar todo o resto.
Referência de estilo. Você envia uma imagem cuja estética quer reproduzir e pede que a paleta, textura ou linguagem visual seja aplicada a outra imagem ou a uma cena descrita em texto.
Referência de composição. Você envia um esboço, uma foto mal tirada ou um rascunho e pede que ele seja transformado em imagem acabada mantendo o arranjo dos elementos.
Vale um cuidado prático: quanto mais limpa a referência, melhor o resultado. Imagens com fundo bagunçado fazem o modelo carregar elementos do cenário sem que você tenha pedido. Se a sua referência tiver esse problema, remover o fundo antes de enviar melhora bastante o resultado.
Texto e infográficos
Renderização de texto legível é um dos avanços mais visíveis desta geração de modelos, e é justamente onde o Nano Banana Pro se justifica. Cartaz com título e subtítulo, infográfico com rótulos, diagrama a partir de anotações, capa com nome de marca — tudo isso saía torto até pouco tempo atrás e hoje sai limpo na maior parte das tentativas.
Três coisas melhoram muito o resultado com texto:
- Escrever o texto exato entre aspas. Sem isso, o modelo interpreta a palavra como tema e pode parafrasear.
- Descrever a hierarquia. "Título grande no topo, subtítulo menor abaixo, três blocos de texto curto na base" dá muito mais controle que deixar em aberto.
- Usar o modelo Pro. Layout denso e texto pequeno são exatamente o caso em que a diferença entre os modelos aparece.
Ainda assim, para peças em que a tipografia precisa ser a da marca, o caminho mais confiável continua sendo gerar a imagem sem texto e adicionar o texto depois, com a fonte certa.
Oito pedidos prontos para o dia a dia
Modelos que cobrem as necessidades mais comuns. Troque o que estiver entre colchetes e mantenha o resto.
Imagem de topo para artigo
Post quadrado para rede social
Cartaz com título
Trocar o fundo de uma foto
Variação de estilo
Mockup de produto
Infográfico simples
Limpar uma foto
Consistência de personagem no Gemini
Como a edição é conversacional, o método mais eficaz é também o mais simples: permanecer no mesmo fio de conversa. Depois de gerar o personagem, peça as próximas cenas sem redescrevê-lo — "agora mostre o mesmo personagem sentado em um café" — e o contexto acumulado faz o trabalho.
Quando a série for longa ou você precisar retomar em outro dia, use a imagem como referência de sujeito e mantenha uma descrição fixa dos traços permanentes, repetida palavra por palavra. O guia de consistência de personagem com IA detalha os quatro métodos e quando cada um compensa.
Gemini ou ChatGPT: o que muda na prática
| Aspecto | Gemini | ChatGPT |
|---|---|---|
| Estilo de prompt | Prosa conversacional | Prosa conversacional |
| Edição por conversa | Forte, com boa preservação do original | Forte, com boa preservação do original |
| Múltiplas imagens de entrada | Ponto forte, incluindo transferência de estilo | Suportado |
| Texto na imagem | Muito bom, melhor ainda no modelo Pro | Muito bom |
| Escolha de modelo | Explícita: Rápido, Raciocínio ou Pro | Instantâneo ou raciocínio, conforme o plano |
| Resolução de download | 1K no gratuito, 2K com plano | Até 2K |
As duas ferramentas convergiram bastante. O critério prático é testar o mesmo pedido nas duas e comparar — e usar a que entrega melhor no seu tipo de imagem. O guia do ChatGPT para criar imagens cobre o outro lado em detalhe, e o comparativo das melhores IAs para criar imagens coloca as principais opções lado a lado.
O que o Gemini não faz bem
- Pessoas reais identificáveis. Geração de figuras públicas é bloqueada, e reformular o pedido não contorna.
- Marcas e personagens licenciados. Logotipos de empresas existentes e personagens protegidos são recusados.
- Vetor de verdade. A saída é sempre rasterizada. Para arquivo editável em curvas, o resultado serve como referência para redesenhar.
- Fundo transparente confiável. Mesmo pedindo, costuma vir fundo sólido. A transparência é mais rápida de resolver depois.
- Fidelidade absoluta ao editar sua foto. Ao alterar uma imagem enviada, o modelo regenera a cena e detalhes finos mudam.
- Volume alto sem plano. A cota diária no uso gratuito é limitada.
Sete erros que mais atrapalham
- Usar o modelo Pro para testar. Gasta cota que faria falta na versão final.
- Escrever em formato de tags. Lista de palavras é a linguagem de outras ferramentas; aqui, prosa rende mais.
- Não dizer a proporção. Sem indicação, o formato quase nunca é o que você precisa.
- Reescrever o prompt a cada tentativa. Você perde o que já tinha acertado. Peça correções pontuais.
- Enviar referência com fundo bagunçado. O modelo carrega elementos do cenário sem você pedir.
- Salvar por captura de tela. Perde resolução e adiciona recompressão.
- Publicar sem otimizar. Imagens em 2K pesam muito e derrubam o carregamento de qualquer página.
Depois de gerar: preparar a imagem
A imagem que sai do Gemini está pronta para ser vista, não para ser publicada. Quatro passos resolvem.
Converter o formato. PNG é ótimo para transparência e ruim para foto na web. Para site, WebP costuma reduzir o peso pela metade sem diferença visível; para envio comum, JPG resolve. O conversor de imagem faz a troca no navegador, e o guia de formatos de imagem ajuda a escolher.
Reduzir o peso. Uma imagem em 2K passa facilmente de vários megabytes. O compressor de imagem corta boa parte disso sem perda visível.
Ajustar tamanho e enquadramento. Para uma medida específica, use o redimensionador; se a proporção saiu diferente do necessário, recortar preserva mais qualidade do que esticar.
Isolar o sujeito quando precisar. Para produtos, logos e elementos que vão sobre fundo colorido, remover o fundo entrega o PNG transparente que a geração não produz.
💡 Ordem que funciona: baixar em resolução cheia → recortar ou redimensionar → converter o formato → comprimir por último. Comprimir antes de redimensionar desperdiça qualidade.
Checklist antes de gerar
- O modelo escolhido corresponde à complexidade do pedido?
- A proporção está declarada?
- O prompt está em prosa, com sujeito, ação e cena?
- Se houver texto, ele está entre aspas e com posição definida?
- As referências enviadas têm fundo limpo?
- Você está pedindo correção em vez de reescrever tudo?
- Vai baixar em resolução cheia, e não por captura de tela?
Converta suas imagens para o formato certo
Transforme o PNG pesado do Gemini em WebP ou JPG e deixe a imagem pronta para publicar, direto no navegador.
Converter imagem