Como manter o mesmo estilo em uma série de fotos geradas no Gemini

série de fotos com o mesmo estilo geradas no Gemini usando Nano Banana Pro
Resposta rápida

Manter o mesmo estilo de fotos no Gemini é escolha de modelo mais método de prompt, não sorte 🙂 O Gemini gera imagem com a família apelidada de Nano Banana, e as versões não servem pra mesma coisa: o Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) não foi projetado pra múltiplas referências nem várias edições, o Nano Banana 2 (Gemini 3.1 Flash Image) aceita várias imagens de referência e o Nano Banana Pro (Gemini 3 Pro Image) compõe a partir de até 14 imagens de entrada, mantendo a semelhança de até 5 pessoas. O resto é prompt-base congelado, papel declarado de cada referência e formato travado do começo ao fim

Fala aí, beleza? Toda pessoa que produz imagem em volume já viveu isso: a primeira sai linda, e as cinco seguintes vêm com outra paleta, outro enquadramento e um personagem que parece primo distante do original

Série consistente não é sorte

É escolha de modelo MAIS método de prompt, nessa ordem

O Gemini gera e edita imagem com a família de modelos apelidada de Nano Banana, e hoje ela tem versões distintas convivendo: Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image), Nano Banana 2 (Gemini 3.1 Flash Image) e Nano Banana Pro (Gemini 3 Pro Image), cada uma pra um uso, segundo a documentação da API do Gemini

E o teto dessa família é o Nano Banana Pro, descrito pelo Google como o de maior consistência, conhecimento de mundo e controle criativo, justamente o que uma série pede

Saber qual deles está rodando por baixo muda TUDO quando o assunto é série

Bora ver na prática?

Formação Vibe Coding
Formação Recomendada

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

O que você precisa antes de começar a série

Antes de disparar o primeiro prompt, deixa três coisas resolvidas

1. O caminho da geração de imagem

No app do Gemini, a geração de imagem é acessada pela ferramenta de criar imagens, no menu de ferramentas

2. Qual modelo de imagem vai rodar

E aqui mora o pulo do gato: no app, o modelo de imagem que roda depende do modelo Gemini que você selecionou no menu

Com o Gemini em Flash-Lite, roda o Nano Banana 2 Lite

Com o Gemini em Flash ou Pro, roda o Nano Banana 2

E com o Gemini em Pro, refazendo a imagem quando você precisa de mais detalhe, entra o Nano Banana Pro, descrito pelo Google como o de maior consistência, conhecimento de mundo e controle criativo

Apelido Nome técnico O que ele oferece pra série
Nano Banana 2 Lite Gemini 3.1 Flash Lite Image Não foi projetado pra múltiplas imagens de referência nem pra várias edições em sequência
Nano Banana 2 Gemini 3.1 Flash Image Aceita múltiplas imagens de referência
Nano Banana Pro Gemini 3 Pro Image Compõe a imagem final a partir de até 14 imagens de entrada e mantém a semelhança de até 5 pessoas

3. O kit de referência e o formato fechado

Separe as imagens de referência ANTES: uma pro personagem, uma pro estilo, uma pro ambiente

Se você ainda não brincou de enviar uma imagem no Gemini, vale entender esse fluxo primeiro, porque a série inteira depende dele

E decida proporção e resolução na largada, não no meio do lote 😀

Passo a passo para gerar uma série que conversa entre si

  1. Escolha o modelo certo pro trabalho. Série é edição repetida com várias referências, e o Nano Banana 2 Lite não foi projetado pra isso: nem pra múltiplas referências, nem pra várias edições em sequência. O erro comum deste passo: começar a série com o Gemini em Flash-Lite e culpar o prompt depois, quando o problema era o modelo que estava rodando por baixo
  1. Monte o kit de referência. O Nano Banana Pro compõe a imagem final a partir de até 14 imagens de entrada e mantém a semelhança de até 5 pessoas, e na API dá pra misturar até 14 imagens de referência. O erro comum deste passo: jogar dez imagens soltas achando que mais referência é sempre melhor, sem dizer pra que serve cada uma
  1. Escreva o prompt-base. A orientação oficial de prompt do Google pede detalhar sujeito, composição, ação, local e estilo, e depois refinar com ângulo de câmera, iluminação e integração de texto. Esse texto vira o esqueleto de TODA imagem do lote. O erro comum deste passo: escrever um prompt curtinho tipo "foto da personagem no café, estilo cinematográfico" e esperar que a próxima geração adivinhe o resto
   PROMPT-BASE CONGELADO
   Sujeito: mulher de 30 anos, cabelo curto castanho, jaqueta jeans clara
   Composicao: retrato de meio corpo, sujeito a esquerda do quadro
   Acao: (varia) segurando uma xicara
   Local: cafeteria com janela grande ao fundo
   Estilo: fotografia editorial, cores quentes e suaves, grao leve
   Camera: lente 50mm, na altura dos olhos
   Iluminacao: luz natural lateral vinda da janela

   Papel das referencias:
   imagem A: pose do personagem
   imagem B: estilo de arte
   imagem C: ambiente do fundo
  1. Declare o papel de cada imagem enviada. Essa parte vem do próprio exemplo do Google nas dicas de prompt do Nano Banana Pro: use a imagem A para a pose do personagem, a imagem B para o estilo de arte e a imagem C para o ambiente do fundo. O erro comum deste passo: subir as três e não falar nada, deixando o modelo decidir sozinho qual delas manda no visual
  1. Trave o formato. Os modelos de imagem do Gemini 3 geram em 1K por padrão e podem sair em outras resoluções: 512px, 2K e 4K, com o K em maiúscula no parâmetro image_size. E o Gemini 3.1 Flash Lite Image tem lista fechada de proporções: 1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9. O erro comum deste passo: misturar 16:9 e 4:5 no mesmo lote e só perceber na hora de montar o carrossel
  1. Gere variando SÓ o que precisa mudar. O prompt-base fica idêntico, palavra por palavra, e você mexe em um campo por vez: a ação, o ângulo, o local. O erro comum deste passo: reescrever o prompt do zero a cada imagem, achando que está "melhorando", e entregar cinco estilos diferentes
  1. Refaça pedindo mais detalhe quando a imagem não segurar o padrão. Com o Gemini em Pro e a imagem refeita pedindo mais detalhe, entra o Nano Banana Pro, que é o de maior consistência e controle criativo. O erro comum deste passo: aceitar a primeira saída fraca e tentar consertar tudo depois no editor

Quando a série sai fora do padrão: o que costuma estar acontecendo

Tome cuidado com esses quatro sintomas, eles têm causa conhecida

Sintoma: o personagem muda de rosto entre uma imagem e outra

Causa provável: o próprio Google reconhece que a consistência do personagem entre edições costuma funcionar, mas pode variar, e diz que segue trabalhando pra deixar isso mais confiável

Ou seja: não é você fazendo errado necessariamente, é uma limitação assumida

Sintoma: as referências parecem ignoradas, e cada edição em sequência degrada mais

Causa provável: você está no Nano Banana 2 Lite, que não foi projetado pra múltiplas imagens de referência nem pra várias edições em sequência

Subir pro Gemini em Flash ou Pro coloca o Nano Banana 2 em jogo, que aceita várias referências

Sintoma: o enquadramento dança de uma imagem pra outra

Causa provável: proporção não fixada

O Gemini 3.1 Flash Lite Image trabalha com uma lista fechada de proporções, então escolha UMA e repita ela até o fim do lote

Sintoma: a imagem sai sem o detalhe que o projeto exige

Causa provável: falta de refino

Com o Gemini em Pro, refazer a imagem pedindo mais detalhe aciona o Nano Banana Pro, descrito como o de maior consistência e controle criativo

E como prevenir os quatro de uma vez? Prompt-base congelado, mesmo conjunto de referências com papel declarado e mesma proporção do começo ao fim

Simples assim 🙂

Onde a série consistente resolve de verdade

Esse método não é preciosismo, ele aparece no resultado quando o volume é alto

  • Capas e miniaturas de uma sequência de conteúdos: fixo o estilo, a paleta e o enquadramento, varia só o elemento central de cada episódio
  • Carrossel com o mesmo personagem em cenas diferentes: fixo as referências de personagem e de estilo de arte, varia a ação e o local
  • Banco de imagens de um mesmo cenário para um projeto: fixo a referência de ambiente e a iluminação, varia o ângulo de câmera
  • Variações de um produto sob a mesma luz: fixo o local, a iluminação e a proporção, varia a pose do produto no quadro

Repara no padrão: o que fica fixo é sempre referência e estilo

O que varia é ação, ângulo e local

Vídeo relacionado

Se liga também neste vídeo do canal, pra continuar vendo IA na prática depois que fechar o seu lote

Fechando: método fixo, variação controlada

O que sustenta uma série que conversa entre si é bem menos místico do que parece

Modelo certo (o Lite não foi pensado pra múltiplas referências nem múltiplas edições), referências com papel declarado no formato que o próprio Google sugere, prompt-base repetido palavra por palavra e formato travado do primeiro ao último arquivo

E vale a honestidade: o Google mesmo diz que a consistência entre edições costuma funcionar, porém pode variar

Então o próximo passo prático é rodar uma série CURTA de teste com o prompt-base congelado antes de mandar o lote inteiro, pra ver se o padrão segura

Ah, e lembra disso: toda imagem gerada pelas ferramentas de IA do Google recebe a marca d’água invisível SynthID, imperceptível e resistente a corte, filtro e compressão

Dá até pra checar depois, enviando a imagem no app do Gemini e perguntando se ela foi criada com IA do Google

Até o próximo post! 😀

Perguntas frequentes

Qual a diferença entre Nano Banana 2 e Nano Banana Pro numa série de fotos?

O Nano Banana 2 (Gemini 3.1 Flash Image) aceita várias imagens de referência, o que já ajuda a manter o padrão. Já o Nano Banana Pro (Gemini 3 Pro Image) compõe a imagem final a partir de até 14 imagens de entrada e mantém a semelhança de até 5 pessoas, sendo descrito pelo Google como o de maior consistência e controle criativo. Ele entra quando você está com o Gemini em Pro e refaz a imagem pedindo mais detalhe.

O Nano Banana 2 Lite serve para gerar uma série de fotos em sequência?

Não é o caminho ideal. O Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) não foi projetado para múltiplas imagens de referência nem para várias edições em sequência. Ele roda quando o Gemini está selecionado em Flash-Lite, então pra série vale trocar pro Flash ou pro Pro.

Quantas imagens de referência dá para usar de uma vez no Gemini?

Na API do Gemini é possível misturar até 14 imagens de referência para produzir a imagem final. O Nano Banana Pro segue esse mesmo limite: compõe a imagem a partir de até 14 imagens de entrada e mantém a semelhança de até 5 pessoas. O importante é declarar o papel de cada uma, tipo pose, estilo e ambiente, em vez de só empilhar imagens.

Qual resolução e proporção usar para não quebrar o padrão visual da série?

Os modelos de imagem do Gemini 3 geram em 1K por padrão e também saem em 512px, 2K e 4K. Se a etapa envolver o Gemini 3.1 Flash Lite Image, a lista de proporções é fechada: 1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9. Escolher esse formato antes de gerar a primeira imagem evita ter que remontar o lote depois.

Por que o rosto do personagem varia entre uma imagem e outra da série?

O próprio Google reconhece que a consistência do personagem entre edições costuma funcionar, mas pode variar, e diz que segue trabalhando para deixar isso mais confiável. Não é necessariamente erro de prompt, é uma limitação assumida pelo próprio fabricante. Por isso o passo de refazer a imagem em Pro, com o Nano Banana Pro, ajuda a recuperar o padrão.

Como confirmar se uma foto da série foi gerada com IA do Google?

Toda imagem gerada pelas ferramentas de IA do Google recebe a marca d’água invisível SynthID, resistente a corte, filtro e compressão. Para checar, basta subir a imagem no app do Gemini e perguntar se ela foi criada com IA do Google, o que dispara a verificação do SynthID.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação SAAS com IA

Formação SAAS com IA

Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!

  • 291 aulas
  • 18 projetos
  • 24h 17min

Blog | Mais populares