Por que a foto que você gerou no Gemini sai errada? Os erros mais comuns no pedido

erros mais comuns ao gerar uma foto no Gemini
Resposta rápida

Se a foto no Gemini saiu com rosto trocado, cenário sem graça ou letra borrada, na maioria das vezes o problema está no pedido, não no modelo. O Google orienta declarar que você quer uma imagem, descrever a cena em um parágrafo narrativo (sujeito, composição, ação, local, estilo), informar a finalidade, trocar comando negativo por descrição positiva e refinar em turnos. Some a isso as limitações declaradas do Gemini 3.1 Flash Image, como texto pequeno borrado na saída em 1K. Este post vai defeito por defeito e mostra o ajuste exato na descrição

Fala aí, beleza? A imagem já está na sua tela e você sabe que ela está errada: o rosto ficou estranho, o cenário parece banco de imagens ou a placa virou um borrão de letras

A vontade é culpar o modelo

Só que, na maior parte dos casos, o defeito não nasce no modelo, nasce em COMO o pedido foi escrito

Então aqui a gente inverte o tutorial: parte do resultado ruim que você já tem e vai até o ajuste exato na descrição

Cada seção abaixo tem sintoma, causa e o que mudar no pedido, sempre em cima do que o Google documenta =)

O Gemini respondeu com texto em vez de gerar a imagem:

Sintoma: você descreveu a foto e voltou um parágrafo bonitinho descrevendo a foto, não a foto

Causa: o modelo é multimodal, ele sabe responder em texto e em imagem

Se você não declara qual saída quer, ele pode escolher o texto

Solução: a documentação orienta declarar a intenção com algo como crie uma imagem de ou gere uma imagem de

Formação Vibe Coding
Formação Recomendada

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

É literalmente isso, abrir o pedido dizendo o formato de saída antes de descrever a cena

Como prevenir: todo pedido começa pela declaração de saída, depois vem a cena

Se você ainda está montando seu primeiro fluxo, vale ver o passo a passo para gerar imagem do zero antes de brigar com o refino

O cenário saiu genérico, sem clima e parecendo banco de imagens:

Sintoma: a imagem está tecnicamente ok e completamente sem personalidade

Parece aquela foto de reunião sorrindo pro nada

Causa: o pedido virou lista de palavras-chave

Coisa do tipo: mulher, escritório, notebook, luz natural, 4k, cinematográfico

Isso não é cena, é etiqueta

Solução: a orientação oficial do Google é descrever a cena em um parágrafo narrativo, não listar palavras soltas

A descrição narrativa quase sempre gera imagem melhor e mais coerente

E tem os elementos que o Google lista pra entrar no pedido:

  • sujeito
  • composição
  • ação
  • local
  • estilo
  • instruções de edição

Tem mais uma coisa que quase ninguém escreve: a FINALIDADE

O exemplo oficial é claro, pedir crie um logo para uma marca de skincare minimalista e sofisticada funciona melhor que crie um logo

Como prevenir: teste do voz alta

Se alguém lê seu pedido em voz alta e consegue visualizar a cena, tá bom

Se soa como uma lista de compras, reescreve

Quando o assunto é gente na frente da câmera, esse cuidado com a cena pesa ainda mais, e dá pra partir de modelos prontos de ensaio fotográfico em vez de escrever do zero

O enquadramento nunca é o que você imaginou:

Sintoma: o sujeito aparece longe demais, de frente demais, chapado, sempre no mesmo ângulo sem graça

Causa: seu pedido não falou nada de câmera

E aí a composição fica por conta do modelo, que escolhe o caminho mais óbvio

Solução: o Google recomenda usar vocabulário fotográfico e cinematográfico pra controlar a composição

Termos que a própria documentação cita:

  • grande angular
  • macro
  • perspectiva de ângulo baixo
  • lente de retrato 85mm
  • ângulo holandês

Se você conhece um pouco de fotografia, é a mesma linguagem que você usaria falando com um fotógrafo

Só que agora o fotógrafo é o modelo

Como prevenir: fecha todo pedido de foto com uma linha de câmera e uma linha de luz

Vira hábito rápido e muda o resultado de forma absurda

Você pediu pra tirar uma coisa e ela continua na imagem:

Sintoma: você escreveu sem carros e a rua veio lotada de carro

Clássico, né?

Causa: comando negativo

Solução: o Google recomenda o negativo semântico, ou seja, descrever o resultado desejado de forma positiva

Em vez de pedir sem carros, descrever assim:

uma rua vazia e deserta, sem sinal de trânsito

Você parou de dizer o que NÃO quer e passou a dizer o que deve estar ali

Como prevenir: toda vez que a palavra sem aparecer no seu pedido, reescreve a frase dizendo o que ocupa aquele espaço

O texto dentro da imagem sai borrado ou ilegível:

Sintoma: placa, rótulo, capa ou título com letra torta e embaçada

Causa: essa aqui não é culpa sua

Antes de seguir, um esclarecimento rápido que evita confusão no resto do post: Nano Banana 2 é o nome comercial do Gemini 3.1 Flash Image

Mesmo modelo, dois nomes, um de marketing e outro técnico

E o card desse modelo declara limitação de renderização de texto pequeno, que costuma sair borrado na saída em 1K

Parágrafos longos e página inteira de texto também estão na lista de limitações declaradas

Solução: três ajustes que atacam exatamente isso

  1. Cortar a quantidade de texto no pedido, ficar no essencial
  2. Aumentar o tamanho relativo do texto na composição, texto pequeno é justamente o caso citado
  3. Subir a resolução: o Gemini 3.1 Flash Image gera saída em 2K e em 4K, e o borrão de texto pequeno é justamente o caso citado na saída em 1K

O erro comum aqui é insistir no mesmo pedido dez vezes esperando o modelo acertar um parágrafo inteiro

Ele avisou que não é isso que ele faz bem

Como prevenir: trata a imagem como suporte de POUCAS palavras

Texto longo se monta fora dela, num editor

O rosto muda de uma imagem pra outra na mesma sequência:

Sintoma: você gera a primeira cena, o personagem fica ótimo

Na segunda ou terceira, ele já é outra pessoa

Causa: consistência de personagem é ponto forte declarado do Nano Banana 2 (o mesmo Gemini 3.1 Flash Image da seção anterior), mas o próprio Google admite que nem sempre acerta e diz estar trabalhando pra tornar isso mais confiável

A capacidade declarada é de até 5 personagens com consistência e semelhança e até 14 objetos com fidelidade ao longo de um fluxo

Solução:

  1. Manter a descrição do personagem estável entre os pedidos, mesma frase, mesmos traços
  2. Ficar dentro desse limite de personagens e objetos
  3. Corrigir por pedido de acompanhamento em vez de recomeçar do zero

Como prevenir: não empilha meio elenco na mesma cena

Quanto mais gente e mais objeto disputando espaço, mais chance de alguém perder a cara

A cena complexa virou uma bagunça de elementos:

Sintoma: você pediu muita coisa de uma vez e voltou aquilo confuso, com elemento se fundindo em elemento

Causa: um pedido único tentando resolver fundo, primeiro plano e objeto principal ao mesmo tempo

Solução: pra cenas complexas a recomendação oficial é dividir o pedido em etapas

  1. Primeiro o fundo
  2. Depois o elemento em primeiro plano
  3. Por fim o objeto principal

E aí você itera

O Google orienta justamente não esperar a imagem perfeita na primeira tentativa e usar pedidos de acompanhamento pra ajustes pequenos, tipo:

deixe a iluminação mais quente
deixe a expressão do personagem mais séria

Como prevenir: encara a imagem como rascunho que evolui em turnos, não como sorteio

A edição estragou o resto da imagem ou mudou a proporção:

Sintoma: você pediu um ajuste pontual e voltou uma imagem diferente, às vezes até com outro formato

Causa: pedido de edição vago

Na edição o modelo costuma preservar a proporção da imagem de entrada, mas nem sempre

Solução: pra editar, o Google recomenda ser direto e específico sobre o elemento:

mude a gravata do homem para verde
remova o carro ao fundo

E quando o formato mudar, ser explícito:

não altere a proporção da imagem de entrada

Como prevenir: um ajuste por pedido

E proporção declarada quando o formato importa

As proporções suportadas pelos modelos de imagem do Gemini:

Proporções suportadas Onde valem
1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9 modelos de imagem do Gemini
1:4, 4:1, 1:8, 8:1 acrescentadas no Gemini 3.1 Flash Image

Pedi algo específico do mundo real e o Gemini errou o fato:

Sintoma: detalhe factual, referência mais recente ou relação espacial saem errados por mais que você descreva

Causa: o card do modelo declara limitações em conhecimento de mundo, raciocínio 3D e factualidade

E tem corte de conhecimento em janeiro de 2025

Ou seja: aquilo que você acha que ele deveria saber, talvez ele simplesmente não saiba

Solução: não delega o fato pro modelo

Descreve você mesmo o que precisa aparecer na cena, ou envia uma imagem de referência e edita em cima dela

Como prevenir: separa as duas coisas no seu pedido

Estética o modelo resolve

Informação quem fornece é você

Não é o seu pedido: quando o limite é da plataforma

Tem caso em que você pode reescrever mil vezes que não vai melhorar, porque o limite não está na descrição

Sintoma: a qualidade caiu do nada ou simplesmente não dá mais pra gerar

O que está verificado hoje:

  • o padrão no app Gemini e no Google Search é o Nano Banana 2, nome comercial do Gemini 3.1 Flash Image, que entrou no lugar do Nano Banana Pro como modelo dos modos Fast, Thinking e Pro
  • existe cota diária de imagens no app, os limites mudam com frequência e o consumo zera todo dia
  • com a cota do Nano Banana 2 esgotada, não dá mais pra refazer imagens com o Nano Banana Pro
  • é preciso ter pelo menos 18 anos pra gerar e editar imagens nos apps do Gemini

Saída pra quem assina: o Nano Banana Pro não sumiu pra todo mundo, assinantes Google AI Pro e Ultra ainda conseguem usar ele pra tarefas específicas, regerando a imagem pelo menu de três pontos

Como prevenir: guarda as gerações mais exigentes pra quando a cota está fresca

Queimar cota testando bobagem e sobrar zero pro trabalho de verdade é frustrante demais haha

Conclusão: o ajuste que resolve a maioria dos casos

Se você reparar, quase todo defeito lá em cima cai no mesmo punhado de correções

  1. Declarar que você quer uma imagem, com crie uma imagem de ou gere uma imagem de
  2. Descrever a cena em um parágrafo narrativo, cobrindo sujeito, composição, ação, local e estilo
  3. Trocar comando negativo por descrição positiva do que deve estar ali
  4. Informar a finalidade da imagem, pra que ela serve
  5. Refinar em turnos, com pedidos de acompanhamento pequenos

Próximo passo é bem prático: pega o último pedido de foto no Gemini que deu errado, reescreve nesse formato e compara as duas saídas lado a lado

A diferença costuma aparecer logo na primeira rodada

Dois lembretes rápidos antes de fechar

Imagens geradas pelas IAs do Google levam marca d’água invisível SynthID, e dá pra enviar a imagem no chat do Gemini e perguntar se ela foi criada ou editada por IA do Google (a ausência da marca não prova que não é IA, só que não é IA do Google)

E ao gerar imagens nos apps do Gemini você concorda com os Termos de Serviço do Google, incluindo a Política de uso proibido, sendo responsável por não violar direitos autorais ou de privacidade de terceiros

Bora reescrever aquele pedido? 🙂

até o próximo post!

Perguntas frequentes

Qual é a idade mínima para gerar ou editar imagens no Gemini?

Pra gerar e editar imagens nos apps do Gemini é preciso ter pelo menos 18 anos

Esse é um requisito do próprio Google, então não tem workaround no pedido que resolva isso

Por que de repente não consigo mais gerar imagens no Gemini?

O app Gemini tem cota diária de imagens e os limites mudam com frequência, então bateu o teto, é esperar o reset diário

Uma pegadinha: se a cota do Nano Banana 2 esgotou, também não dá pra refazer a imagem usando o Nano Banana Pro

Como saber se uma imagem foi gerada por IA do Google?

Toda imagem criada pelas IAs do Google leva uma marca d’água invisível chamada SynthID

Dá pra enviar a imagem no próprio chat do Gemini e perguntar se ela foi criada ou editada por IA do Google, ele verifica isso

Só um detalhe: a ausência dessa marca não prova que a imagem não é IA, só prova que não é IA do Google

Como faço o Gemini manter a proporção da imagem ao editar?

Na edição o modelo costuma preservar a proporção da imagem de entrada, mas quando isso não acontece o Google recomenda ser explícito no pedido

Algo como não altere a proporção da imagem de entrada resolve

Dá pra usar o Nano Banana Pro em vez do Nano Banana 2 no Gemini?

O padrão hoje é o Nano Banana 2, nome comercial do Gemini 3.1 Flash Image: ele passou a ser o modelo dos modos Fast, Thinking e Pro no app Gemini e no Google Search, no lugar do Nano Banana Pro

Mas o Nano Banana Pro continua acessível pra quem assina Google AI Pro e Ultra, em tarefas específicas

O caminho é regerar a imagem pelo menu de três pontos

Posso usar comercialmente uma imagem gerada no Gemini?

Ao gerar imagens nos apps do Gemini você concorda com os Termos de Serviço do Google, incluindo a Política de uso proibido

E a responsabilidade de não violar direitos autorais ou de privacidade de terceiros é sua, então vale ler essa política antes de usar a imagem em algo comercial



Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação SAAS com IA

Formação SAAS com IA

Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!

  • 291 aulas
  • 18 projetos
  • 24h 17min

Blog | Mais populares