Prompts no Gemini para foto de produto: como descrever cenário, luz e fundo

Prompts Gemini para foto de produto funcionam quando você escreve a cena inteira, não só o objeto. O guia oficial do Google manda descrever sujeito, composição, ação, local e estilo, começar o texto com "A photo of…" e detalhar ao máximo: quanto mais específico, mais controle sobre o resultado. Pra cara de estúdio, nomeie o setup de luz (three-point softbox setup), a superfície, o fundo e a lente (macro, grande-angular, f/1.8). Neste post tem modelos prontos pra fundo branco de marketplace, cena de estilo de vida, macro de textura e variação de ângulo, além do caminho com imagens de referência.
Fala aí, beleza? Sua foto de produto saiu com aquela cara de render genérico de banco de imagens, e não tem nada a ver com o produto ser feio
O motivo quase sempre é o mesmo: o prompt descreve o PRODUTO e esquece a cena inteira em volta dele
O modelo então inventa a cena sozinho, e o que ele inventa é a média da internet: fundo neutro sem graça, luz chapada, sombra que não existe em lugar nenhum
Aqui a gente vai pelo caminho contrário: montar prompts Gemini para foto de produto escrevendo cenário, luz e fundo como três blocos separados do texto, do jeito que o guia oficial recomenda
No fim tem modelo pronto pra copiar e adaptar pro seu catálogo 🙂
O que você precisa antes de escrever o prompt
Antes de sair digitando, vale saber QUEM está gerando a sua imagem, porque o apelido e o nome técnico do modelo são coisas diferentes
| Apelido | Nome técnico |
|---|---|
| Nano Banana Pro | Gemini 3 Pro Image |
| Nano Banana 2 | Gemini 3.1 Flash Image |
| Nano Banana 2 Lite | Gemini 3.1 Flash-Lite Image |
| Nano Banana (original) | Gemini 2.5 Flash Image (tratado como legado) |
No anúncio do Nano Banana 2, o Google informou que ele passou a ser o modelo de imagem nos modos Fast, Thinking e Pro do app Gemini, substituindo o Nano Banana Pro
E que assinantes Google AI Pro e Ultra podem voltar pro Nano Banana Pro regerando a imagem pelo menu de três pontos
Formação Agentes de IA
Domine a criação de Agentes de IA e Venda para Empresas
- 402 aulas
- 32 projetos
- 38h 19min
E se eu estou no plano gratuito?
A ajuda oficial do Gemini diz que o plano gratuito tem acesso LIMITADO ao Nano Banana Pro
Os limites são por computação, não por número fixo de imagens: eles consideram a complexidade do prompt, os modelos usados e o tamanho do chat, e renovam a cada 5 horas até o teto semanal
O Google AI Pro tem limites 2x maiores que o gratuito, e o Ultra 4x
Ou seja: prompt gigante com muita edição em cima come mais do seu limite do que uma geração simples, beleza?
A marca d’água que você não vê
Toda imagem gerada pela IA do Google recebe a SynthID, uma marca d’água invisível adicionada no momento da criação
Ela não altera a qualidade da imagem e resiste a modificações como corte, filtros e compressão com perda
Dá até pra subir a imagem no Gemini e perguntar se ela foi criada ou editada com IA do Google
Vale saber disso antes de mandar a foto pro catálogo, porque o rastro fica ali
Do seu lado, o material
- foto do produto que você já tem, mesmo tirada no celular, se for usar como referência
- a descrição honesta do material e do acabamento (fosco, escovado, translúcido, texturizado)
- a decisão de onde a imagem vai parar: ficha de marketplace, banner, post
O Nano Banana Pro também aparece em Google Ads e Workspace, entre outros, e o Nano Banana 2 segue em rollout na Busca e no Ads
Se quiser ver onde o Gemini já está integrado, tem um mapa desses produtos aqui no blog
Como descrever cenário, luz e fundo no prompt (passo a passo)
A lógica é a do guia oficial de prompting do Nano Banana: descreva a cena em rico detalhe, porque quanto mais específico você é, mais controle você tem sobre o resultado
E o Google recomenda montar o prompt de imagem com estes elementos: sujeito, composição, ação, local, estilo e instruções de edição
Em foto de produto, alguns desses blocos ficam quase mudos: ação quase não existe (o objeto está parado ali), estilo entra logo na primeira palavra do prompt (fotografia) e instrução de edição só aparece quando você já tem imagem na mão, que é a parte lá do fim do post
Sobram sujeito, composição e local pra carregar o texto, e o guia do Nano Banana detalha dois blocos em cima disso que fazem toda a diferença: luz e câmera
Vamos escrever um bloco de cada vez
- Abra o prompt sinalizando que é FOTO (o bloco de estilo)
O guia oficial orienta começar prompts de foto com palavras que sinalizem fotografia, tipo "A photo of…"
A photo of a matte black ceramic coffee mugO erro comum deste passo: começar com "crie uma imagem de um produto", que é um pedido genérico e abre espaço pro modelo escolher ilustração, render 3D ou sei lá o quê
- Descreva o sujeito com material e acabamento
Sujeito é quem ou o quê, e o guia manda ser específico
Produto não é só o nome dele: é o material, a cor exata, o acabamento e os detalhes que a câmera pega
A photo of a matte black ceramic coffee mug with a glossy interior glaze
and a small embossed logo on the handle sideO erro comum deste passo: escrever "caneca preta" e esperar que a IA adivinhe que o corpo é fosco e o interior é brilhante
- Escolha a composição e o enquadramento
Composição é o enquadramento: o Google cita close extremo, plano aberto, ângulo baixo e retrato como exemplos
..., extreme close-up centered compositionO erro comum deste passo: deixar o enquadramento em aberto e receber sempre o mesmo plano médio chatinho em todas as gerações
- Escreva o local, a superfície e o fundo
Esse é o bloco que quase todo mundo pula
Produto sempre está APOIADO em alguma coisa, e o que está atrás dele também é escolha sua
..., placed on a seamless white studio backdrop,
sitting on a smooth white acrylic surface with a soft reflection underneathO erro comum deste passo: descrever o produto lindamente e não dizer nada sobre a superfície, aí a peça sai flutuando ou apoiada numa mesa aleatória de madeira
- Nomeie o setup de luz, não o sentimento da luz
Aqui mora a diferença entre "parece foto de estúdio" e "parece imagem de IA"
O guia oficial cita termos de iluminação que o modelo entende, incluindo o setup de estúdio:
three-point softbox setuppra luz uniforme, que é o que catálogo pedechiaroscuro lighting with harsh, high contrastpra clima dramáticogolden hour backlighting creating long shadowspra contraluz quente com sombra longa
..., lit with a three-point softbox setup for even, shadowless illuminationO erro comum deste passo: pedir "luz suave e profissional" sem nomear o setup, porque suave é subjetivo e softbox de três pontos é uma descrição de estúdio que o modelo reconhece
- Dite câmera, lente e abertura
O guia orienta ditar câmera, lente e abertura no texto do prompt pra controlar profundidade, distorção e perspectiva
Os exemplos citados: low-angle shot with a shallow depth of field (f/1.8), lente grande-angular pra dar escala e lente macro pra detalhe
Tipos de câmera também mudam a estética (GoPro, Fujifilm, câmera descartável), o que é ótimo quando você QUER a cara de foto casual
..., shot with a macro lens, shallow depth of field (f/1.8)O erro comum deste passo: pedir "fundo desfocado" solto, quando dizer a abertura resolve de forma muito mais previsível
- Defina a entrega: resolução e proporção
Segundo a documentação da Gemini API, os modelos de imagem do Gemini 3 geram em 1K por padrão e aceitam resoluções maiores: 2K e 4K (e 512px/0.5K apenas no Gemini 3.1 Flash Image)
As proporções suportadas são 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9, e o Gemini 3.1 Flash Image acrescenta 1:4, 4:1, 1:8 e 8:1
Tome cuidado: no parâmetro de resolução da API, o K é MAIÚSCULO
1K, 2K, 4K -> aceito
1k, 2k, 4k -> rejeitadoO erro comum deste passo: escrever 1k em minúscula e tomar erro sem entender o motivo
Modelos de prompt prontos para catálogo e e-commerce
Agora é só encaixar os blocos
Os quatro modelos abaixo são a MESMA estrutura, mudando basicamente o bloco de fundo, o bloco de luz e o bloco de lente
1. Fundo branco de marketplace
O clássico da ficha de produto: sem distração, sem sombra dura, produto legível na miniatura
A photo of a matte black ceramic coffee mug with a glossy interior glaze,
centered product composition, full view of the object,
placed on a seamless white studio backdrop with a smooth white surface
and a subtle contact shadow underneath,
lit with a three-point softbox setup for even, shadowless illumination,
shot with a standard lens, everything in sharp focus2. Produto em cena de estilo de vida
Aqui você troca o fundo de estúdio por um local e liga a luz natural
A photo of a matte black ceramic coffee mug with a glossy interior glaze,
wide shot, product placed slightly off-center,
sitting on a wooden kitchen table near a large window,
with golden hour backlighting creating long shadows across the table,
shot with a wide-angle lens to show the scale of the room,
shallow depth of field (f/1.8) on the background3. Macro de textura e acabamento
Esse é pra vender o material: aquela imagem que mostra a costura, o grão, o relevo
A photo of a matte black ceramic coffee mug,
extreme close-up on the embossed logo and the rim of the mug,
against a dark neutral backdrop,
chiaroscuro lighting with harsh, high contrast to reveal surface texture,
shot with a macro lens, shallow depth of field (f/1.8)4. Variação de ângulo da mesma peça
Catálogo bom mostra o produto de mais de um ângulo, então só o bloco de composição muda
A photo of a matte black ceramic coffee mug with a glossy interior glaze,
low-angle shot with a shallow depth of field (f/1.8),
placed on a seamless white studio backdrop,
lit with a three-point softbox setupRepare no que mudou entre os quatro: o produto ficou igual, palavra por palavra
O que virou outra foto foi FUNDO + LUZ + LENTE
E se o seu caso for gente na foto em vez de objeto, a lógica de cena é a mesma que usei no prompt para foto de perfil profissional aqui do blog
Como usar fotos do seu produto como referência
Prompt do zero é ótimo pra conceito, mas catálogo real precisa do SEU produto, com a sua etiqueta e o seu acabamento
Pra isso o guia oficial descreve uma fórmula bem direta:
[imagens de referência] + [instrução de relação entre elas] + [novo cenário]- Junte as imagens de referência
O Nano Banana Pro aceita até 14 imagens combinadas e mantém consistência de até 5 pessoas
O erro comum deste passo: subir 10 fotos parecidas do mesmo ângulo, quando o que ajuda é variar (frente, verso, detalhe do acabamento)
- Escreva a relação entre elas
A fórmula pede que você diga o que é o quê, senão o modelo trata tudo como sugestão solta de estilo
Algo como "use o produto da primeira imagem e o fundo da segunda"
O erro comum deste passo: mandar as imagens sem explicar o papel de cada uma
- Descreva o novo cenário do zero
Essa é a parte onde você reaproveita os blocos do passo a passo lá de cima: superfície, fundo, setup de luz, lente
O erro comum deste passo: achar que a imagem de referência já traz o cenário junto e escrever só "coloca num fundo bonito"
- Ajuste com os controles de estúdio (as instruções de edição)
O Nano Banana Pro oferece controles de nível estúdio sobre a imagem gerada: edição localizada de partes da imagem, ajuste de ângulo de câmera, mudança de foco, color grading e transformação da luz da cena, tipo dia pra noite e efeito bokeh
Ou seja, você não precisa refazer tudo quando a foto já ficou quase boa: mexe só no pedaço
E se você curte ver prompt virando fluxo de trabalho, se liga nesse vídeo do canal:
Conclusão
Foto de produto com cara de estúdio não sai de prompt curto
Sai de cena escrita: sujeito específico, composição, superfície, fundo, setup de luz nomeado e lente definida, que é exatamente o que o guia oficial pede quando fala em descrever a cena em rico detalhe
O próximo passo prático é bem simples: pega um dos modelos daqui, mantém o bloco do produto INTACTO e troca só o bloco de luz e o de fundo
Gera as duas versões, coloca lado a lado e vê qual delas você colocaria na sua ficha de produto
Em duas ou três rodadas você já descobre o seu preset pessoal de catálogo 😀
até o próximo post!
Perguntas frequentes
Qual proporção de imagem usar pra foto de produto de e-commerce no Gemini?
Os modelos de imagem do Gemini aceitam 1:1, 2:3, 3:2, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9 e 21:9, e o Gemini 3.1 Flash Image ainda acrescenta 1:4, 4:1, 1:8 e 8:1. Pra ficha de marketplace o formato quadrado 1:1 costuma casar com o espaço da galeria, mas escolha a proporção pensando em onde a imagem vai parar (banner, post, ficha).
Como usar uma foto real do meu produto como referência no prompt?
O guia oficial do Nano Banana descreve uma fórmula pra quem envia imagem de referência: [imagens de referência] + [instrução de relação entre elas] + [novo cenário]. Ou seja, você manda a foto do produto que já tem e escreve no prompt como ela deve se combinar com o cenário novo que você está pedindo.
Qual resolução escolher pra foto de produto: 1K, 2K ou 4K?
Os modelos de imagem do Gemini 3 geram em 1K por padrão e também aceitam 2K e 4K, com 512px (0.5K) disponível só no Gemini 3.1 Flash Image. Se for gerar pela API, o parâmetro de resolução exige K maiúsculo (1K, 2K, 4K); escrever em minúscula tipo 1k é rejeitado.
Dá pra editar só uma parte da foto gerada, tipo trocar a cor de fundo depois?
Sim, com o Nano Banana Pro. Ele oferece edição localizada de partes da imagem, ajuste de ângulo de câmera, mudança de foco, color grading e transformação da luz da cena, incluindo passar de dia pra noite ou aplicar efeito bokeh.
O Nano Banana Pro mantém o mesmo rosto de pessoa em fotos de produto com modelo?
Sim. O Nano Banana Pro aceita até 14 imagens de referência combinadas e mantém consistência de até 5 pessoas na mesma geração, o que ajuda em fotos de produto que usam modelo humano.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

As diferenças de var, let e const

Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]

ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
