ChatGPT para fotografia: como gerar e editar imagens (e onde a ferramenta erra)

ChatGPT fotografia: geração e edição de imagens no ChatGPT Images 2.0
Resposta rápida

O ChatGPT para fotografia hoje roda no ChatGPT Images 2.0, anunciado pela OpenAI em 21 de abril de 2026. A versão padrão está disponível em todos os planos, incluindo o gratuito, e o modo com raciocínio fica em Plus, Pro e Business (Enterprise e Edu previstos para depois). Pra gerar, você descreve a imagem na conversa ou usa a área Images. Pra editar, tem dois caminhos: marcar a área com o botão Select ou descrever a mudança direto no chat. A própria OpenAI admite falha em tarefas complexas, detalhes muito finos e raciocínio físico

Pedir uma imagem pro ChatGPT é fácil

pedir A imagem que você tem na cabeça é outra história 😅

Fala aí, beleza? O modelo de imagem atual do ChatGPT é o ChatGPT Images 2.0, anunciado pela OpenAI em 21 de abril de 2026

E a diferença entre um resultado massa e um resultado esquisito quase sempre mora na descrição, não na ferramenta

Então bora fazer o completão: como gerar, como editar em cima do que já saiu, e quais pedidos simplesmente não funcionam (com os limites que a própria OpenAI assume)

O que você precisa antes de começar

Nada de instalação, nada de next, next e finish: tudo acontece dentro do ChatGPT mesmo

A lista curta:

  • Conta no ChatGPT: a versão padrão do Images 2.0 está disponível em todos os planos, incluindo o gratuito
  • Plano pago (Plus, Pro ou Business) se você quiser o modo com raciocínio, o tal Images with thinking. Enterprise e Edu estão previstos pra depois
  • A imagem de referência em mãos, caso o objetivo seja editar em vez de criar do zero

Se seu caso é só "quero ver como fica", o padrão já resolve

se é "preciso de várias opções da mesma ideia", aí o modo com raciocínio entra em cena, e eu explico o porquê mais abaixo

Formação Vibe Coding
Formação Recomendada

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Como gerar uma imagem no ChatGPT passo a passo

A parte boa: não tem menu escondido, tu literalmente conversa

  1. Peça a imagem: descreva a imagem desejada direto na conversa, ou selecione Images e escreva o prompt ali

O erro comum deste passo: prompt vago tipo "faz uma foto bonita de um café". Isso deixa TODA decisão na mão do modelo, e aí a culpa do resultado genérico é sua, não dele 😛

  1. Estruture a descrição: assunto, enquadramento, luz, estilo e o texto que deve aparecer na imagem

Um molde simples que tu pode copiar e adaptar:

Assunto: xícara de café expresso sobre balcão de madeira clara
Enquadramento: close, câmera na altura do balcão, fundo desfocado
Luz: luz natural lateral vindo da esquerda, sombra suave
Estilo: fotografia realista, cores quentes
Texto na imagem: a palavra "ABERTO" numa plaquinha ao fundo

O erro comum deste passo: esquecer de dizer ONDE o texto entra na imagem. Se você não indica o lugar e o suporte (placa, embalagem, camiseta), o modelo escolhe por você

  1. Use a área Images da barra lateral quando você não sabe nem por onde começar: ela tem filtros predefinidos e prompts em alta

É tipo entrar num estúdio com os presets já montados: serve pra sair do zero e depois refinar no seu texto

O erro comum deste passo: ficar preso no preset e nunca escrever a sua própria descrição. Filtro é ponto de partida, não entrega final

  1. Envie uma referência de aparência (likeness) uma única vez pra reutilizar nas criações seguintes

É o que evita aquele efeito "cada imagem parece outra pessoa"

O erro comum deste passo: pedir várias mudanças de uma vez no mesmo prompt (muda o rosto, muda o fundo, muda a luz, coloca texto). Um pedido por vez sai MUITO mais previsível

Como editar uma imagem no ChatGPT (os dois caminhos)

Aqui é onde a ferramenta brilha de verdade, e onde a galera erra mais

O passo a passo abaixo segue o que está na central de ajuda da OpenAI sobre imagens no ChatGPT

  1. Escolha a imagem: selecione uma imagem gerada pelo ChatGPT Images ou envie uma imagem existente

No celular, segundo essa mesma documentação, o envio é pelo ícone + na área do prompt, opção Add photos & files

  1. Caminho A, com seleção: clique na imagem e use o botão Select, que a documentação posiciona no canto superior direito da janela da imagem, pra marcar a parte que você quer mudar. Aí descreve a mudança no chat

O erro comum deste passo: descrever a área em vez de marcá-la ("aquele negócio ali no canto de cima"). Se dá pra apontar com a ferramenta de seleção, aponta 🙂

  1. Caminho B, sem seleção: pula a marcação e descreve a edição direto na conversa

Bom pra mudança que afeta a imagem inteira, tipo trocar o clima da cena

O erro comum deste passo: pedir edição e recriação na mesma frase ("tira o carro do fundo e gera outra versão dessa cena"). São dois pedidos, mande em duas mensagens

  1. Saiba o que dá pra pedir: a OpenAI descreve que o modelo lida com adicionar, subtrair, combinar, mesclar (blend) e transpor elementos

E tem um comportamento que muda o jogo em foto real: ao editar uma imagem enviada, o modelo altera apenas o que foi pedido e preserva iluminação, composição e a aparência das pessoas

Ou seja, dá pra fazer ajuste cirúrgico sem a cena inteira virar outra coisa

Versão padrão x modo com raciocínio: qual usar em cada caso

O padrão atende todo mundo

o thinking é o modo que para pra pensar antes de desenhar

E vale pros dois: a geração de imagens ficou até 4 vezes mais rápida em relação à versão anterior

Critério Versão padrão Modo com raciocínio
Disponibilidade Todos os planos, incluindo o gratuito Plus, Pro e Business (Enterprise e Edu em breve)
O que acrescenta Geração direta a partir da sua descrição Raciocínio, uso de ferramentas, busca na web ao vivo e múltiplas imagens a partir de um único prompt

Se você já mexeu com raciocínio estendido no Claude Code, a lógica é a mesma ideia aplicada a imagem: mais processo antes da resposta

Quando o padrão basta? Pedido claro, referência visual simples, ajuste pontual em foto que você já tem

Quando o modo com raciocínio compensa? Quando o pedido depende de informação que o modelo precisa buscar, ou quando você quer várias variações de uma vez em cima do mesmo prompt

Onde o ChatGPT erra nas imagens (e o que fazer)

Os limites abaixo são os que a própria OpenAI assume no anúncio do modelo

Tarefas complexas e quebra-cabeças:

Sintoma: você pede uma cena com muita regra interna (peças que encaixam, montagem cheia de condições) e volta algo que parece certo de longe e desmorona de perto

Causa: tarefas complexas e quebra-cabeças ainda são difíceis demais pro modelo

O que fazer: quebrar em etapas. Gera a base, valida, e só então pede a próxima camada em cima

Detalhes muito finos:

Sintoma: a textura minúscula sai borrada ou inventada

Causa: detalhe muito fino é limite assumido, e o exemplo que a OpenAI dá é bem literal: grãos de areia

O que fazer: não apostar a entrega no micro detalhe. Se o valor da imagem está no detalhe minúsculo, é foto de verdade que resolve, não geração

Raciocínio físico:

Sintoma: sombra que não bate com a luz, objeto apoiado em nada, reflexo que não faz sentido

Causa: o raciocínio físico continua fraco

O que fazer: revisar antes de publicar e corrigir com edição pontual, marcando a área com Select em vez de mandar regerar tudo

E o que NÃO é mais limitação:

Texto dentro da imagem melhorou

a renderização em inglês ficou mais confiável e o suporte foi ampliado a japonês, coreano, chinês, hindi e bengali, incluindo texto mais denso e menor

Então aquele reflexo antigo de "não peça texto pra IA" merece um teste novo antes de virar regra na sua cabeça

A prevenção, resumindo: quebre o pedido em etapas, cheque o resultado antes de publicar e não terceirize precisão técnica pro modelo

Quando vale usar o ChatGPT para fotografia (e quando não vale)

Vale muito quando o trabalho é variação e ajuste:

  • Gerar várias versões da mesma ideia mudando luz, enquadramento ou estilo
  • Ajuste pontual em foto enviada, com iluminação, composição e aparência das pessoas preservadas
  • Combinar, mesclar e transpor elementos entre imagens
  • Arte com texto embutido, tipo cartaz, capa e post
  • Reuso de aparência via likeness, mandando a referência uma vez só

Não vale quando a entrega depende de precisão:

  • Qualquer coisa que dependa de física correta na cena
  • Detalhe minúsculo que precisa estar exato
  • Montagem complexa cheia de regras encadeadas

E tem um ponto de regra que mudou e muita gente ainda não percebeu: no lugar do bloqueio técnico geral usado na linha DALL-E, agora figuras públicas que não querem ser retratadas podem optar por sair (opt-out)

Muda o desenho da coisa: o padrão deixou de ser "bloqueado pra todo mundo" e passou a depender da escolha de cada figura pública, então antes de planejar uma peça com gente famosa vale contar com a possibilidade daquela pessoa ter pedido pra ficar de fora

E claro, imagem é só uma das frentes de uso de IA no seu dia. Se a sua dúvida é qual ferramenta usar pra pesquisa com fonte, tem aqui no blog uma comparação entre NotebookLM, ChatGPT e Gemini que resolve essa parte

Conclusão

A imagem não sai sozinha do ChatGPT: ela sai acompanhada

As imagens geradas no ChatGPT, no Codex e na API da OpenAI carregam metadados C2PA e marca d’água invisível SynthID

Vale saber a diferença entre os dois: o metadado C2PA é frágil e pode ser removido ou perdido em upload, download, mudança de formato, redimensionamento ou captura de tela, enquanto o SynthID sobrevive melhor a essas transformações

E se um pedido seu for barrado, não é bug: o ChatGPT Images 2.0 aplica três camadas de segurança, uma no prompt de entrada, uma na imagem de entrada e uma na análise da imagem final antes de exibir

Próximo passo? Começa pequeno: pega uma foto sua, clica nela, usa o botão Select numa área específica e pede UMA mudança só

É o jeito mais rápido de sentir o que o modelo preserva e o que ele reescreve

E quem quer automatizar isso em volume, o caminho é o modelo na API, o gpt-image-2

Até o próximo post! 😀

Perguntas frequentes

Preciso pagar pra gerar imagem no ChatGPT?

Não. A versão padrão do ChatGPT Images 2.0 está disponível em todos os planos, incluindo o gratuito. Só o modo com raciocínio (Images with thinking) fica restrito aos planos Plus, Pro e Business, com Enterprise e Edu previstos pra depois.

Dá pra editar uma foto que eu já tenho sem perder a aparência da pessoa?

Dá sim. Ao editar uma imagem enviada, o modelo altera só o que foi pedido e preserva iluminação, composição e a aparência das pessoas. Isso vale tanto pelo caminho com a ferramenta Select quanto pela descrição direta no chat.

O modo com raciocínio do ChatGPT vale a pena pra fotografia?

Vale quando o pedido depende de busca na web ou quando você quer várias variações da mesma ideia de uma vez, já que o thinking soma uso de ferramentas, busca ao vivo e múltiplas imagens por prompt. Pra ajuste pontual em foto simples, a versão padrão já resolve.

Imagem gerada pelo ChatGPT tem marca d’água?

Sim. As imagens do ChatGPT, do Codex e da API da OpenAI carregam metadados C2PA e uma marca d’água invisível chamada SynthID. O C2PA é frágil e pode se perder em upload, download ou print, enquanto o SynthID costuma sobreviver melhor a essas transformações.

O ChatGPT consegue colocar texto certo dentro da imagem?

A renderização de texto em inglês melhorou, e o suporte a japonês, coreano, chinês, hindi e bengali também avançou, incluindo texto mais denso e pequeno. Ainda assim, vale indicar no prompt onde e em qual suporte o texto deve aparecer, pra não deixar essa escolha só pro modelo.

Por que o ChatGPT erra em imagens com muitos detalhes pequenos?

A própria OpenAI reconhece que quebra-cabeças, tarefas complexas e detalhes muito finos (como grãos de areia) ainda são difíceis demais pro modelo, e que o raciocínio físico continua fraco. Nesses casos o caminho é quebrar o pedido em etapas menores em vez de tentar tudo num prompt só.



Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação SAAS com IA

Formação SAAS com IA

Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!

  • 291 aulas
  • 18 projetos
  • 24h 17min

Blog | Mais populares