ChatGPT para fotografia: como gerar e editar imagens (e onde a ferramenta erra)

O ChatGPT para fotografia hoje roda no ChatGPT Images 2.0, anunciado pela OpenAI em 21 de abril de 2026. A versão padrão está disponível em todos os planos, incluindo o gratuito, e o modo com raciocínio fica em Plus, Pro e Business (Enterprise e Edu previstos para depois). Pra gerar, você descreve a imagem na conversa ou usa a área Images. Pra editar, tem dois caminhos: marcar a área com o botão Select ou descrever a mudança direto no chat. A própria OpenAI admite falha em tarefas complexas, detalhes muito finos e raciocínio físico
Pedir uma imagem pro ChatGPT é fácil
pedir A imagem que você tem na cabeça é outra história 😅
Fala aí, beleza? O modelo de imagem atual do ChatGPT é o ChatGPT Images 2.0, anunciado pela OpenAI em 21 de abril de 2026
E a diferença entre um resultado massa e um resultado esquisito quase sempre mora na descrição, não na ferramenta
Então bora fazer o completão: como gerar, como editar em cima do que já saiu, e quais pedidos simplesmente não funcionam (com os limites que a própria OpenAI assume)
O que você precisa antes de começar
Nada de instalação, nada de next, next e finish: tudo acontece dentro do ChatGPT mesmo
A lista curta:
- Conta no ChatGPT: a versão padrão do Images 2.0 está disponível em todos os planos, incluindo o gratuito
- Plano pago (Plus, Pro ou Business) se você quiser o modo com raciocínio, o tal Images with thinking. Enterprise e Edu estão previstos pra depois
- A imagem de referência em mãos, caso o objetivo seja editar em vez de criar do zero
Se seu caso é só "quero ver como fica", o padrão já resolve
se é "preciso de várias opções da mesma ideia", aí o modo com raciocínio entra em cena, e eu explico o porquê mais abaixo
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Como gerar uma imagem no ChatGPT passo a passo
A parte boa: não tem menu escondido, tu literalmente conversa
- Peça a imagem: descreva a imagem desejada direto na conversa, ou selecione Images e escreva o prompt ali
O erro comum deste passo: prompt vago tipo "faz uma foto bonita de um café". Isso deixa TODA decisão na mão do modelo, e aí a culpa do resultado genérico é sua, não dele 😛
- Estruture a descrição: assunto, enquadramento, luz, estilo e o texto que deve aparecer na imagem
Um molde simples que tu pode copiar e adaptar:
Assunto: xícara de café expresso sobre balcão de madeira clara
Enquadramento: close, câmera na altura do balcão, fundo desfocado
Luz: luz natural lateral vindo da esquerda, sombra suave
Estilo: fotografia realista, cores quentes
Texto na imagem: a palavra "ABERTO" numa plaquinha ao fundo
O erro comum deste passo: esquecer de dizer ONDE o texto entra na imagem. Se você não indica o lugar e o suporte (placa, embalagem, camiseta), o modelo escolhe por você
- Use a área Images da barra lateral quando você não sabe nem por onde começar: ela tem filtros predefinidos e prompts em alta
É tipo entrar num estúdio com os presets já montados: serve pra sair do zero e depois refinar no seu texto
O erro comum deste passo: ficar preso no preset e nunca escrever a sua própria descrição. Filtro é ponto de partida, não entrega final
- Envie uma referência de aparência (likeness) uma única vez pra reutilizar nas criações seguintes
É o que evita aquele efeito "cada imagem parece outra pessoa"
O erro comum deste passo: pedir várias mudanças de uma vez no mesmo prompt (muda o rosto, muda o fundo, muda a luz, coloca texto). Um pedido por vez sai MUITO mais previsível
Como editar uma imagem no ChatGPT (os dois caminhos)
Aqui é onde a ferramenta brilha de verdade, e onde a galera erra mais
O passo a passo abaixo segue o que está na central de ajuda da OpenAI sobre imagens no ChatGPT
- Escolha a imagem: selecione uma imagem gerada pelo ChatGPT Images ou envie uma imagem existente
No celular, segundo essa mesma documentação, o envio é pelo ícone + na área do prompt, opção Add photos & files
- Caminho A, com seleção: clique na imagem e use o botão Select, que a documentação posiciona no canto superior direito da janela da imagem, pra marcar a parte que você quer mudar. Aí descreve a mudança no chat
O erro comum deste passo: descrever a área em vez de marcá-la ("aquele negócio ali no canto de cima"). Se dá pra apontar com a ferramenta de seleção, aponta 🙂
- Caminho B, sem seleção: pula a marcação e descreve a edição direto na conversa
Bom pra mudança que afeta a imagem inteira, tipo trocar o clima da cena
O erro comum deste passo: pedir edição e recriação na mesma frase ("tira o carro do fundo e gera outra versão dessa cena"). São dois pedidos, mande em duas mensagens
- Saiba o que dá pra pedir: a OpenAI descreve que o modelo lida com adicionar, subtrair, combinar, mesclar (blend) e transpor elementos
E tem um comportamento que muda o jogo em foto real: ao editar uma imagem enviada, o modelo altera apenas o que foi pedido e preserva iluminação, composição e a aparência das pessoas
Ou seja, dá pra fazer ajuste cirúrgico sem a cena inteira virar outra coisa
Versão padrão x modo com raciocínio: qual usar em cada caso
O padrão atende todo mundo
o thinking é o modo que para pra pensar antes de desenhar
E vale pros dois: a geração de imagens ficou até 4 vezes mais rápida em relação à versão anterior
| Critério | Versão padrão | Modo com raciocínio |
|---|---|---|
| Disponibilidade | Todos os planos, incluindo o gratuito | Plus, Pro e Business (Enterprise e Edu em breve) |
| O que acrescenta | Geração direta a partir da sua descrição | Raciocínio, uso de ferramentas, busca na web ao vivo e múltiplas imagens a partir de um único prompt |
Se você já mexeu com raciocínio estendido no Claude Code, a lógica é a mesma ideia aplicada a imagem: mais processo antes da resposta
Quando o padrão basta? Pedido claro, referência visual simples, ajuste pontual em foto que você já tem
Quando o modo com raciocínio compensa? Quando o pedido depende de informação que o modelo precisa buscar, ou quando você quer várias variações de uma vez em cima do mesmo prompt
Onde o ChatGPT erra nas imagens (e o que fazer)
Os limites abaixo são os que a própria OpenAI assume no anúncio do modelo
Tarefas complexas e quebra-cabeças:
Sintoma: você pede uma cena com muita regra interna (peças que encaixam, montagem cheia de condições) e volta algo que parece certo de longe e desmorona de perto
Causa: tarefas complexas e quebra-cabeças ainda são difíceis demais pro modelo
O que fazer: quebrar em etapas. Gera a base, valida, e só então pede a próxima camada em cima
Detalhes muito finos:
Sintoma: a textura minúscula sai borrada ou inventada
Causa: detalhe muito fino é limite assumido, e o exemplo que a OpenAI dá é bem literal: grãos de areia
O que fazer: não apostar a entrega no micro detalhe. Se o valor da imagem está no detalhe minúsculo, é foto de verdade que resolve, não geração
Raciocínio físico:
Sintoma: sombra que não bate com a luz, objeto apoiado em nada, reflexo que não faz sentido
Causa: o raciocínio físico continua fraco
O que fazer: revisar antes de publicar e corrigir com edição pontual, marcando a área com Select em vez de mandar regerar tudo
E o que NÃO é mais limitação:
Texto dentro da imagem melhorou
a renderização em inglês ficou mais confiável e o suporte foi ampliado a japonês, coreano, chinês, hindi e bengali, incluindo texto mais denso e menor
Então aquele reflexo antigo de "não peça texto pra IA" merece um teste novo antes de virar regra na sua cabeça
A prevenção, resumindo: quebre o pedido em etapas, cheque o resultado antes de publicar e não terceirize precisão técnica pro modelo
Quando vale usar o ChatGPT para fotografia (e quando não vale)
Vale muito quando o trabalho é variação e ajuste:
- Gerar várias versões da mesma ideia mudando luz, enquadramento ou estilo
- Ajuste pontual em foto enviada, com iluminação, composição e aparência das pessoas preservadas
- Combinar, mesclar e transpor elementos entre imagens
- Arte com texto embutido, tipo cartaz, capa e post
- Reuso de aparência via likeness, mandando a referência uma vez só
Não vale quando a entrega depende de precisão:
- Qualquer coisa que dependa de física correta na cena
- Detalhe minúsculo que precisa estar exato
- Montagem complexa cheia de regras encadeadas
E tem um ponto de regra que mudou e muita gente ainda não percebeu: no lugar do bloqueio técnico geral usado na linha DALL-E, agora figuras públicas que não querem ser retratadas podem optar por sair (opt-out)
Muda o desenho da coisa: o padrão deixou de ser "bloqueado pra todo mundo" e passou a depender da escolha de cada figura pública, então antes de planejar uma peça com gente famosa vale contar com a possibilidade daquela pessoa ter pedido pra ficar de fora
E claro, imagem é só uma das frentes de uso de IA no seu dia. Se a sua dúvida é qual ferramenta usar pra pesquisa com fonte, tem aqui no blog uma comparação entre NotebookLM, ChatGPT e Gemini que resolve essa parte
Conclusão
A imagem não sai sozinha do ChatGPT: ela sai acompanhada
As imagens geradas no ChatGPT, no Codex e na API da OpenAI carregam metadados C2PA e marca d’água invisível SynthID
Vale saber a diferença entre os dois: o metadado C2PA é frágil e pode ser removido ou perdido em upload, download, mudança de formato, redimensionamento ou captura de tela, enquanto o SynthID sobrevive melhor a essas transformações
E se um pedido seu for barrado, não é bug: o ChatGPT Images 2.0 aplica três camadas de segurança, uma no prompt de entrada, uma na imagem de entrada e uma na análise da imagem final antes de exibir
Próximo passo? Começa pequeno: pega uma foto sua, clica nela, usa o botão Select numa área específica e pede UMA mudança só
É o jeito mais rápido de sentir o que o modelo preserva e o que ele reescreve
E quem quer automatizar isso em volume, o caminho é o modelo na API, o gpt-image-2
Até o próximo post! 😀
Perguntas frequentes
Preciso pagar pra gerar imagem no ChatGPT?
Não. A versão padrão do ChatGPT Images 2.0 está disponível em todos os planos, incluindo o gratuito. Só o modo com raciocínio (Images with thinking) fica restrito aos planos Plus, Pro e Business, com Enterprise e Edu previstos pra depois.
Dá pra editar uma foto que eu já tenho sem perder a aparência da pessoa?
Dá sim. Ao editar uma imagem enviada, o modelo altera só o que foi pedido e preserva iluminação, composição e a aparência das pessoas. Isso vale tanto pelo caminho com a ferramenta Select quanto pela descrição direta no chat.
O modo com raciocínio do ChatGPT vale a pena pra fotografia?
Vale quando o pedido depende de busca na web ou quando você quer várias variações da mesma ideia de uma vez, já que o thinking soma uso de ferramentas, busca ao vivo e múltiplas imagens por prompt. Pra ajuste pontual em foto simples, a versão padrão já resolve.
Imagem gerada pelo ChatGPT tem marca d’água?
Sim. As imagens do ChatGPT, do Codex e da API da OpenAI carregam metadados C2PA e uma marca d’água invisível chamada SynthID. O C2PA é frágil e pode se perder em upload, download ou print, enquanto o SynthID costuma sobreviver melhor a essas transformações.
O ChatGPT consegue colocar texto certo dentro da imagem?
A renderização de texto em inglês melhorou, e o suporte a japonês, coreano, chinês, hindi e bengali também avançou, incluindo texto mais denso e pequeno. Ainda assim, vale indicar no prompt onde e em qual suporte o texto deve aparecer, pra não deixar essa escolha só pro modelo.
Por que o ChatGPT erra em imagens com muitos detalhes pequenos?
A própria OpenAI reconhece que quebra-cabeças, tarefas complexas e detalhes muito finos (como grãos de areia) ainda são difíceis demais pro modelo, e que o raciocínio físico continua fraco. Nesses casos o caminho é quebrar o pedido em etapas menores em vez de tentar tudo num prompt só.
Formações
Formação SAAS com IA
Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!
- 291 aulas
- 18 projetos
- 24h 17min
Blog | Mais populares
As diferenças de var, let e const
Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]
ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
