Um bom prompt para imagem descreve quatro coisas em ordem: o sujeito, o estilo, a luz e a lente. Quando você junta esses blocos, a IA deixa de adivinhar e passa a renderizar exatamente o que você imaginou. Por isso, “um gato” produz uma foto genérica, enquanto “retrato de um gato cinza junto à janela, luz natural suave, lente 50mm, estilo fotográfico realista” produz uma imagem que parece saída de um estúdio. Neste guia prático mostramos a anatomia de um prompt para imagem, com exemplos antes e depois, uma biblioteca de prompts prontos pra copiar e como o mesmo texto muda no Nano Banana, no Gemini e no ChatGPT.

Como funciona um prompt para imagem (e por que a IA entende)

Um modelo de geração de imagem aprende associando milhões de fotos a suas descrições. Portanto, quando você escreve um texto, a IA busca padrões visuais ligados a cada palavra. Em seguida, ela combina esses padrões num resultado coerente. Quanto mais específica a descrição, mais o modelo restringe as possibilidades.

Por isso, palavras vagas geram resultados imprevisíveis. A IA precisa preencher as lacunas sozinha, e ela faz isso com a média do que viu no treinamento. Dessa forma, um termo solto como “carro” pode virar qualquer veículo, em qualquer ângulo, com qualquer iluminação. Já uma descrição rica reduz essa margem e aproxima a saída da sua intenção.

Vale lembrar que cada ferramenta tem um modelo diferente por trás. O Gemini usa a família Imagen, segundo o blog oficial do Google. O ChatGPT usa o DALL·E, conforme a documentação da OpenAI. Apesar das diferenças, o princípio é o mesmo: descrição clara, resultado previsível.

Outro ponto merece atenção. A IA lê o texto da esquerda para a direita e dá mais peso ao começo. Portanto, o que aparece primeiro no seu prompt para imagem tende a dominar o resultado. Por isso, recomendamos sempre colocar o sujeito principal logo no início. Em seguida, vêm os complementos de estilo, luz e técnica, que apenas refinam o que já foi definido.

Além disso, modelos recentes lidam bem com instruções negativas. Quando você escreve “sem texto” ou “sem distorções”, a IA tenta evitar esses elementos. Contudo, use poucas negativas por vez. Afinal, uma lista longa de proibições costuma confundir o modelo e piorar a saída.

Anatomia de um prompt para imagem: sujeito, estilo, luz e lente

A estrutura mais confiável de um prompt para imagem segue quatro blocos em sequência. Essa fórmula reflete a forma como os próprios modelos organizam a leitura do texto. Veja a seguir a anatomia completa, do mais importante ao mais técnico.

Anatomia de um prompt para imagem: sujeito, estilo, luz e lente conectados
Os quatro blocos que estruturam um bom prompt para imagem: sujeito, estilo, luz e lente.
  • Sujeito principal + ação/cenário: quem ou o que aparece e o que está fazendo. Por exemplo, “uma mulher jovem lendo um livro num café”.
  • Estilo artístico: a linguagem visual desejada, como “foto realista”, “ilustração aquarela” ou “render 3D”.
  • Luz e cor: a atmosfera. Termos como “luz natural de janela”, “hora dourada” ou “tons pastel” mudam tudo.
  • Detalhes técnicos (lente e ângulo): “lente 50mm”, “plano fechado”, “vista de cima” ou “fundo desfocado”.

Na prática, basta encaixar suas ideias nesses quatro espaços. Primeiro o sujeito, depois o estilo, em seguida a luz e por fim a lente. Assim, você monta um prompt para imagem completo sem decorar nada. Inclusive, essa é a mesma ordem que o Google sugere em suas orientações de geração de imagem.

Cada bloco também tem um vocabulário próprio que vale conhecer. No estilo, por exemplo, você pode citar nomes de técnicas: “fotografia analógica”, “pintura a óleo” ou “arte digital”. Na luz, termos como “contraluz”, “luz dura” e “iluminação volumétrica” mudam radicalmente o clima. Já nos detalhes técnicos, mencionar a lente certa controla a perspectiva. Uma lente 24mm abre o cenário, enquanto uma 85mm aproxima e desfoca o fundo.

Para entender melhor a montagem, observe o diagrama abaixo. Ele mostra como os quatro blocos se conectam numa frase única e fluida.

Publicidade

Antes e depois: do prompt vago à foto realista

A diferença entre um resultado amador e um profissional quase sempre está no texto. A seguir, comparamos prompts fracos com versões anatômicas completas. Note como cada coluna da direita preenche os quatro blocos da seção anterior.

Prompt vago Prompt anatômico completo
um gato Retrato de um gato cinza sentado junto à janela, luz natural suave da tarde, lente 50mm, fundo desfocado, foto realista
uma cidade Vista aérea de uma cidade litorânea ao pôr do sol, luz dourada refletindo nos prédios, tons quentes, plano amplo, estilo cinematográfico
um café Xícara de café espresso sobre mesa de madeira, vapor subindo, luz lateral suave de janela, plano fechado, lente macro, foto de produto realista

Repare que a coluna da direita nunca é apenas mais longa. Cada palavra extra cumpre uma função. De fato, “lente 50mm” controla a perspectiva, “luz natural suave” controla a atmosfera e “fundo desfocado” controla a profundidade. Logo, comprimento sem propósito não ajuda; estrutura, sim.

Veja também o ganho de previsibilidade. Com o prompt vago “um gato”, duas gerações seguidas podem entregar imagens completamente diferentes. Já com a versão completa, as variações ficam dentro do mesmo clima. Dessa forma, um prompt para imagem bem estruturado faz você controlar o resultado em vez de torcer pela sorte. Esse é o maior benefício de pensar a descrição como uma fórmula, e não como um palpite.

Prompt para foto profissional com IA

O segredo de um prompt para foto profissional está em pensar como um fotógrafo, não como quem digita palavras soltas. Primeiro, descreva o sujeito num enquadramento real, como “plano 3/4” ou “retrato de meio corpo”. Em seguida, defina a luz de estúdio, porque é ela que separa o amador do profissional. Por fim, escolha a lente. Uma 85mm comprime o fundo e valoriza o rosto, enquanto uma 35mm mantém o ambiente visível.

Na prática, recomendamos sempre incluir o termo da lente em milímetros na descrição voltada a retrato. De fato, esse único detalhe reduz aquele aspecto “plástico” típico de IA e ancora a perspectiva. Da mesma forma, peça “luz suave de janela” ou “iluminação de estúdio difusa” para evitar sombras duras. Assim, o resultado já nasce com cara de ensaio fotográfico.

Como aumentar a qualidade da imagem no prompt

Quando a imagem sai borrada ou com pouca definição, o problema costuma estar na ausência de termos de acabamento. Por isso, adicione modificadores de resolução no fim do prompt, como “alta resolução”, “nitidez detalhada” ou “8K”. Esses termos sinalizam ao modelo que você quer riqueza de detalhe, não um esboço.

Além disso, controle a profundidade para evitar o borrão indesejado. Quando o fundo inteiro fica desfocado, muitas vezes a culpa é de um “fundo desfocado” pedido sem critério. Portanto, especifique onde quer foco, como “nitidez nos olhos, fundo levemente desfocado”. Em seguida, evite empilhar adjetivos contraditórios, já que eles confundem o modelo e derrubam a definição. Dessa forma, você aumenta a qualidade sem precisar gerar a mesma imagem dezenas de vezes.

Prompts prontos para copiar

A seguir, montamos uma biblioteca de prompts prontos. Cada um já segue a anatomia de quatro blocos. Substitua o que está entre colchetes pelo seu assunto e copie direto na ferramenta. Recomendamos começar pelo retrato profissional, que costuma render os melhores resultados realistas.

Code
Retrato profissional de [pessoa: homem de 30 anos], plano 3/4,
expressão confiante, luz suave de janela vindo da esquerda,
lente 85mm, fundo neutro levemente desfocado, foto realista,
alta nitidez nos olhos
Retrato profissional masculino gerado por IA, luz suave de janela e fundo neutro
Resultado do prompt de retrato profissional.

Em seguida, um prompt voltado a foto de produto, ideal para e-commerce ou catálogo.

Code
Foto de produto de [objeto: um tenis branco] sobre superficie
de concreto claro, iluminacao de estudio difusa, sombra suave,
plano frontal levemente angulado, lente 50mm, fundo minimalista,
estilo comercial realista
Foto de produto de um tênis branco sobre concreto claro, estilo catálogo, gerada por IA
Resultado do prompt de foto de produto.

Por fim, um prompt de edição, para transformar uma imagem que você já tem.

Code
Edite [a imagem] mantendo o sujeito principal, troque o fundo
por um ambiente de estudio cinza, adicione luz suave de janela
pela direita, mantenha as cores realistas e a nitidez original

Esses prompts funcionam como ponto de partida. Contudo, ajuste sempre a luz e a lente conforme o clima que você quer. Da mesma forma, troque “foto realista” por “ilustração” ou “render 3D” quando a intenção mudar. Inclusive, vale salvar seus favoritos num documento à parte. Assim, você cria sua própria biblioteca pessoal e reaproveita os melhores resultados.

Quer mais variedade visual? Para anime, aquarela, pixel art, estilo Ghibli e cinema, montamos uma galeria à parte com o prompt pronto de cada estética. Confira nossa galeria de estilos de prompt para imagem e copie o modelo que combina com o seu projeto.

Nano Banana, Gemini ou ChatGPT: o mesmo prompt em cada IA

Um detalhe importante: o mesmo conceito exige fraseados diferentes em cada ferramenta. A anatomia permanece, mas o tom muda. Veja a seguir como adaptar a mesma ideia em três plataformas populares.

No Nano Banana, o modelo de imagem do Google, prefira frases curtas e diretas. Como ele é fortemente fotorrealista, descrições objetivas já entregam excelente nitidez. Conheça os detalhes no nosso guia sobre o que é o Nano Banana.

No ChatGPT com DALL·E, o estilo conversacional ajuda. Você pode escrever a descrição em linguagem natural, com vários detalhes encadeados. Inclusive, dá pra pedir ajustes em mensagens seguintes, como “deixe a luz mais quente”. Saiba mais em nosso artigo sobre o Google Gemini e a IA do Google para comparar abordagens.

Já no Gemini pelo aplicativo, você controla a proporção e o enquadramento descrevendo em texto, como “formato widescreen 16:9” ou “imagem vertical”. Em vez de sufixos técnicos, o Gemini lê a intenção no próprio corpo do prompt. Portanto, basta deixar a proporção explícita na descrição para o resultado sair como você quer.

Em resumo, adapte sempre o tom à ferramenta. O Nano Banana pede objetividade, o Gemini lê a proporção pela descrição e o ChatGPT aceita conversa. Se ainda está em dúvida sobre qual adotar, vale comparar as opções com calma. Para isso, leia nosso comparativo entre ChatGPT, Claude e Gemini antes de escolher.

Erros comuns que estragam o resultado

Mesmo conhecendo a anatomia, alguns deslizes derrubam a qualidade. Primeiro, o excesso de adjetivos contraditórios. Quando você pede “luz dramática e suave ao mesmo tempo”, a IA fica confusa e escolhe uma média sem graça.

Em seguida, há o erro de empilhar sujeitos demais. Por exemplo, “um cachorro, um gato, um carro e uma praia” dilui o foco. Por isso, mantenha um sujeito principal claro e use o resto como cenário de apoio. Assim, a IA sabe onde concentrar os detalhes.

Outro tropeço frequente é ignorar a luz. Muita gente descreve o sujeito com riqueza, mas esquece a iluminação. Consequentemente, o resultado parece chapado. Termos como “luz natural de janela” ou “hora dourada” resolvem isso na hora. Se quiser dominar o vocabulário técnico, nosso glossário de IA para iniciantes ajuda bastante.

Há ainda o problema oposto: detalhar demais. Um prompt com vinte adjetivos compete consigo mesmo. Por isso, prefira poucas escolhas fortes a muitas fracas. Da mesma forma, evite misturar estilos incompatíveis, como “foto realista em estilo cartoon”. Esse tipo de combinação raramente gera algo coerente.

Por fim, evite prompts curtos demais quando busca realismo. Um prompt para imagem de uma palavra raramente entrega foto profissional. Afinal, sem estilo, luz e lente, a IA não tem como saber sua intenção.

Conclusão e próximos passos

Portanto, escrever um bom prompt para imagem não é talento, é método. Você descreve o sujeito, define o estilo, ajusta a luz e escolhe a lente. Dessa forma, qualquer ferramenta de IA passa a entender exatamente o que você quer, seja uma foto realista, uma ilustração ou um render 3D.

Lembre-se de praticar com a biblioteca de prompts prontos deste guia. Primeiro, copie um modelo e troque o assunto. Em seguida, ajuste a luz e a lente conforme o clima desejado. Por fim, compare suas saídas entre Nano Banana, Gemini e ChatGPT para sentir as diferenças de cada modelo. Com poucos testes, você já estará criando imagens muito mais próximas da sua visão.

Publicidade

Qual IA transforma prompt em imagem?
Várias ferramentas fazem isso. As mais populares são o Google Gemini com o Nano Banana e o ChatGPT com o DALL·E. Cada uma usa um modelo próprio, mas todas convertem texto em imagem a partir da sua descrição.
Como transformar uma imagem em um prompt?
Você pode enviar a imagem para o ChatGPT ou o Gemini e pedir para que descrevam o conteúdo em forma de prompt. A IA analisa sujeito, estilo, luz e composição, e devolve um texto que você pode reutilizar ou refinar para gerar variações.
Qual a melhor IA para prompt de imagem?
Não existe uma única melhor. O Nano Banana do Gemini se destaca em fotorrealismo, o DALL·E do ChatGPT é ótimo para uso conversacional e o Gemini pelo app oferece controle de proporção pela própria descrição. A escolha depende do seu objetivo.
Como editar imagens com IA usando um prompt?
Envie a imagem original e escreva um prompt de edição descrevendo a mudança desejada, como trocar o fundo ou ajustar a luz. Peça para manter o sujeito principal e as cores realistas. Ferramentas como Gemini e ChatGPT já suportam esse tipo de edição guiada por texto.
Preciso escrever o prompt em inglês?
Não. As ferramentas modernas entendem português muito bem. Ainda assim, alguns termos técnicos de fotografia podem render resultados ligeiramente melhores em inglês em certos modelos. Para a maioria dos casos, o português funciona perfeitamente.
Como fazer um prompt para foto profissional?
Use a anatomia de quatro blocos com foco em retrato. Descreva o sujeito em plano 3/4, adicione luz suave de janela, escolha uma lente 85mm e peça fundo desfocado com estilo realista. Essa combinação imita as escolhas de um fotógrafo de estúdio.