Como Escrever Prompts de IA que Realmente Funcionam (Guia Completo para Iniciantes, 2026)
Você digitou "retrato de mulher bonita" no Midjourney. O resultado pareceu um manequim de loja de departamentos em crise existencial. Você tentou "deixe mais realista" — mesma coisa, um pouco pior. Depois pesquisou "como escrever prompts de IA" e caiu em um artigo com 12 dicas vagas e zero exemplos práticos. É exatamente essa lacuna que este guia preenche. Aqui está a fórmula real: cinco partes, em ordem, com comparações de prompts ruins vs. bons em cada etapa — para você parar de adivinhar e começar a dirigir.
Índice
- Por que a Maioria dos Primeiros Prompts Falha
- A Fórmula de 5 Partes para Prompts
- Parte 1: Sujeito
- Parte 2: Estilo
- Parte 3: Iluminação
- Parte 4: Composição
- Parte 5: Modificadores de Qualidade
- Técnicas Avançadas
- Fórmulas de Prompt para Casos de Uso Comuns
- Como Iterar e Melhorar
- Limitações Reais
- Perguntas Frequentes
Por que a Maioria dos Primeiros Prompts Falha
O problema central é que os modelos de imagem de IA não são mecanismos de busca. Quando você digita "pôr do sol" no Google, recebe fotos de pôr do sol. Quando digita "pôr do sol" no Midjourney ou no DALL-E 3, o modelo precisa preencher dezenas de lacunas: Que horas exatamente? Quais cores? O que está em primeiro plano? Qual é o clima da cena? Qual lente? Ele preenche cada lacuna que você deixou — com médias estatísticas, não com a sua visão.
"Um cachorro" gera um cachorro marrom de porte médio de perfil, sentado na grama, com luz neutra e suave. Sempre. Não porque o modelo seja ruim, mas porque essa é literalmente a média de todas as imagens de cachorros com que ele foi treinado. "Mulher bonita" resulta em uma jovem de 25 anos com simetria facial perfeita, sorriso desfocado e fundo branco limpo. O modelo não falhou. Ele fez exatamente o que um gerador de médias faz quando não tem nada específico para mirar.
Prompts curtos não falham por serem curtos. Eles falham porque deixam as decisões erradas para o modelo. A solução não é escrever mais palavras — é preencher deliberadamente as cinco lacunas certas. Veja quais são essas cinco lacunas.
A Fórmula de 5 Partes para Prompts
Sujeito + Estilo + Iluminação + Composição + Qualidade
Você não precisa das cinco partes em todo prompt. Mas conhecer essas cinco dimensões — e fazer escolhas conscientes sobre cada uma — é o que separa imagens que funcionam de imagens que parecem fotos de banco de imagens de 2015. Pense nisso como uma lista de verificação: antes de clicar em gerar, pergunte a si mesmo se você cobriu o sujeito, a linguagem visual, a fonte de luz, a posição da câmera e a qualidade do acabamento. Vamos percorrer cada parte com exemplos reais.
Parte 1: Sujeito — Específico o Suficiente para Surpreender
O sujeito é a base de todo prompt. Mas sujeitos genéricos produzem imagens genéricas. Você não está descrevendo um conceito para o modelo — está descrevendo um momento, objeto ou pessoa específicos com detalhes suficientes para que o modelo não possa recorrer aos seus padrões.
Prompt ruim: "uma mulher"
Por que falha: Idade? Etnia? Expressão? Cenário? Ação? O modelo escolhe padrões seguros para tudo. Você receberá uma jovem genérica de 25 anos, luz suave, fundo neutro, sorriso discreto.
Prompt bom: "uma ceramista japonesa de 60 anos com as mãos manchadas de argila, examinando um vaso que acabou de tirar do forno, expressão de intensa concentração"
Por que funciona: Idade, profissão, detalhe físico, ação e emoção estão todos especificados. O modelo tem um alvo real, não uma média para recorrer.
Um sujeito forte tem três camadas. Primeiro, um substantivo principal — uma coisa central, não cinco. Segundo, um detalhe definidor — um ou dois adjetivos específicos que não sejam "bonito" ou "incrível" (esses são instruções de qualidade, não especificações visuais). Terceiro, uma ação ou relação — o que está fazendo, ou com o que está próximo? A camada de ação força o modelo a tomar decisões composicionais. Geralmente boas. "Um corvo pousando em um piano abandonado" é mais interessante do que "um corvo perto de um piano" exatamente por isso.
Parte 2: Estilo — Escolha Um e Comprometa-se
O estilo diz ao modelo em qual linguagem visual trabalhar. "Estilo de arte digital" não diz quase nada — é como dizer a um chef para cozinhar no "estilo comida". A diferença entre escolhas de estilo específicas é enorme no resultado final.
Prompt ruim: "estilo de arte digital, bonito, impressionante"
Por que falha: "Arte digital" abrange tudo, de renders da Pixar a pixel art e hiperrealismo. "Bonito" e "impressionante" são adjetivos de qualidade — eles não melhoram a qualidade, apenas dizem ao modelo que você quer algo bom. Ele já assume isso.
Prompt bom: "fotografia cinematográfica, lente anamórfica, gradação de cor ARRI Alexa, profundidade de campo rasa"
Por que funciona: São referências técnicas específicas. O modelo sabe como é a ciência de cores da ARRI Alexa. Sabe o que as características de uma lente anamórfica produzem. Você está falando a mesma língua dos seus dados de treinamento.
Escolhas de estilo que produzem resultados confiáveis: fotografia cinematográfica, fotografia editorial de moda, pintura a óleo com textura de impasto, animação Studio Ghibli, concept art de matte painting, fotografia em filme vintage com grão, fotografia de produto com iluminação comercial limpa. Escolha um por prompt. Misturar dois estilos geralmente produz um resultado confuso — a menos que você queira especificamente a tensão entre eles, como "pintura a óleo renderizada com detalhe fotográfico hiperrealista". Navegue pela galeria de imagens do PromptSpace para ver o que diferentes combinações de estilo realmente produzem antes de se comprometer com uma.
Parte 3: Iluminação — A Forma Mais Rápida de Mudar a Emoção
A iluminação é onde fotógrafos experientes justificam seus cachês. Tanto o Midjourney quanto o DALL-E 3 respondem a descritores de iluminação de forma mais confiável do que a quase qualquer outro componente. O mesmo sujeito sob luz da hora dourada, luz dura do meio-dia e brilho neon são três experiências emocionais completamente diferentes — e três prompts completamente diferentes.
Prompt ruim: "boa iluminação, bem iluminado"
Por que falha: "Boa iluminação" não tem significado — é como pedir "tempo agradável". O modelo recorre a uma luz de estúdio plana, uniforme e genérica que faz tudo parecer um headshot mediano do LinkedIn.
Prompt bom: "iluminação Rembrandt, única luz principal quente a 45 graus acima à esquerda, triângulo de luz abaixo do olho, sombra profunda no lado direito do rosto"
Por que funciona: Específico, técnico, e o modelo já viu milhares de imagens marcadas exatamente assim. Ele sabe o que fazer.
Descritores de iluminação que vale a pena aprender: hora dourada (âmbar quente, sombras longas, nostalgia); iluminação Rembrandt (uma luz principal, sensação dramática de retrato); rim lighting / contraluz (bordas brilhantes do sujeito, silhueta cinematográfica); brilho neon (sombras coloridas, reflexos em asfalto molhado, cyberpunk); luz difusa encoberta (sombras suaves e uniformes, clima íntimo ou melancólico); bioluminescência (fonte de luz interna azul-esverdeada, atmosfera sobrenatural). A única regra: combine a iluminação com o clima. "Hora dourada" combinada com "atmosfera sombria e perturbadora" é uma contradição que enfraquece os dois descritores.
Parte 4: Composição — Diga à Câmera Onde Ficar
A composição controla o enquadramento, a perspectiva e as relações espaciais dentro do quadro. Deixe-a sem especificação e o modelo recorre a um plano médio com o sujeito centralizado. Ótimo para fotos casuais. Para qualquer coisa intencional, você precisa dirigir a câmera explicitamente.
Prompt ruim: "uma paisagem de montanha"
Por que falha: Você recebe montanhas a média distância, centralizadas, horizonte plano. Um cartão-postal. Competente, genérico, esquecível.
Prompt bom: "vista com grande angular extremo olhando para cima em direção a picos irregulares a partir de uma pequena saliência rochosa, pedras rachadas em primeiro plano com foco nítido, picos desaparecendo em nuvens de tempestade, perspectiva vertiginosa, profundidade atmosférica"
Por que funciona: Posição da câmera, distância focal, elemento em primeiro plano e atmosfera estão todos especificados. O modelo trabalha a partir de um projeto, não de uma média.
Termos de composição úteis: retrato em close (rosto preenche o quadro), ângulo holandês (câmera inclinada sugerindo inquietação), vista de cima para baixo, vista de baixo para cima, plano sobre o ombro, grande angular extremo, macro. A escolha da lente também importa: 35mm grande angular, 85mm retrato, compressão de 200mm teleobjetiva, distorção olho de peixe. Esses são termos técnicos da fotografia real — o modelo os viu em milhões de imagens e responde com precisão. A coleção de prompts cinematográficos usa esses termos de composição extensivamente, e vale a pena ver os resultados reais para desenvolver intuição.
Parte 5: Modificadores de Qualidade — Referências Específicas, Não Superlativos
Modificadores de qualidade não são palavras mágicas que melhoram tudo. São referências técnicas ou de plataforma específicas que direcionam o modelo para um certo nível de detalhe e acabamento. Funcionam quando combinam com o estilo escolhido — e saem pela culatra quando não combinam.
Prompt ruim: "8K ultra HD hiper realista impressionante premiado obra-prima"
Por que falha: Essa pilha de qualidade está tão desgastada que perdeu o significado. Empilhar seis superlativos vagos não multiplica a qualidade — dilui o sinal. O modelo já viu essa frase em milhares de imagens medianas.
Prompt bom: "médio formato Hasselblad, grão de filme Kodak Portra 400, foco preciso nos olhos, profundidade de campo rasa f/2.8, textura de pele visível"
Por que funciona: Sistema de câmera específico, filme específico, características técnicas específicas. O modelo mapeia isso para qualidades visuais reais, não para aspirações abstratas.
Para fotografia: use marcas de câmera específicas (Sony A7R IV, Canon 5D Mark IV), especificações de lente (85mm f/1.4) e filmes (Kodak Portra 400, Fuji Velvia). Para ilustração e concept art: "Artstation trending, detailed concept art, professional illustration". Para trabalhos cinematográficos: "ARRI Alexa footage, anamorphic, color graded". Use o gerador de prompts do PromptSpace para experimentar como os modificadores de qualidade se combinam com diferentes componentes de estilo e ver quais combinações produzem os resultados que você busca.
Técnicas Avançadas: Prompts Negativos, Proporções e Dicas por Modelo
Prompts Negativos
Prompts negativos dizem ao modelo o que excluir. No Midjourney, use --no [termo] ao final. No DALL-E 3 e na maioria das outras ferramentas, inclua uma instrução curta como "evite texto, marcas d'água e fundos desfocados" no seu prompt principal.
Mantenha o prompt negativo focado. Uma lista de 20 termos supera uma de 200. Os prompts negativos de 200 palavras encontrados em fóruns geralmente estão cheios de contradições que se cancelam mutuamente. Comece com: --no text, watermark, blurry, overexposed, extra fingers, bad anatomy. Depois adicione exclusões específicas com base no que está aparecendo de errado nos seus resultados — não proíba preventivamente coisas que não são um problema para o seu prompt específico.
Proporções de Aspecto
Este é o parâmetro mais consistentemente ignorado, e é um dos poucos que importa em absolutamente todas as gerações. A saída padrão do Midjourney é aproximadamente quadrada. Se você está gerando para um formato específico, defina a proporção explicitamente antes de começar — não como uma reflexão tardia depois de ter uma composição que você gosta.
- --ar 16:9 — Miniaturas do YouTube, papéis de parede para desktop, fotografia paisagística
- --ar 9:16 — Stories do Instagram, vídeos do TikTok, papéis de parede para celular
- --ar 4:5 — Posts no feed do Instagram, fotografia de retrato
- --ar 1:1 — Posts quadrados nas redes sociais, fotos de perfil
- --ar 21:9 — Ultra-wide cinematográfico, banners para sites
Uma ótima composição gerada na proporção errada será arruinada quando você tentar recortá-la para o seu caso de uso real. Defina a proporção primeiro, depois construa o seu prompt.
Dicas por Modelo
O Midjourney v6 e versões posteriores respondem fortemente a linguagem natural descritiva — escreva como um diretor de cinema dando instruções de cena. O DALL-E 3 responde melhor a frases completas e descrições de cena; ele entende contexto narrativo de forma excepcionalmente boa. O Stable Diffusion usa termos separados por vírgula e parênteses para ênfase ponderada como (term:1.3), com o prompt negativo em um campo separado. A fórmula de cinco partes se aplica aos três modelos, mas a sintaxe e os padrões de ênfase diferem entre eles.
Fórmulas de Prompt para Casos de Uso Comuns
Foto de Perfil / Headshot
Professional headshot of [person description], shallow depth of field,
clean neutral background, Rembrandt lighting, Sony A7R IV,
85mm portrait lens, skin detail, eyes sharp,
--ar 1:1 --no text, blurry, extra fingers
Veja prompts de headshot testados na coleção de prompts de fotos realistas — organizados por estilo e abordagem de renderização de tom de pele.
Miniatura para YouTube
[Subject in dramatic pose or expression], high contrast,
bold saturated colors, cinematic lighting, dark vignette edges,
editorial photography style, shallow depth of field,
--ar 16:9 --no text, watermark, logo
A biblioteca de prompts para miniaturas tem mais de 50 fórmulas testadas organizadas por nicho — tecnologia, games, finanças, lifestyle e muito mais.
Foto de Produto
[Product name and brief description] floating on [background color or texture],
dramatic side rim lighting, clean reflections on surface below,
commercial photography, tack-sharp focus, minimal shadows,
--ar 4:5 --no text, hands, clutter
Paisagem Cinematográfica
[Location or setting], [time of day], [weather condition],
extreme wide angle, sharp foreground detail, atmospheric haze in distance,
ARRI Alexa color grade, anamorphic lens,
epic sense of scale, --ar 21:9 --no people, cars, power lines
Como Iterar e Melhorar: O Fluxo de Trabalho Real
Criadores profissionais de imagens de IA não acertam na primeira geração. Eles executam um ciclo de iteração focado, e conhecer esse ciclo é tão importante quanto conhecer a fórmula.
Passo 1 — Comece apenas com Sujeito + Estilo. Acerte o conceito central antes de adicionar complexidade. Se o sujeito não está funcionando nessa etapa, nenhuma quantidade de detalhe de iluminação vai salvá-lo. Execute duas ou três variações e veja qual direção tem potencial.
Passo 2 — Adicione a iluminação. Assim que o sujeito e o estilo estiverem definidos, execute o prompt com dois ou três descritores de iluminação diferentes. Hora dourada vs. Rembrandt vs. luz encoberta produzem resultados emocionalmente muito diferentes a partir do mesmo sujeito. Escolha o que combina com o clima que você quer transmitir.
Passo 3 — Fixe a direção e adicione Composição + Qualidade. Não recomece do zero quando tiver um resultado promissor. Refine a direção vencedora adicionando os componentes restantes da fórmula e veja o que muda.
Passo 4 — Use Variações, não regeneração completa. No Midjourney, use os botões V em um resultado que você gosta em vez de escrever um novo prompt. Você está iterando em direção a uma imagem específica, não jogando dados a cada vez. Para o DALL-E 3, edite o prompt levemente e peça explicitamente para "manter a mesma composição, mas mudar a iluminação".
Espere executar de 5 a 10 gerações por imagem final. Isso não é fracasso — é o fluxo de trabalho profissional normal. As pessoas cujos resultados você vê nas redes sociais estão mostrando o melhor resultado delas, não o primeiro.
Limitações Reais: O que os Prompts Não Conseguem Corrigir
Um prompt bem elaborado não corrige limitações fundamentais do modelo, e vale a pena conhecê-las com antecedência para não passar uma hora ajustando prompts quando o problema é estrutural.
As mãos ainda são um ponto fraco documentado na maioria dos modelos de imagem em 2026. Adicione --no deformed hands, extra fingers, missing fingers para reduzir as ocorrências, mas você ainda vai receber mãos ruins periodicamente. A solução prática é usar inpainting para corrigir a região da mão em vez de regenerar a imagem inteira do zero.
Texto legível dentro de imagens é pouco confiável. O Midjourney v6 consegue lidar com palavras curtas e simples, mas qualquer coisa além de uma ou duas palavras será renderizada como um texto com aparência plausível, mas sem sentido, na maioria das ferramentas. Gere a imagem sem texto e adicione o seu texto real no Canva, Photoshop ou Figma depois. Não tente contornar essa limitação com prompts.
Semelhanças com pessoas reais específicas são imprevisíveis, e algumas serão recusadas por filtros de conteúdo independentemente de como o prompt for escrito. A fórmula funciona dentro do que o modelo consegue realmente produzir — ela não pode desbloquear capacidades que o modelo não tem nem contornar barreiras de segurança.
Por fim, prompts não compensam um conceito vago. Um prompt tecnicamente perfeito de cinco partes para uma ideia vaga produz uma imagem vagamente polida. Dedique tempo para decidir o que você realmente quer comunicar antes de gastar tempo descrevendo como fazê-lo. A fórmula é uma ferramenta de precisão — ela precisa de um alvo.
Perguntas Frequentes
Qual deve ser o tamanho do meu prompt de imagem de IA?
Longo o suficiente para cobrir os cinco componentes — geralmente de 30 a 60 palavras para um resultado focado. Mais longo não é melhor. Um prompt de 150 palavras cheio de termos vagos produz resultados piores do que um prompt de 40 palavras com referências precisas. Cada palavra no seu prompt compete pela atenção do modelo. Faça cada uma apontar para uma característica visual específica, não para uma qualidade abstrata como "incrível" ou "épico".
A ordem das palavras em um prompt realmente importa?
Sim — a maioria dos modelos dá mais peso aos termos que aparecem no início do prompt. Coloque o sujeito e o estilo principal primeiro. Mova iluminação, clima e modificadores de qualidade para o final. Parâmetros técnicos como proporção de aspecto sempre vão por último. Se algo específico não está aparecendo no seu resultado, tente movê-lo para o início do prompt em vez de adicionar mais palavras ao redor dele.
Por que continuo recebendo o mesmo resultado genérico não importa o que eu digite?
Você está usando termos que o modelo mapeia para sua saída média estatística. Palavras como "bonito", "realista", "legal" e "alta qualidade" não apontam para características visuais específicas — são avaliações abstratas que o modelo já viu associadas a milhões de imagens medianas. Substitua-as por referências técnicas precisas: modelos de câmera, configurações de iluminação específicas, nomes de artistas, filmes fotográficos, gradações de cor nomeadas. A especificidade é a única coisa que quebra o padrão genérico.
Devo usar o ChatGPT para escrever meus prompts do Midjourney ou DALL-E?
Pode ajudar, mas somente se você der um briefing adequado. Pedir ao ChatGPT para "escrever um prompt do Midjourney para um retrato" produz o mesmo resultado genérico que o seu próprio prompt genérico — pelos mesmos motivos. Em vez disso, use a fórmula de cinco partes como briefing: peça para ele escrever um prompt "usando iluminação Rembrandt, estilo de fotografia cinematográfica, lente de 85mm, com o sujeito realizando uma ação específica, e adicione modificadores de qualidade para um visual Hasselblad". Essa especificidade no seu pedido produz um resultado utilizável.
Essas técnicas funcionam para ferramentas de IA baseadas em texto como ChatGPT e Claude, não apenas para geradores de imagem?
O princípio da especificidade se aplica em todo lugar. Para IA de texto, o equivalente da fórmula de cinco partes é: especifique o formato (lista com marcadores, parágrafo curto, etapas numeradas), o tom (formal, conversacional, técnico), o público-alvo, o tamanho e um exemplo concreto de como seria um bom resultado. Os componentes exatos da fórmula não se traduzem diretamente de imagens para texto, mas a ideia central sim — preencha as lacunas deliberadamente em vez de deixar o modelo adivinhar o que você quis dizer.
A fórmula funciona porque força escolhas deliberadas em cada dimensão que realmente impulsiona o resultado. Depois de internalizar Sujeito + Estilo + Iluminação + Composição + Qualidade, criar prompts deixa de ser um jogo de adivinhação. Você está dirigindo, não torcendo. Explore a biblioteca completa de prompts do PromptSpace com centenas de prompts testados construídos sobre essa fórmula, organizados por estilo e caso de uso, prontos para copiar e personalizar para os seus próprios projetos.






