Prompts para Imagens de IA: Os Seis Slots Essenciais

Resumo

Prompts estruturados vs. sopa de palavras-chave. Os seis slots que separam renders genéricos dos bons: assunto, estilo, iluminação, composição, mood, técnico. Como Midjourney v7, Flux 1.1 Pro e SD3.5 precisam de briefings diferentes. Vocabulário de iluminação real. Cinco prompts prontos para copiar. Build prompt libraries com Are.na.

Flat lay of printed reference photos, contact sheets, and a closed laptop on a concrete studio table, zine moodboard style

Prompts para imagens de IA não são mais longos, são estruturados. Seis slots: assunto, estilo, iluminação, composição, mood, técnico. Pula um e o Midjourney ou Flux preenche com a opção mais genérica que têm, que é exatamente o motivo do teu render parecer com o do resto do Pinterest. Isto não é sobre empilhar adjetivos até algo funcionar. É sobre nomear cada decisão que um fotógrafo ou diretor de arte real faria antes do obturador sequer abrir. Essa é a diferença inteira entre um output com sorte e um que é repetível.

Já fizeste isto: escreveste "uma rapariga num parque, cinematográfico, 8k, melhor qualidade" e recebeste a mesma coisa enfadonha e sobre-iluminada que toda a gente que escreve essa frase exata. Não é má sorte. É um prompt com três slots vazios, preenchidos pela adivinha mais genérica do modelo.

Os Seis Slots que Cada Prompt que Funciona Segue

Esquece a sopa de palavras-chave separadas por vírgulas. "Raposa, floresta, outono, brumoso, luz solar, 8k, melhor qualidade" diz ao modelo zero sobre o que realmente queres, por isso default para lodo de stock-photo. Cada modelo viu dez mil imagens etiquetadas com essas palavras exatas, e faz uma média de todas elas para o output mais seguro possível.

O briefing que aguenta em todos os modelos: assunto, estilo, iluminação, composição, mood, técnico. Seis slots. Se não consegues nomear o que vai num slot, o modelo escolhe por ti, e escolhe a média de cada imagem que já viu etiquetada dessa forma. É o "aspecto IA" que estás a tentar fugir.

Assunto primeiro, sempre. Não "uma rapariga," mas o que ela está a fazer, a usar, a segurar, e onde. Estilo depois: nomeia um meio ou um movimento, não uma vibe. "Cinematográfico" significa nada específico para um modelo, é uma palavra de marketing, não uma instrução visual. "Slide de filme Kodachrome, 1978" significa algo que um modelo consegue realmente simular.

Composição é o slot que a maioria salta. Escolha de lente, ângulo, framing distance: um ângulo baixo de três-quartos 35mm lê-se completamente diferente de um close-up justo 85mm, e o modelo precisa de ti para escolher um em vez de adivinhar "uma foto agradável."

Abre-o e olha para o que está realmente num prompt que funciona: um assunto a fazer algo concreto, um estilo nomeado, uma fonte de luz com direção, uma escolha de lente e framing, um registo emocional, e os flags de parâmetro que o modelo precisa. Falha dois desses e ficas com a quadragésima variação do mesmo retrato bege genérico que toda a gente está também a gerar esta semana.

Mood é o slot que a maioria salta inteiramente ou sobrecarrega com três adjetivos contraditórios de uma vez. Escolhe um registo: tranquilo, tenso, celebratório, clínico. Não "épico e sereno e dramático" empilhados juntos, que apenas diz ao modelo para fazer uma média de três moods num meio indeciso e achatado. E técnico por último, não primeiro: aspect ratio, seed, flags específicas do modelo. É o slot que fixa os outros cinco no lugar uma vez que decidiste realmente o que dizem.

Midjourney v7, Flux 1.1 Pro, SD3.5: O Mesmo Briefing, Regras Diferentes

Corremos o mesmo briefing de seis slots através de três modelos, mesmo assunto, mesma pista de iluminação, mesmo framing. Os outputs divergiram mais do que esperávamos, que é o ponto inteiro de testar em vez de asumir.

Midjourney v7 quer frases curtas e de alto sinal, não sentenças completas. Recompensa --sref para consistência de estilo e lê --stylize mais agressivamente do que as versões anteriores faziam. Mete um parágrafo inteiro nele e começa a fazer média do ruído de volta para algo mais seguro e mais plano. É ainda o modelo com o sentido mais forte de mood e iluminação atmosférica dos três, mas precisa que sejas económico sobre como pedes.

Flux 1.1 Pro vai para o outro lado completamente. Segue briefings em linguagem natural de perto e recompensa detalhe, particularmente especificidades de câmara e stock de filme. Diz "85mm, f/1.8, Kodak Portra 400" e Flux realmente agarra-se a esse grão e resposta de cor em vez de o suavizar para plástico. Este é o modelo para alcançar quando o briefing é uma fotografia, não uma ilustração, e tornou-se o default profissional exatamente por essa razão.

Stable Diffusion 3.5 recompensa palavras-chave estruturadas e pesadas: parênteses para empurrar ênfase para cima, parênteses retos para puxar para baixo. (rim light:1.4) comporta-se diferente de digitar "forte rim light" numa frase, e esse controlo numérico é a razão inteira para usar. Se estás a construir um pipeline com LoRAs customizadas e ControlNet, SD3.5 é ainda aquele que possuís ponto a ponto, self-hosted ou através de um front end.

Nenhum destes é objetivamente "melhor." São superfícies de controlo diferentes construídas para trabalhos diferentes. Escolhe aquele cuja superfície de controlo corresponda ao briefing que escreveste, não aquele que toda a gente está a screenshot no X esta semana porque aconteceu de meter num output com sorte.

Vale a pena dizer claramente: mudar de modelo a meio de um projeto porque um output te desiludiu é a forma mais rápida de acabar com uma pasta de estilos não-combinados e sem throughline. Decide o modelo baseado no briefing, corre o mesmo briefing através de três ou quatro seeds antes de julgar o modelo em si, e só muda ferramentas se a superfície de controlo genuinamente não consegue fazer o que o briefing pede.

O Vocabulário de Iluminação que Mata o "Aspecto IA"

Aqui está a correção mais rápida para renders que gritam "gerado": nomeia a fonte de luz e a sua direção. Não "boa iluminação," que é uma frase com zero informação nela. Uma fonte, uma qualidade, uma direção.

"Baixo sol a filtrar através de bamboo, sombras duras a varrer para a esquerda" dá ao modelo uma configuração física para simular, da forma que um gaffer iluminaria um set. "Boa iluminação" dá-lhe nada, por isso default para o aspecto plano, sem sombras, sobre-iluminado que se tornou o sinal inconfundível de um prompt com pressa escrito em trinta segundos.

Macro shot of a small softbox casting hard-edged shadow across a plaster bust, illustrating single-source lighting setup

Toma de empréstimo vocabulário de iluminação real em vez de inventar o teu próprio: iluminação Rembrandt para um pequeno triângulo de luz na bochecha sombreada, rim light para separação do fundo, volumetric fog para atmosfera com profundidade real. Estas não são palavras decorativas escolhidas para soarem fancy. Cada uma diz ao modelo para simular uma configuração física específica em vez de adivinhar o que quereste dizer.

Adiciona "RAW photo" ou "unprocessed" ao slot técnico se a sobre-renderização e suavização de pele de plástico é o teu problema recorrente. É uma pequena frase que faz uma quantidade desproporcionada de trabalho contra o aspecto sobre-renderizado que cada modelo default quando o prompt o deixa espaço para adivinhar.

Terracotta clay bust lit with dramatic Rembrandt-style side lighting against a dark backdrop

Cinco Prompts que Podes Roubar Agora

Testámos estes nos três modelos acima. Não são arte acabada, são pontos de partida construídos na estrutura de seis slots. Muda o assunto, mantém os ossos intactos.

Coloca qualquer um destes no Flux para fotorrealismo ou Midjourney para atmosfera, e observa qual slot quebra primeiro quando o output te desaponta. Normalmente é o slot exato que precisa afinar na ronda seguinte, não uma razão para reroll cegamente.

Construindo uma Biblioteca de Prompts em Vez de um Cemitério de Screenshots

A "coleção de prompts" da maioria é quarenta screenshots enterrados numa app de Notas, nenhum etiquetado, nenhum reutilizável seis semanas depois quando realmente precisas dessa configuração de iluminação exata de novo. Não é uma biblioteca, é um cemitério que nunca vais cavar.

Uma biblioteca que funciona etiqueta por slot, não por vibe. Coloca um prompt sob "iluminação: hard side light" e "estilo: riso print," não sob "aquela legal" ou "aquela coisa da raposa." Quando precisas de uma configuração de iluminação específica um mês a partir de agora, encontra em dez segundos em vez de passar por um camera roll esperando reconhecer uma thumbnail.

Overhead view of a cork moodboard pinned with vintage Kodachrome-style photos and riso color swatches

Isto é também onde Are.na merece o seu lugar no workflow, não como um nice-to-have mas como o passo antes do passo. Are.na-isa as tuas referências antes de escreveres um único prompt: bloqueia o DNA visual (luz, textura, paleta) num canal primeiro, depois traduz esse canal nos seis slots. É mais lento do que digitar diretamente num modelo, mas os outputs param de parecer intercambiáveis com os de toda a gente.

Quando Iterar Mais Apenas Torna Pior

Fixa o seed. Muda um slot por ronda. É toda a disciplina, e quase ninguém a faz.

O instinto quando um output te desaponta é fazer reroll dez vezes e esperar que o seed aleatório te salve. O que realmente funciona: mantém o seed fixo, muda exatamente uma variável de cada vez, iluminação primeiro, depois composição, depois mood, e avalia o resultado contra o briefing que originalmente escreveste, não contra se gostas pessoalmente da vibe hoje. "Isto corresponde ao que pedi" bate "gosto disto" sempre, porque a segunda pergunta não tem fim e vais queimar cem gerações a perseguir um sentimento em vez de uma spec.

Se mudaste quatro coisas de uma vez e ainda estás a fazer reroll sem melhoria, o briefing estava incompleto desde o início. Volta aos seis slots. Algo está vazio, e nenhuma quantidade de reroll conserta um slot vazio.

Para controlo técnico mais profundo no lado do fotorrealismo, Black Forest Labs documenta o comportamento de aderência a prompts e guidance-scale do Flux em mais detalhe do que a maioria de guias de terceiros se importa, vale a pena os quinze minutos se estás a empurrar além de uso casual.

Qual Modelo Realmente Corres Isto em Primeiro?

Flux 1.1 Pro se o briefing lê como uma fotografia. Midjourney v7 se lê como um mood. SD3.5 se precisas possuir o pipeline ponto a ponto e empilhar LoRAs customizadas no topo de um modelo base.

Não há resposta universal aqui, e qualquer um a vender-te uma é alguém a vender-te um template pack, não um método. Escreve o briefing de seis slots primeiro, decide que tipo de imagem é que realmente descreve uma vez está na página, e só depois escolhe o modelo que combina. Rouba os cinco prompts acima, quebra-os, reconstrói-os para o teu próprio assunto e a tua própria stack de referências. Esse é o trabalho real, e é um melhor uso de uma tarde do que scroll pela centésima vez na showcase feed de alguém.

Perguntas frequentes

Qual é a diferença entre um bom prompt e um genérico?
Um bom prompt tem estrutura: assunto, estilo, iluminação, composição, mood e técnico. Um genérico é sopa de palavras-chave separadas por vírgulas, que o modelo preenche com a opção mais média que tem.
O Midjourney v7 é melhor que Flux 1.1 Pro?
Não há 'melhor' — são superfícies de controlo diferentes. Midjourney v7 quer frases curtas e recompensa --sref. Flux 1.1 Pro segue linguagem natural e agarra-se a detalhes de câmara. Escolhe baseado no teu briefing.
Como namear iluminação sem soar genérico?
Em vez de 'boa iluminação,' usa vocabulário real: Rembrandt lighting, rim light, volumetric fog. Cada termo diz ao modelo uma configuração física específica a simular.
Devo reroll indefinidamente até gostar?
Não. Fixa o seed, muda um slot de cada vez (iluminação, depois composição, depois mood). Se mudas quatro coisas de uma vez, o briefing estava incompleto desde o início.
Qual é o melhor site para guardar e organizar prompts?
Uma biblioteca real etiqueta por slot (iluminação, estilo), não por vibe. Are.na é excelente: constrói o DNA visual primeiro, depois traduz nos seis slots.
Qual modelo lanço um prompt novo em primeiro?
Se o briefing é uma fotografia, Flux 1.1 Pro. Se é um mood, Midjourney v7. Se precisas de pipeline customizado com LoRAs, SD3.5.
Como mato o 'aspecto IA' (plastic skin, lighting plano)?
Nomeia a fonte de luz e direção (não 'boa iluminação'). Adiciona 'RAW photo' ou 'unprocessed' ao slot técnico. São pequenas frases que fazem trabalho desproporcionado.
★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   ★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   
✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦