AI 이미지 프롬프트 작성법: 구조가 길이를 이긴다
요약
AI 이미지 프롬프트는 길이가 아니라 구조다. 주제·스타일·조명·구성·무드·기술 여섯 슬롯을 명확히 하면 Midjourney나 Flux가 제네릭 결과물로 채우는 일을 막을 수 있다. 같은 브리프도 모델별로 다르게 읽히므로: Midjourney는 짧은 신호어, Flux는 세밀한 카메라 스펙을 좋아한다. 제어 표면을 선택한 후 시작해야 한다. 이 가이드는 테스트한 여섯 슬롯 구조, 조명 용어법, 즉시 쓸 수 있는 프롬프트와 라이브러리를 정리해 짓는 방법을 담고 있다.
좋은 AI 이미지 프롬프트 작성법은 길이 아니라 구조다. 여섯 개 슬롯: 주제, 스타일, 조명, 구성, 무드, 기술. 하나를 건너뛰면 Midjourney나 Flux가 가진 가장 무난한 옵션으로 채우는데, 그게 정확히 네 렌더가 모두의 Pinterest처럼 보이는 이유다. 형용사를 쌓다가 운이 좋으면 좋은 결과가 나온다는 식의 방법이 아니다. 이건 진짜 사진작가나 아트 디렉터가 셔터를 누르기도 전에 내릴 모든 결정을 이름 붙이는 것이다. 이게 운 좋은 한 번의 결과와 반복 가능한 시스템의 차이다.
"여자가 공원에 있고, 시네마틱, 8k, 최고 품질" 같은 프롬프트를 입력하면 모두가 입력하는 그 정확한 문장에 반응해 과도하게 밝고 과도하게 부드러운 디폴트가 나온다. 그건 운이 아니다. 세 개 슬롯이 비어 있어서 모델이 가장 무난한 추측으로 채운 것이다.
동작하는 모든 프롬프트가 따르는 여섯 개 슬롯 브리프
쉼표로 구분한 키워드 수프는 잊어라. "여우, 숲, 가을, 안개, 햇빛, 8k, 최고 품질"은 모델에 아무것도 알려주지 않으니까 가장 안전한 출력인 스톡 포토 뭉개짐으로 돌아간다. 모든 모델은 그 정확한 단어로 태그된 만 개의 이미지를 봤고, 그 모든 것의 평균을 내어 가장 안전한 결과물을 뽑는다.
모든 모델을 가로지르는 브리프: 주제, 스타일, 조명, 구성, 무드, 기술. 여섯 슬롯. 슬롯에 뭐가 들어가야 하는지 이름 붙일 수 없으면 모델이 골라주는데, 그 용어로 본 모든 이미지의 평균을 고른다. 그게 바로 네가 벗어나려는 "AI 룩"이다.
항상 주제부터. "여자"가 아니라 뭘 하고 있는지, 뭘 입고 있는지, 뭘 들고 있는지, 어디 있는지. 그 다음 스타일: 분위기가 아니라 매체나 운동을 이름 붙여라. "시네마틱"은 모델에 구체적 의미가 없다. 마케팅 단어지, 시각 지시가 아니다. "1978년 코닥크롬 슬라이드 필름"은 모델이 실제로 시뮬레이션할 수 있는 뭔가다.
구성은 사람들이 제일 많이 건너뛰는 슬롯이다. 렌즈 선택, 각도, 프레이밍 거리: 35mm 사분할 저각 샷과 85mm 타이트 클로즈업은 완전히 다르게 읽히고, 모델은 "좋은 샷"을 추측하는 대신 넌 하나를 골라야 한다.
동작하는 프롬프트를 펼쳐서 보라: 구체적으로 뭔가 하는 주제, 이름 붙은 스타일, 방향이 있는 광원, 렌즈와 프레이밍 선택, 감정 레지스터, 그리고 모델이 필요로 하는 파라미터 플래그. 이 중 두 개를 건너뛰면 이번 주 모두가 생성하는 같은 베이지색 초상화의 마흔 번째 변형을 얻는다.
무드는 사람들이 대부분 완전히 건너뛰거나, 한 번에 세 개의 모순된 형용사를 쌓아 올리는 슬롯이다. 하나 고르자: 조용함, 긴장, 축제적, 임상적. "웅장하고 평온하고 극적"이 한 번에 쌓이면 모델에 세 무드의 평균을 내도록 할 뿐이고, 평탄한 미정형 중간 지점이 나온다. 그리고 기술은 마지막이고 첫 번째가 아니다: 종횡비, 시드, 모델별 플래그. 다른 다섯 개를 실제로 정했으면 그것들을 잠그는 슬롯이다.
Midjourney v7, Flux 1.1 Pro, SD3.5: 같은 브리프, 다른 규칙
같은 여섯 슬롯 브리프를 세 모델에 돌려봤다. 같은 주제, 같은 조명 신호어, 같은 프레이밍. 출력이 예상보다 많이 갈라졌는데, 그게 가정 대신 테스트하는 이유다.
Midjourney v7은 짧은 고신호 구를 원한다. 문장 전체가 아니라. --sref로 스타일 일관성을 그리고 --stylize를 예전 버전보다 더 적극적으로 읽는다. 길게 문단 전체를 입력하면 평균을 다시 안전한 것으로 돌려 뭔가 더 무료하게 만들기 시작한다. 세 모델 중에도 분위기와 대기 조명 감각이 제일 강하지만, 넌 요청하는 방식을 경제적으로 해야 한다.
Flux 1.1 Pro는 정반대로 간다. 자연어 브리프를 따라가고 디테일을 보상하는데, 특히 카메라와 필름 스톡 스펙에서 그렇다. "85mm, f/1.8, 코닥 포트라 400"이라고 말하면 Flux가 플라스틱으로 스무딩하는 대신 그 입자와 색감 반응을 실제로 잡아낸다. 이건 브리프가 일러스트레이션이 아니라 사진일 때 손 뻗어야 할 모델이고, 정확히 그 이유 때문에 전문가 기본값이 됐다.
Stable Diffusion 3.5는 구조화된 가중 키워드를 보상한다: 괄호로 강조를 올리고 대괄호로 내린다. (림 라이트:1.4)는 "강한 림 라이트"라고 문장에 입력하는 것과 다르게 작동하고, 그 숫자 제어가 완전한 어필이다. 커스텀 로라와 컨트롤넷을 스택하는 파이프라인을 만들 때 SD3.5는 여전히 너 자체-호스팅하든 프론트엔드를 통하든 끝에서 끝까지 소유하는 것이다.
이들은 객관적으로 "더 낫지" 않다. 다른 일을 위해 지어진 다른 제어 표면이다. 이번 주 X에서 스크린샷되는 것 때문이 아니라, 쓴 브리프와 제어 표면이 맞는 것을 고르자.
명확히 말해둘 가치: 프로젝트 중간에 한 출력이 실망했다고 모델을 바꾸는 건 스타일이 안 맞는 폴더와 일관성이 없는 결과로 끝나는 가장 빠른 방법이다. 브리프로 모델을 정하고, 모델 자체를 판단하기 전에 같은 브리프를 세네 개 시드로 돌려라. 그리고 제어 표면이 진짜로 브리프가 요구하는 것을 못 할 때만 도구를 바꿔라.
AI 룩을 죽이는 조명 용어
렌더가 "생성됨"을 외치는 가장 빠른 수정: 광원과 방향을 이름 붙여라. "좋은 조명"이 아니라, 그건 정보가 0인 문장이다. 소스, 품질, 방향.
"대나무를 통과하는 낮은 태양, 왼쪽으로 갈퀴질하는 단단한 그림자"는 모델에 가정으로(gaffer가 세트를 밝히는 식) 시뮬레이션할 물리적 설정을 준다. "좋은 조명"은 아무것도 안 줘서 평탄하고 그림자 없고 과도하게 밝은, 서둘러 써서 30초에 완성한 프롬프트의 확실한 마크가 된 룩으로 돌아간다.

자기 조명 용어로 빌려라, 너만의 것을 발명하지 말고: 렘브란트 조명은 어두운 뺨 위 작은 삼각형 빛을 위해, 림 라이트는 배경에서 분리를 위해, 볼루메트릭 안개는 실제 깊이를 가진 대기를 위해. 이들은 꾸며 주기 위해 골라진 꾸미는 단어가 아니다. 각각은 모델에게 너 의도를 추측하는 대신 구체적인 물리적 설정을 시뮬레이션하라고 말한다.
기술 슬롯에 플라스틱 피부 과다-스무딩이 반복되는 문제면 "RAW 사진" 또는 "미가공"을 더해라. 작은 구가 모든 모델이 프롬프트가 추측 여지를 남길 때 디폴트하는 과다-렌더된 룩에 맞서 파격적인 일을 한다.

지금 바로 훔칠 수 있는 다섯 개 프롬프트
위의 세 모델에 걸쳐 테스트했다. 완성된 미술이 아니라, 여섯 슬롯 구조를 기반으로 한 출발점이다. 주제를 바꿔라, 뼈대는 그대로.
편집 초상화: "사분할 초상화, 저각, 35mm 렌즈, 카메라 왼쪽 렘브란트 조명, 억제된 가을 팔레트, 조용하고 결정된 표현, 필름 입자, RAW 사진."
제품 인접 스틸 라이프: "오버헤드 플랫 레이 날것의 콘크리트에, 창 빛에서 한 개의 단단한 모서리 그림자, 한 물체가 약간 오프 센터, 채도를 뺀 톤, 미가공."
브루탈리스트 건축: "와이드 샷, 대칭적 콘크리트 파사드, 흐린 확산 빛, 프레임 안 사람 없음, 찬 색등급, 24mm 렌즈, 다큐멘터리 프레이밍."
리소 인쇄 텍스처 연구: "2색 리소 인쇄 미학, 보이는 레지스트레이션 오프셋, 평탄한 색 블록, 하프톤 도트 패턴, 보이는 종이 입자."
무드 있는 풍경: "와이드 샷, 안개로 필터된 낮은 태양, 차가운 색온도, 긴 그림자, 최소한의 색 팔레트, 시네마틱 구성."
이들 중 하나를 Flux에 포토리얼리즘으로 또는 Midjourney에 분위기로 던져라. 그리고 출력이 실망할 때 어느 슬롯이 첫 번째로 부러지는지 봐라. 그게 보통 넌 다음 라운드에 더 많이 조이는 정확한 슬롯이지, 맹목적으로 다시 롤링하는 이유가 아니다.
스크린샷 무덤 대신 프롬프트 라이브러리 만들기
대부분의 사람 "프롬프트 컬렉션"은 Notes 앱에 파묻힌 마흔 개 스크린샷인데, 라벨도 없고, 여섯 주 뒤 정말로 그 정확한 조명 설정이 필요할 때 다시 쓸 수 없다. 그건 라이브러리가 아니라, 넌 절대 파헤칠 무덤이다.
동작하는 라이브러리는 분위기가 아니라 슬롯으로 태그를 단다. 프롬프트를 "조명: 단단한 측면 빛" 그리고 "스타일: 리소 인쇄," 아래에 파일하지, "멋진 것" 또는 "여우 것" 아래에. 한 달 뒤 구체적인 조명 설정이 필요할 때, 넌 스크롤 카메라 롤 썸네일 인식을 희망하는 대신 10초에 찾는다.

여기가 Are.na가 워크플로우에서 자리를 번다. 좋으면-좋다가 아니라 단계 전 단계로서. 단일 프롬프트 입력 전 참조를 Are.na-화하라: 시각 DNA(빛, 텍스처, 팔레트)를 먼저 채널로 막고, 그 다음 그 채널을 여섯 슬롯으로 번역하라. 모델에 곧바로 입력하는 것보다 느리지만, 출력이 모두의 것과 바뀔 수 없게 된다.
반복이 더 나쁘게 만들 때
시드를 잠가라. 라운드마다 정확히 한 슬롯을 바꿔라. 그게 전부고, 거의 아무도 안 한다.
출력이 실망했을 때의 본능은 열 번 다시 롤링해 무작위 시드가 저장하길 희망하는 것이다. 실제로 동작하는 것: 시드 고정 유지, 정확히 하나 변수 시간마다, 조명 첫 번째, 그 다음 구성, 그 다음 무드, 그리고 원래 쓴 브리프에 맞게 결과를 평가하라, 오늘 개인적으로 분위기를 좋아하는지에 맞춰가 아니라. "내가 요청한 것과 맞나"는 "넌 좋아할까"를 이기는데 매번이다, 왜냐하면 두 번째 질문은 끝점이 없고 넌 사양 대신 감정을 쫒다가 백 세대를 불탈 것이기 때문이다.
넌 한 번에 네 가지를 바꿨는데 여전히 개선 없이 다시 롤링하면, 브리프가 처음부터 완전하지 않았다. 여섯 슬롯으로 돌아가라. 뭔가 빈다, 그리고 아무 다시 롤링도 빈 슬롯을 고치지 않는다.
사진 현실주의 쪽 깊은 기술 제어를 위해, Black Forest Labs가 Flux의 프롬프트 순응과 가이던스-스케일 동작을 대부분의 제삼자 가이드보다 더 상세히 문서화했고, 캐주얼 사용을 지나 밀어붙인다면 15분은 가치있다.
어떤 모델에서 먼저 실행해야 할까?
Flux 1.1 Pro 브리프가 사진처럼 읽히면. Midjourney v7 분위기처럼 읽히면. SD3.5 파이프라인 끝에서 끝까지 소유하고 싶고 커스텀 로라를 베이스 모델 위에 스택해야 하면.
여기 보편적 답은 없고, 누구든 하나 팔면 너한테 메소드가 아니라 템플릿 팩을 팔고 있다. 먼저 여섯 슬롯 브리프를 쓰고, 페이지에 있으면 실제로 뭤한 이미지를 묘사하는지 정하고, 그리고 오직 그 때만 매치하는 모델을 고르자. 위의 다섯 개 프롬프트를 훔쳐, 깨트려, 너 주제와 너 참조 스택을 위해 재건해라. 그게 실제 일이고, 아무도의 쇼케이스 피드를 백 번째로 스크롤하는 것보다 오후에 더 나은 사용이다.