AI 風景プロンプト:3つのモデルで同じブリーフをテスト、異なる結果を検証

要約

同じプロンプトを3つのAIモデルで検証。本物らしい風景生成には6つのスロット構造(被写体・スタイル・光・構成・気分・技術)が効果的。スケール参照の正確な配置、カメラスペックの使い分け、SD3.5のサンセット問題など、プロンプト構築の実践的なテクニックを解説。

金色の時間帯に照らされた山々の尾根にハイカーのシルエットがスケール用に立つアルプスの山脈

AI 風景 プロンプトで本物らしい生成画像を得るには、プロンプトの長さではなく構造が重要だ。Midjourney v7、Flux 1.1 Pro、Stable Diffusion 3.5で同じブリーフを試して、AI 風景 プロンプトのどの要素が実際に出力を左右するのか、どれが単なる装飾なのかを検証した。結論:6つのスロットは6つの形容詞に勝つ。常に。そして誰もが飛ばすそのスロットが、最も重要な働きをしている。

同じプロンプト、3つのモデル、3つの異なる風景

3つのモデルに全く同じブリーフを入力した:山頂、金色の時間帯、谷間の低い霧、スケール用のハイカー。同じ単語、同じ順序、各5シード、固定シード範囲だから幸運な結果と不運な結果を比較することはない。

Midjourney は気分を最優先、地理は2番目。尾根は信じられるほど、霧には重量があったが、岩場は数秒見つめると明らかに創作物だった。

Flux は尾根の幾何学をほぼ文字通りに尊重した。カメラとレンズの指定を雰囲気ではなく指示として扱うため、「32mm, f/11」がシーンの4つのレイヤーすべての焦点深度を実際に変えた。前景だけでなく。

SD3.5 は3つの中で最もフラットな結果をくれた。使える状態だが、グレイン追加とフィルムストック参照が必要だった。そうしないとゲームエンジンから直出のレンダーに見える。

ここで「最高」なモデルはない。同じ6つのスロットに異なる方言で反応する異なるツールだ。実装するものに基づいて選べ:ムードボード=Midjourney、クライアント向けヒーロー画像=Flux、高速バリエーション生成=SD3.5。

Misty layered forest valley showing foreground, mid-ground and background depth

6つのスロット構造を風景に応用する

これは肖像画とプロダクトプロンプトについて前に言ったことだが、風景は除外対象ではない:被写体、スタイル、光、構成、気分、技術。1つのスロットを飛ばすと、モデルはそこに最も一般的なオプションを埋める。

風景特有では、「構成」が誰もが最初に落とすスロットで、写真とスクリーンセーバーを分けるもの。

1つの平らな「美しい眺め」ではなく、レイヤーで考えろ。前景の興味、中景の被写体、背景の深さ、空のドラマ。4つのレイヤー、4つの文、終了。

上のフォレスト画は正確にそれで走った:「暗い松のシルエット前景、霧に包まれた丘の中景、薄い尾根背景、曇った拡散光」。それがどれだけ美しいかについての形容詞はない。レイヤリング自体が仕事をした。

分解すると、その画像の6つのスロットは:

すべてのスロットが埋まり、相互に戦わない。これが全トリックだ。2倍の長さでも2つのスロットを2回埋めるだけのプロンプトはこれに負ける。毎回。

気分が幾何学より大事なら、これを最初にMidjourney に入力しろ。下の地形が創作だとしても、大気感の読み込みは最強だ。

スケールはみんな間違った使い方をするチートコード

どの風景プロンプトガイドも「スケール用に何か追加しろ」と言う。ほぼ誰も、どこに追加するのか、なぜそれが構成を変えるだけでなくレンダーの計算を変えるのか、とは言わない。

スケール参照なしでは、モデルは何がどのくらい大きいのか全く分からない。山、砂丘、崖、すべて何をどんなに詳細に岩のテクスチャプロンプトを書いても読まない曖昧な中サイズにデフォルトする。

単一の小さな人物またはオブジェクトをフレームの黄金比地点に、尾根、砂丘クレスト、海岸線に置け。中央ではなく。2つの人物ではなく。1つだ。

なぜ1つで複数ではないのか:複数は「人が行く場所」に読まれ、モデルを観光パンフレットの舞台演出に引きずる。単一の遠い人物は「存在する場所」に読まれ、ほとんどの風景ブリーフが実は追い求めている感覚だ。

Vast sand dunes at blue hour with a tiny human figure on a distant ridge for scale

この砂丘ショットを人物ありなし両方でテストした。同じシード範囲、同じプロンプト。なしだと砂丘はデスクトップ壁紙に見えた。ありだとスケールがカチッと所定の位置に収まり、画像全体が本当の場所として読まれた。

実際に違いを生むカメラスペック

「8K超リアル」は何もしない。十分テストしたので、平らに言える。解像度キーワードは劇場、指示ではない。

実際にレンダーを変えるもの:焦点距離、絞り、本物のカメラまたはレンズ名。Flux 1.1 Pro は特に、これらを美的フレーバーテキストではなく光学指示として扱う。なぜならそのトレーニングが写真的に正確な焦点深度とレンズ特性に強く傾いているから。

一貫してプロンプト内での場所を獲得するいくつか:

矛盾したスペックを同じプロンプトに積み重ねるな。「14mm超広角、f/1.4、テレ圧縮」は互いに議論する3つの異なる写真で、モデルはそれらを平均化してドロドロにするだろう。

SD3.5 もこれらの言葉に反応するが、より字義通りではない。契約ではなくヒントとして扱い、失望することはない。Flux のように正確な光学数学にコミットするのではなく、光と深度の手がかりを正しい方向にシフトさせる。

SD3.5がサンセットでつまずき続ける理由

ここがプロンプトガイドに入れる人は誰もいない:SD3.5 は広い空グラデーションのカラーバンディングで実在して反復可能な問題を持つ。サンセットやサンライズを十分に押し付けると、滑らかなブレンドの代わりに色遷移のかすかなステップが見える。

12のゴールデンアワースカイをそれを確認するため通した。ワンオフシードではなかった。12のうち8つは全解像度で見える時のバンディングを示した。

考えられる原因は圧縮ビデオスカイに表示されるのと同じもの:広い色範囲に渡る滑らかなグラデーションは連続したブレンドの代わりに見える段階に量子化され、SD3.5 のサンプリングは風景スケールグラデーションでそれに対する耐性が Midjourney か Flux より低い。

修正は「より詳細を追加する」ではない。逆だ。フィルムグレインまたはノイズ参照を追加し、バンディングは直接戦われるのではなくテクスチャでマスクされる。「35mmフィルムグレイン、微妙なハロー」はスカイの説明を増やすより天のためにより多くをした。

これが起こるときスカイの形容詞を増やすテンプレーションをスキップしろ。オレンジ色の空についての言葉が増えても、このレンダリング成果物を修正しない。これは正確に「スキップ」誰もプロンプトガイドに入れてない種だ、なぜなら、ユーザーの代わりにモデルを悪く見させるから。

天気が場所の前にシーンを売る

「山の風景」を「山の風景、迫り来る嵐、雲の切れ目を通して壊れる光」に入れ替え、構成は他の何かに触れる前に改善する。天気はモデルに光、影、テクスチャを均等に代わりに意図で置く理由を与える。

Dramatic coastal cliffs under an incoming storm with light breaking through the clouds

この崖のショットは地理的に興味深いことをほぼ何もしていない。それを運んでいるのは嵐の光とフォアグラウンドのスプレーテクスチャ。同じプロンプトの平らな青空版に入れ替え、直接スクリーンセーバー領域に戻る。

時間帯も同じ仕事を、より安くする。ゴールデンアワー、ブルーアワー、厳しい真昼、曇った昼:それぞれが単一の岩や木を異なる説明することなくモデルに影がどこに落ちるか、色がどのくらい飽和すべきかを伝える。

天気自体が背景ではなく被写体になることを望むなら、Ideogram はテキストなしの大気シーンをきれいに処理し、極端なアスペクト比でも空が濁るのを防ぐ。

目的で本物らしさを破る

すべての AI 生成風景が写真として渡す必要があるわけではない。時々ブリーフはリソプリントグラデーション空と岩の形成で、そのままではいられず、フォトリアリズムは完全に間違ったターゲットだ。

そのために、スロットの半分をカメラスペックから落とす。被写体、スタイル、気分を保ち、構成と色パレットが光学精度の代わりに画像を運ぶようにする。

Surreal riso-print style landscape with floating rock formations in a pastel gradient sky

これは2色パレット制限とハーフトーングレイン参照でプロンプトを走った。プロンプト内のどこにもカメラボディは言及されない。1つを追加する瞬間、モデルはそれを不可能な幾何学と和解させようと試み、全体が一般的に崩れ戻る。

このモードはアルバムアート、エディトリアルスプレッド、リソ隣接ジン表紙、ブリーフが「明らかに撮影された」より「明らかに構築された」が必要な場所に到達する価値がある。ここでモデルをリアリズムに戻す戦いは世代を浪費するだけだ。

Leonardo AI のスタイルリファレンスワークフローは、ワンオフ画像の代わりに反復的なシュールシリーズを構築している場合ここで見る価値がある。セット全体の生パレットを保持し、これはセットを製造する代わりに単一のヒーロー画を製造する一度、生出力品質より重要だ。

コピーする価値のある4つのプロンプト

これらをコピー、場所をスワップ、構造をそのまま保つ。

これをコピー、場所と光をリミックス、最後の1つにカメラスペックを追加しないでくれ。

よくある質問

同じプロンプトでMidjourney、Flux、SD3.5の結果が違う理由は?
3つのモデルは同じ情報に異なる方言で反応します。Midjourney は気分と大気感を優先し、Flux はカメラ指定を光学的に解釈し、SD3.5 は素早くフラットな結果を生成します。実装の目的に合わせて選ぶべきです。
風景プロンプトで最も重要な6つのスロットは何ですか?
被写体、スタイル、光、構成、気分、技術です。それぞれのスロットを埋めることで、形容詞を増やすより効果的です。特に構成(前景・中景・背景・空)を正確に定義することが写真とスクリーンセーバーの違いを作ります。
スケール参照を追加するときの最良の方法は?
単一の小さな人物またはオブジェクトをフレームの黄金比地点に置いてください。複数の人物は「観光地」に見え、単一の人物は「存在する場所」に見えます。これがAIモデルのレンダリング計算を根本的に変えます。
カメラスペック(焦点距離、絞り)は実際に効果がありますか?
はい、特に Flux 1.1 Pro では。「8K超リアル」のような解像度キーワードは効果がありませんが、「14mm f/11」のような具体的なカメラパラメータは焦点深度と光の層の正確性に影響します。矛盾したスペックを重ねるのは避けてください。
SD3.5 でサンセットのカラーバンディングが出る理由は?
SD3.5 は広い色範囲のグラデーションで色量子化に敏感です。修正は「より詳細を追加する」ではなく、「35mmフィルムグレイン」のようなテクスチャ参照を追加してバンディングをマスクすることです。
天気表現がプロンプトに与える影響は?
天気(嵐、霧、ゴールデンアワー)はモデルに光と影の配置について具体的な指示を与えます。場所の説明より先に天気を定義することで、構成の質が大幅に改善されます。
フォトリアリズムではなく、シュールなスタイルを狙う場合はどうしますか?
カメラスペックを落とし、色パレットと構成を重視してください。複数の人物や具体的な光学パラメータを追加しようとすると、モデルが不可能な幾何学を調整しようとして全体が崩れます。
★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   ★ steely dan × liminal hotel room × 35mm film ★ brutalist architecture sunset vaporwave ★ 1970s rock album × medium format ★ renaissance cyberpunk samurai ★ macro honey gold leaf ★ tokyo aerial rain cinematic ★ surrealist collage editorial ★ analog grain portrait studio ★ neon botanical illustration ★   
✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦ copy the prompt ✦ remix this ✦ drop into flux ✦ steal this look ✦ open the moodboard ✦ crack it open ✦ send to nano banana ✦ go wild ✦