- ブログ
- AI画像生成プロンプト:応用できる7つの再利用可能なパターン
AI画像生成プロンプト:応用できる7つの再利用可能なパターン
再利用可能なAI画像生成プロンプトは魔法の言葉ではなくパターンです。被写体・ライティング・構図のためのスロットベースの7つのパターンと、それぞれに必要な確認項目を解説します。

AI画像生成プロンプトは、ある程度予測できる形で失敗します。たとえば「猫の美しい写真」という願望を入力すると、モデルはあらゆる隙間を自分好みで静かに埋めてしまいます。そこで、もっとたくさん書こうとしたり、秘密のキーワードを探したりしがちです。しかし、より良いのは構造を意識して書くことです。クリエイティブブリーフのように機能するプロンプトは、何を見せるか、どのように見えるべきか、物がどこに配置されるか、何を省くかを、各指示が持つ重みの順序に沿ってモデルに伝えます。以下の7つのパターンは、被写体やプラットフォームを問わず再利用でき、それぞれに、画像を採用する前に確認すべき項目が添えられています。
形容詞ではなく、構造から始める
Adobeのテキスト・トゥ・イメージ(text-to-image)プロンプトのガイドは、装飾よりも明瞭さと具体性を優先しています。明確な指示から始め、一貫した書式を使い、関連するディテールを論理的な順序でまとめ、望ましくない解釈を排除する文脈や制約を加えることです(Adobe Express、AI画像生成ツール向けテキストプロンプトの例)。要点は、すべてのプロンプトに6つの節が必要ということではありません。安定した形があれば、ある試行を次の試行と比較できる、ということです。
Typefaceは同じ考えを固定の順序として示しています。すなわち「[画像タイプ]の[メインの被写体]を[背景のシーン]に配置した、[構図スタイル]」という形で、順序が重要な理由も挙げています。モデルは前の方の単語をより重く扱うため、画像タイプとメインの被写体は、背景やムードより前に来るべきだというのです(Typeface、優れたAI画像プロンプトの書き方)。Cloudinaryはプロンプトを、被写体、設定、スタイル、構図、ライティング、ムード、制約を備えたブリーフだと説明し、強いプロンプトは具体的だが詰め込みすぎないように、と警告しています(Cloudinary、画像生成プロンプト)。3つのガイドに共通する前提は一つです。プロンプトはスロットベースのブリーフであり、そのスロットは再利用できるということです。
パターン1:既定の骨組みとしてのスロットスタック
最もシンプルな再利用可能パターンは、固定されたスロットの並びです。
[被写体] + [設定] + [スタイル] + [構図] + [ライティング] + [ムード] + [制約]
Cloudinaryの一行のフォーミュラは、漠然とした被写体を読み取れるブリーフに変えます。「コーヒーカップ」と「明るい木製の机の上の陶器のコーヒーマグ、リアルな製品写真、中央配置の構図、柔らかな朝の日差し、温かくミニマルなムード、文字や余計な物体なし」を比べてみてください。2つ目のプロンプトは、被写体、設定、スタイル、配置、光、ムード、そして境界をモデルに与えています。毎回すべてのスロットを埋めるわけではありません。Cloudinaryはこのフォーミュラを契約ではなくチェックリストとして扱っています。それでもスロットを同じ順序に保つことで、各結果を比較でき、それが当てずっぽうではなく、外れの原因を診断できるようにしてくれます。
パターン2:被写体から書き始める
前の方の単語ほど重みを持つため、報われるのは被写体のスロットです。Cloudinaryは「靴」と「厚いソールと控えめな青いアクセントを備えた白い革のランニングシューズ」を対比させて違いを示しています。2つ目のプロンプトは素材、形状、アクセントを明示しているため、モデルが創作しなければならない部分が少なくなります。Typefaceは反対側から同じ点を指摘し、ディテールを優先順位で並べないプロンプトは、被写体をスタイルの言葉の下に埋もれさせ、そのスタイルの言葉が画像を支配してしまうと警告しています。名詞と、それを他と区別するディテールを先頭に置き、スタイルにはそれらを先導させるのではなく、磨かせるようにしましょう。

ここでの確認は簡単です。出力が凡庸に見えるなら、他の何かに手を付ける前に被写体のスロットを見直しましょう。名詞、素材、そしてこの被写体を同種のあらゆるものから区別するディテールを1つ挙げてください。
パターン3:スタイルより先に画像タイプを1つに固定する
Typefaceが画像タイプを最初に置くのには理由があります。写真、製品写真、イラストはそれぞれレンダリングを別の方向へ引っ張り、それらを混ぜたプロンプト——たとえば「フォトリアルな水彩ポスター」——は、両立しない2つの指示をモデルに与えてしまいます。Cloudinaryも同じカテゴリーを分けて扱い、フォトリアル、エディトリアル写真、シネマティック、ミニマリスト・イラスト、3Dレンダー、フラットベクターを、装飾的な形容詞ではなく別個の方向性として挙げています。最初のフレーズで媒体を決め、残りのスロットにはそれを磨かせましょう。
パターン4:ライティングを最大のてこ(レバー)として扱う
すべてのスロットの中で、最も少ない言葉で画像を最も大きく変えるのがライティングです。Cloudinaryは柔らかな朝の光、ゴールデンアワー、ドラマチックなサイドライト、明るいスタジオ照明、ネオンの反射、曇天の自然光を挙げ、平坦な画像と洗練された画像の差はたいてい光にあると述べています。文脈と制約を加えるよう促すAdobeの助言——照明条件、スタイル、ムードを含む——も同じ方向を指しています。ライティングのフレーズ1つは、品質についての余分な形容詞3つよりも多くの仕事をします。
確認は、結果の中の光を読み取り、自分が書いたフレーズと一致しているかを問うことです。画像が平坦なら、「美しい」という言葉の代わりに、方向(サイド、バック)、質(ソフト、ハード)、時間帯(朝、ゴールデンアワー)を加えましょう。
パターン5:構図を書き、意図的に余白を残す
構図は、多くの人が飛ばしてしまうスロットであり、製品画像やウェブ画像がたいてい必要とするスロットです。Cloudinaryの例は明快です。製品を画像の右側に置き、ウェブサイトのコピー用に左側へきれいな空白を残す——そしてAdobeは、プロンプトが要素の特定の配置を必要とする場合には、段階を追った指示を勧めています。配置(中央、真上からの俯瞰、下中央、片側のネガティブスペース)を明示すれば、モデルが対称的で中央揃えのフレームに既定で落ち着いてしまうのを防げます。

パターン6:制約の行で締めくくる
ネガティブな指定をプロンプト全体に散りばめるのではなく、短い締めくくりの一行にまとめましょう。Adobeは文脈と制約を、生成器の焦点を絞り、望ましくない解釈を排除する方法として位置づけており、Cloudinaryは制約を独立したスロットとして扱っています。文字なし、ロゴなし、製品を変更しない、被写体をトリミングしない。制約の行は、意図的な最終文として機能させるのが最もうまくいきます。なぜなら、そのルールは画像内の単一の要素ではなく、画像全体に適用されるからです。
パターン7:1回の試行につき1つのスロットだけ変える
この一連のガイドはすべて、プロンプト作成を一発勝負ではなくループとして説明しています。Adobeは、最初の試行を分析し、そこから微調整しながら反復と改良を重ねるよう述べています。Cloudinaryは、明確なベースプロンプトから始め、一度に1つか2つのディテールを磨くことを勧めています。Typefaceは、画像が目標に達するまで修飾語を繰り返し加えることを述べています。実践的なルールは、1回の生成につき1つの変数だけを変えることです。被写体、スタイル、光を一度に書き換えてしまうと、たとえより良い画像が得られても、再利用できるものは何も学べません。
パターンを新しい被写体に適応させる方法
パターンを順に並べると、繰り返し使えるワークフローが導き出されます。
- 被写体を具体的な名詞句として書く——素材、形状、そして区別できるディテールを1つ。
- 最初のフレーズで画像タイプを固定する。写真、製品写真、イラストのいずれか。
- 設定を1つ、スタイルを1つ、ライティングのフレーズを1つ、構図の指示を1つ加える。
- 繰り返し目にするアーティファクト(不要な生成物)をカバーする制約の行で締めくくる。
- 生成し、ブリーフに最も近いバージョンを残し、次のラウンドの前にちょうど1つのスロットだけを変える。
- 勝ちパターンの行を、次の被写体のベースとして再利用し、ゼロから始めない。
この骨組みは移植可能です。同じスロットは、KOOX AI テキスト・トゥ・イメージのようなテキスト・トゥ・イメージツールでも機能し、何もないところから生成するのではなく、イメージ・トゥ・イメージで既存のフレームを磨くときにもこのパターンはそのまま活かせます。
プロンプトパターンが機能しなくなる場所
2つの正直な限界が、期待値を正しく保ってくれます。Cloudinaryは、モデルによって反応が異なるため、ある生成器にとって最良のプロンプトが別の生成器にとっても自動的に最良になるわけではないと指摘しています。パターンは出発点となる構造であり、どこでも通用する保証ではありません。Typefaceも同様に率直で、AI画像生成は変動する——同じプロンプトがいつも同じ画像を返すとは限らない——ため、一度うまくいったプロンプトは、そこから反復していく基準であって、固定されたレシピではないと述べています。どちらの指摘もパターンを無用にするものではありません。両者を合わせると、スロットスタックはより速く目標に近づけてくれ、仕上げの仕事を担うのはレビューだ、ということになります。生成された画像は、被写体が損なわれていないか、構図がレイアウトに合っているか、望まないものが紛れ込んでいないかを、人が確認する必要があります。
いつも忘れてしまうスロットから始める
すでに必要としている被写体を取り上げ、完全なスロットスタックで一度書いてみましょう。具体的な被写体、画像タイプを1つ、設定、ライティングのフレーズ、構図の行、そして締めくくりの制約です。もし習慣を2つだけ身につけるなら、構図のスロットと制約の行にしましょう。この2つは最もよく省かれ、画像が使えるかどうかを最もよく左右する2つです。静止した出発点が欲しいときはテキスト・トゥ・イメージから始め、作り直したいフレームがすでにあるときはイメージ・トゥ・イメージに切り替え、切り抜きにもっと余白が必要なだけのときは、最初から再生成するのではなく画像拡張を使いましょう。どのツールであっても、プロンプトがブリーフであり、品質はブリーフで決まります。