Skip to content
PromptIdeas

AI画像プロンプトの書き方(シンプルな公式付き)

ChatGPT、Gemini、Midjourney、Flux、Stable Diffusionで使える、AI画像プロンプトのシンプルな6つの要素の公式。ビフォー・アフターの例付きで解説します。

2026年9月23日更新

良いAI画像プロンプトは、長くも凝ってもいません。具体的なのです。モデルは1枚の画像ごとに、被写体の見た目、カメラの位置、光の当たり方など、何百ものことを決めなければなりません。書かなかった部分は、すべて推測で補われます。良いプロンプトほど、推測の余地が少なくなります。

このガイドでは、主要な画像生成AIすべてで使える1つの公式を紹介し、それを各モデルに合わせて調整する方法を説明します。

プロンプトの6つの要素の公式

プロンプトは次の順番で書きます。毎回すべての要素が必要なわけではありませんが、モデルは冒頭に最も注目するので、順番は重要です。

  1. 被写体と動作。 誰が・何が、何をしているか。「網を繕う年老いた漁師」。
  2. スタイル。 写真、アニメ、油絵、3Dカートゥーン、ロゴ。1つを選びます。
  3. 構図。 クローズアップ、全身、広角、真上から、ローアングル。
  4. ライティング。 ゴールデンアワー、柔らかいスタジオ光、ネオン、キャンドルの光、窓からの光。
  5. 雰囲気と色。 心地よい、ドラマチック、穏やか。暖色系、パステル、白黒。
  6. サイズ。 正方形、縦長2:3、ワイド16:9。

実際に公式を使った例を見てみましょう(AIモデルは英語のプロンプトで最も良く動くので、例は英語のままにしています)。

ビフォー: a fisherman

アフター: A photorealistic photograph of an old fisherman mending nets on a wooden boat at dawn. Medium shot from the waist up. Soft warm sunrise light from behind, with mist on the water. The mood is calm and quiet. Muted blues and warm highlights. Vertical 2:3 format.

(訳:夜明けの木造船の上で網を繕う年老いた漁師のフォトリアルな写真。腰から上のミディアムショット。背後からの柔らかく暖かい朝日、水面には霧。雰囲気は穏やかで静か。落ち着いた青と暖かいハイライト。縦長2:3の形式。)

2つ目のプロンプトは特別凝ったものではありません。モデルが本来推測するはずだった質問に答えているだけです。

被写体から始めて、具体的に書く

「女性」と書けば、平均的な女性が出てきます。「銀髪をゆるいお団子にまとめ、緑の綿のサリーを着た60代の女性」と書けば、1人の人物が出てきます。具体的な名詞とディテールは、形容詞よりも常に効果的です。

あいまいな言葉を、指させるようなものに置き換えましょう:

あいまい 具体的
きれいなドレス 金のザリ刺繍の縁取りがある赤いシルクのレヘンガ
すてきな背景 青いドアと吊るされた植物が並ぶ細い路地
かっこいい照明 濡れた舗道に映るピンクと青のネオンサイン
古い車 クロームバンパー付きの1960年代のミントグリーンのアンバサダー

スタイルは1つに決める

スタイルを混ぜることは、仕上がりが濁る最もよくある原因です。「フォトリアルなアニメ風水彩画」は、3つの異なるものを求めています。メインのスタイルを1つ選びましょう。ブレンドしたい場合は、ベースのスタイルを先に、影響を受けたいスタイルを後に書きます:「柔らかい水彩の背景を持つアニメイラスト」。

仕事の大半はライティングがしてくれる

同じ被写体のプロンプトでも、光が違えばまったく違って見えます。画像がのっぺりして見えるなら、解決策はたいてい細部を増やすことではなく、ライティングです。ほぼ確実に効果があるものをいくつか紹介します:

  • ゴールデンアワー:暖かく見栄えの良いポートレートや風景に
  • 横からの柔らかい窓明かり:自然な室内写真に
  • 深い影のあるローキー照明:ドラマチックな演出に
  • リムライトの輝きがある逆光:被写体を背景から浮き立たせるために

プロンプトをAIモデルに合わせる

同じアイデアでも、モデルによって書き方を変えるべきです。AI画像プロンプトジェネレーターなら自動でやってくれますが、ここでは何が変わるかを説明します。

ChatGPTとGemini

カメラマンに指示を出すように、普通の文章で書きます。入れたくないものは言葉で伝えましょう:「No text or watermarks.(文字や透かしは入れない)」。自分の写真をアップロードする場合は、「Keep the face and identity exactly the same as the uploaded photo.(アップロードした写真と顔や雰囲気をまったく同じに保つ)」を加えます。

Midjourney

最も重要な単語をカンマ区切りで並べ、最後にパラメーターを付けます:

old fisherman mending nets on a wooden boat, dawn, photorealistic, medium shot, soft sunrise backlight, mist, calm, muted blues --ar 2:3 --v 7 --style raw

--arはアスペクト比を設定し、--style rawはより写真らしい見た目にし、--noは要素を取り除きます(--no text, watermark)。

Stable Diffusion

キーワードを使い、被写体をかっこで囲んで重みを加え、不要なものはネガティブプロンプト欄に入れます:

(old fisherman mending nets on a wooden boat:1.2), dawn, photorealistic photo, soft backlight, mist, masterpiece, best quality, highly detailed

ネガティブプロンプト:blurry, lowres, watermark, text, deformed, bad anatomy, extra fingers

Flux

Fluxは自然な言葉をよく理解します。ChatGPTスタイルのプロンプトを使いますが、アスペクト比はテキストではなくアプリ側で設定しましょう。

うまくいかないプロンプトを直す

  • 被写体が違う: 被写体をいちばん最初に移し、具体的なディテールを2つ加えます。
  • 作り物っぽい、プラスチックのよう: 「natural skin texture(自然な肌の質感)」「film grain(フィルムの粒子感)」や、「85mm」のような実在のレンズを加えます。
  • ごちゃごちゃしている: 形容詞を半分に減らし、「clean background(すっきりした背景)」や「negative space(余白)」を加えます。
  • 切り取り方が違う: 構図(「full body, head to toe visible(全身、頭からつま先まで見える)」)とアスペクト比を指定します。
  • ほぼ理想どおり: プロンプトはそのままにして、書き直す前に2~3回生成し直してみましょう。

かんたんチェックリスト

生成ボタンを押す前に、プロンプトが次の点に答えているか確認しましょう:何を、どんなスタイルで、どこから、どんな光で、どんな雰囲気で、どのサイズで。これで、良い画像を作る要素の9割をカバーできます。

これらのアイデアを実際の結果で見てみたいですか?プロンプト集では、すべてのプロンプトを生成された画像と一緒に掲載しています。

よくある質問

AI画像プロンプトに最適な書き方は?

まず被写体と何をしているかを書き、次にスタイル、構図、ライティング、雰囲気と色を加え、最後にサイズで締めくくります。ChatGPTとGeminiは完全な文章を好み、MidjourneyとStable Diffusionはカンマ区切りのキーワードを好みます。

ネガティブプロンプトは使うべき?

ネガティブプロンプト欄があるStable DiffusionやFluxのツールではそこに、Midjourneyでは--noで指定します。ChatGPTやGeminiでは、「no text or watermarks(文字や透かしは入れない)」のように、入れたくないものを普通の文章で伝えるだけで大丈夫です。

AI画像で手や文字がおかしくなるのはなぜ?

手や文字は、正確に描く必要がある細かいパーツが多いためです。新しいモデルはかなり改善されていますが、手はシンプルに(物を1つ持つ、ポケットに入れるなど)し、必要な文字は引用符で囲んで短くすると効果的です。