本当に効くAI画像プロンプトの書き方
被写体、設定、光、レンズ、仕上げ。テキストから画像を生成するプロンプトの実践的な構成を、そのまま貼って使える例とともに紹介します。

物足りないレンダーの多くは、被写体だけを書いて終わっているプロンプトから生まれます。するとモデルは、被写体がどこに立ち、どう照らされ、カメラとの距離はどれくらいかなど、ほかのすべてを推測しなければならず、その推測はたいてい、モデルが知る最も平均的な答えになります。良いプロンプトは、それらの判断をあらかじめ済ませておきます。
このガイドでは、ほとんどの静止画に使える5つの要素の構成を紹介し、最初のレンダーが惜しいところまで来たときにプロンプトを絞り込む方法を説明します。
強いプロンプトの5つの要素
- 被写体 - 画像に何が写っているか。具体的なディテールを1つか2つ添えます。「陶器のティーポット」は出発点、「注ぎ口が欠けたマットな白い陶器のティーポット」なら絵になります。
- 設定 - それがどこにあるか。台の上、部屋、風景、被写体を切り離したいなら無地の背景など。
- 光 - ムードを左右する最大の要素です。光源と方向を示しましょう。「左からの低い窓の光」「真上からのハードなスポットライト」など。
- カメラ - 距離とレンズ。「マクロのクローズアップ」「ワイドショット」「85mmのポートレートレンズ、浅い被写界深度」など。
- 仕上げ - 最終的な画像の見た目。「エディトリアル写真」「フィルムグレイン」「すっきりしたスタジオの商品写真」など。
毎回5つすべてが必要なわけではありませんが、省いた要素はそれぞれ、モデルに判断を委ねることになります。
使い込まれたオークのテーブルに置かれた、注ぎ口が欠けたマットな白い陶器のティーポット、左からの低い窓の光、やわらかな影、50mmレンズ、浅い被写界深度、静かなエディトリアルの静物写真、フィルムグレイン長さより順序が大切
画像モデルは、先に書かれたものにいちばん注意を払います。被写体を先頭に、次に設定を置き、スタイルの言葉は最後に回しましょう。「シネマティック、8k、傑作」で始まるプロンプトは、最も強い位置を、何も具体的に表さない言葉に使ってしまっています。
長さもある程度までは役に立ちます。形容詞を並べた1段落より、具体的なディテールを書いた1、2文のほうが効果的です。「美しい」の類語を5つ並べていることに気づいたら、4つは消しましょう。
望むものを書き、望まないものは書かない
「散らかっていない」と書いても、散らかりのイメージはプロンプトに入ってしまいます。代わりに、そこに何があるべきかを書きましょう。「何もないコンクリートの床」「空っぽの白い背景」のように。否定より、肯定の描写のほうが確実です。
変更は一度に1つずつ
レンダーが惜しいところまで来たら、1つの要素だけを変えてもう一度実行します。光だけを入れ替え、ほかはそのまま。次にレンズ。3つ同時に変えると、どれが効いたのか分からなくなります。
スタジオでは、どの結果でもプロンプトを再利用を押すと、そのプロンプトがコンポーザーに戻り、1つのフレーズだけを編集できます。またバリエーションを押すと、同じアイデアで別のテイクを生成します。料金はレンダーごとに事前に表示されるので、繰り返し試しても予想外の請求はありません。
書く前にフレームを決める
縦長の4:5と横長の16:9では、求められる構図が異なります。まず画像を使う場所を決めましょう。フィード、バナー、スマホの壁紙など。そのうえで、その形に合うシーンを描写します。どのフレームが何に向くかは、アスペクト比のガイドで解説しています。
アレンジして使える3つのプロンプト
磨かれた黒い石の上のガラスの香水ボトル、ソフトボックスの映り込みが1つ、紫のリムライト、暗い背景、マクロの商品写真夜明けの廃墟となった温室、割れたガラス、生い茂るシダの間に漂う霧、屋根から差し込む淡い金色の光、ワイドショット、24mmレンズ、シネマティック真上から見下ろしたラーメンのどんぶり、立ちのぼる湯気、暗いスレートのテーブル、温かいタングステンの光、料理のエディトリアル写真よくある質問
AI画像のプロンプトはどれくらいの長さが適切ですか?
具体的なディテールを1、2文書けば、たいてい十分です。それ以上は、形容詞を足しても結果が鮮明になるどころか、ぼやけがちです。
8kや傑作といったスタイルの言葉は効果がありますか?
ほとんどありません。具体的なことは何も表していないからです。光、レンズ、写真のジャンルを指定するほうが、はるかに効果的です。


