Stable Diffusionのプロンプト(呪文)とは?

Stable Diffusionのプロンプトとは、作りたい画像の中身をAIに伝える英語の指示文です。単語の組み合わせが魔法の詠唱のように見えることから、日本では「呪文」と呼ばれています。
Stable Diffusionとは、Stability AIが公開している画像生成AIです。モデル(学習済みのAI本体)を無料で入手でき、自分のPCでも動かせます。現行の主力はSD 3.5(Large・Medium・Turbo)とSDXLです。
プロンプト欄は2つあります。
- ポジティブプロンプト: 画像に入れたい要素を書く欄
- ネガティブプロンプト: 画像から消したい要素を書く欄
呪文集と呼ばれるものの中身は、この2欄に入れる定番の単語リストのこと。暗記は不要で、型を覚えて差し替えるだけで十分です。
では、単語をどんな順番で並べればいいのか。ここが最初の分かれ道です。
編集部のおすすめ
PCに
GPUや環境構築がなくても、登録してすぐブラウザで生成できます。多くは無料枠から試せます。
呪文はどんな順番で書けばいい?

前に書いた単語ほど効きやすい。これが並び順の基本ルールです。いちばん大事な要素を先頭に置き、細かい指定は後ろへ回します。
迷ったら、次の6ブロックで組み立ててください。
| 順番 | ブロック | 書く | 例 |
|---|---|---|---|
| 1 | 品質 | 仕上がりの水準 | masterpiece, best quality |
| 2 | 被写体 | 誰・何が写るか | 1girl, a cat, a red car |
| 3 | 画風 | 写真風かイラスト風か | photorealistic, anime style |
| 4 | 構図 | カメラの距離と角度 | upper body, from above |
| 5 | 光・色 | 明るさや色味 | soft lighting, pastel colors |
| 6 | 背景 | 場所や周りの状況 | city street at night |
つまり、「何を描くか」を前半に、「どう見せるか」を後半に置けば大きく外しません。
単語はカンマ(,)で区切ります。区切りの後の半角スペースは入れても入れなくても動きます。
もう一つ知っておきたいのが、長さの上限です。SD 1.5やSDXLでは、AIが扱う文字のかたまり(トークン)が75個ごとに区切られて処理されます。75を超えても書けますが、後ろの単語ほど効きは弱くなります。欲張って50単語並べるより、15〜25単語に絞るほうが狙いどおりの絵になります。
この順番を頭に入れたら、ブロックごとの定番呪文を見ていきます。
品質と画風を決める呪文16選
品質の呪文は「全体の仕上がり」、画風の呪文は「写真かイラストか」を決めます。どちらもプロンプトの先頭近くに置くと効きます。
品質系の定番8個は次のとおりです。
| No. | 呪文 | 意味 | 効きやすい |
|---|---|---|---|
| 1 | masterpiece | 傑作 | アニメ・イラスト系モデル |
| 2 | best quality | 最高品質 | ほぼ全モデル |
| 3 | high quality | 高品質 | 控えめに品質を上げたいとき |
| 4 | highly detailed | 細部まで精密 | 髪・服・機械の描き込み |
| 5 | ultra detailed | 極めて精密 | 背景の密度を上げたいとき |
| 6 | 8k | 超高解像度風 | 写真風の質感 |
| 7 | sharp focus | ピントがくっきり | ぼやけ対策 |
| 8 | absurdres | 高解像度(タグ用語) | Animagine XLなどタグ型モデル |
つまり、1・2・4の3つを入れておけば、たいていのモデルで底上げができます。
注意点が一つあります。masterpieceやabsurdresは、イラスト投稿サイトのタグで学習したモデル向けの言葉です。SD 3.5のように文章で理解するモデルでは効き目が薄め。入れても害はありませんが、過信は禁物です。
続いて画風系の8個です。
| No. | 呪文 | 仕 | 向いている |
|---|---|---|---|
| 9 | photorealistic | 写真のようにリアル | 人物写真・商品イメージ |
| 10 | anime style | アニメ調 | キャラクター |
| 11 | watercolor painting | 水彩画 | 絵本風・やわらかい挿絵 |
| 12 | oil painting | 油絵 | 重厚な雰囲気のアート |
| 13 | flat illustration | フラットなイラスト | ブログ挿絵・図解 |
| 14 | 3d render | 3DCG風 | アイコン・ゲーム風 |
| 15 | pixel art | ドット絵 | レトロゲーム風 |
| 16 | cinematic | 映画のワンシーン風 | ドラマチックな一枚 |
つまり、画風は1つに絞るのが鉄則です。anime styleとphotorealisticを同時に入れると、中途半端な絵になりがちです。
画風がモデルの得意分野とずれていると、呪文だけでは寄せきれません。実写ならJuggernaut XL、アニメならAnimagine XLやNoobAI-XLのように、モデル選びで8割が決まります。
仕上がりの方向が決まったら、カメラをどこに置くかを決める番です。
構図とカメラを操る呪文8選
構図の呪文は、被写体との距離とカメラの角度を指定します。ここを書かないと、AIは毎回バラバラの距離で描いてしまいます。
| No. | 呪文 | 意味 | 使いどころ |
|---|---|---|---|
| 17 | close-up | 顔のアップ | 表情を見せたいとき |
| 18 | upper body | 上半身 | SNSアイコン・プロフィール画像 |
| 19 | full body | 全身 | 服装やポーズを見せたいとき |
| 20 | from above | 上から見下ろす | 俯瞰(ふかん)の構図 |
| 21 | from below | 下から見上げる | 迫力を出したいとき |
| 22 | wide shot | 引きの広い画角 | 風景と人物を一緒に入れる |
| 23 | looking at viewer | こちらを見ている | 目線を合わせたいとき |
| 24 | depth of field | 背景がぼける | 写真らしい奥行き |
つまり、距離(17〜19・22)から1つ、角度や目線(20・21・23)から1つ選ぶと構図が安定します。
地味に効くのがfull bodyです。指定しないと足先が切れることが多く、全身を描かせたいなら必須と考えてください。縦長の画像サイズと組み合わせると、成功率がさらに上がります。
構図が決まったら、雰囲気を大きく左右する光の指定に進みます。
光と色で雰囲気を変える呪文8選
同じ人物でも、光の呪文を1つ変えるだけで印象はがらりと変わります。プロっぽさを出したいなら、このブロックがいちばん費用対効果の高い部分です。
| No. | 呪文 | 効果 | 合う |
|---|---|---|---|
| 25 | soft lighting | やわらかい光 | ポートレート全般 |
| 26 | golden hour | 夕方の金色の光 | 屋外・エモい写真 |
| 27 | backlighting | 逆光 | 髪の輪郭を光らせたいとき |
| 28 | rim light | 輪郭に沿った光 | 被写体を背景から浮かせる |
| 29 | studio lighting | スタジオ照明 | 商品写真・証明写真風 |
| 30 | neon lights | ネオンの光 | サイバーパンク・夜の街 |
| 31 | pastel colors | 淡い色合い | かわいい系イラスト |
| 32 | monochrome | 白黒 | 漫画風・アート写真 |
つまり、光は1〜2個、色は1個までに抑えると、絵がちぐはぐになりません。
golden hourとbacklightingの組み合わせは定番中の定番。夕日を背にした人物が、それだけで映画のポスター風になります。逆にstudio lightingとneon lightsのように、場所の違う光を混ぜるのは失敗のもとです。
光が決まれば、あとは舞台と登場人物の細部です。
背景と人物の呪文12選
背景の呪文は「どこにいるか」、人物の呪文は「どんな様子か」を決めます。どちらもプロンプトの後半に置いて、主役の指定を邪魔しないようにします。
背景・場所の6個です。
| No. | 呪文 | 意味 | ひとこと |
|---|---|---|---|
| 33 | simple background | 無地の背景 | 被写体が主役の絵に |
| 34 | white background | 白背景 | 切り抜き素材を作るとき |
| 35 | city street at night | 夜の街並み | ネオン系と相性がいい |
| 36 | cafe interior | カフェの店内 | 日常系・広告風 |
| 37 | forest | 森 | ファンタジーや自然系 |
| 38 | blue sky with clouds | 雲のある青空 | 爽やかな屋外シーン |
つまり、素材として使うなら33・34、世界観を出すなら35〜38と使い分けます。
人物・表情・ポーズの6個です。
| No. | 呪文 | 意味 | ひとこと |
|---|---|---|---|
| 39 | smile | 笑顔 | gentle smileで控えめに |
| 40 | long hair | 長い髪 | 色と組み合わせてblack long hairなど |
| 41 | sitting | 座っている | 椅子や場所と一緒に書く |
| 42 | standing | 立っている | full bodyと相性がいい |
| 43 | hands in pockets | ポケットに手 | 手の崩れを避けたいときにも有効 |
| 44 | business suit | スーツ姿 | ビジネス系の挿絵に |
つまり、表情・髪・姿勢・服装を1つずつ足すと、人物像がぶれにくくなります。
43は裏ワザ的な使い方ができます。画像生成AIは手の描写が苦手です。手を隠すポーズにしてしまえば、指の崩れをそもそも避けられます。
ここまでで44個。残りの6個は、消したいものを書くネガティブプロンプトです。
ネガティブプロンプトの定番6選
ネガティブプロンプトは、低画質や崩れた手など「出てほしくないもの」を指定する欄です。SD 1.5やSDXL系では、これを入れるだけで失敗作の割合が目に見えて減ります。
| No. | 呪文 | 消したい | 優先度 |
|---|---|---|---|
| 45 | lowres | 低解像度 | 必須 |
| 46 | worst quality | 最低品質 | 必須 |
| 47 | bad anatomy | 人体の崩れ | 人物なら必須 |
| 48 | bad hands | 崩れた手 | 人物なら必須 |
| 49 | watermark | 透かし文字 | 推奨 |
| 50 | blurry | ぼやけ | 推奨 |
つまり、45〜48の4つが最低ライン。人物を描かない風景画なら、47と48は外して構いません。
コピペ用にまとめると、次の1行になります。
lowres, worst quality, bad anatomy, bad hands, watermark, blurry
ネガティブに入れすぎるのも逆効果です。数十語を詰め込むと、描いてほしい要素まで弱まることがあります。6〜10語で様子を見て、問題が出たときだけ足すのが正解です。
なお、少ない手順で一気に描く高速モデルでは、ネガティブが効きにくくなります。CFG(指示にどれだけ忠実に従うかの強さ)を1前後で動かす設定だと、ネガティブ欄がほぼ無視されるためです。
ここまでの整理: 呪文は「品質→被写体→画風→構図→光→背景」の順に並べ、各ブロックから1〜2語ずつ選ぶ。ネガティブは4〜6語で十分。50個全部を使う必要はなく、組み合わせは毎回15〜25語が目安です。
呪文を選べるようになったら、残る課題は「効かせ方」です。
呪文が効かないのはなぜ?強調記法と書き方のコツ
呪文が効かない原因は、たいてい「位置が後ろすぎる」「ほかの単語に埋もれている」の2つです。強調記法で重みを上げれば、多くは解決します。
AUTOMATIC1111・Forge・ComfyUIでは、カッコで重みを調整できます。
| 書き方 | 意味 | 使い方の |
|---|---|---|
(red dress) | 約1.1倍に強める | 少しだけ目立たせたいとき |
(red dress:1.3) | 1.3倍に強める | 確実に反映させたいとき |
(red dress:0.8) | 0.8倍に弱める | 主張を控えめにしたいとき |
<lora:ファイル名:0.8> | 追加学習データを0.8の強さで使う | LoRAで画風やキャラを足すとき |
つまり、数字で指定する (単語:数値) の形だけ覚えれば、ほとんどの場面に対応できます。
数値の目安は1.1〜1.4です。1.5を超えると色が飛んだり形が崩れたりしやすく、正直おすすめしません。効かないときは数値を上げる前に、単語を前に移動させてみてください。それだけで直る場面はかなり多いものです。
ほかにも、手を動かしながら覚えたいコツが4つあります。
- シード値を固定する: 乱数を固定すると、呪文を1語変えたときの差だけを比べられる
- 1回に変える単語は1つ: 複数を同時に変えると、何が効いたか分からなくなる
- 色は対象とセットで書く: 「red, dress」より「red dress」のほうが色移りしにくい
- 矛盾する語を同居させない: smileとcryingを並べると、どちらつかずの表情になる
地味ですが、シード固定の効果は圧倒的です。これをやらずに呪文を比べても、偶然の当たり外れに振り回されるだけです。
同じ呪文でも、モデルが違えば効き方が変わります。その書き分けを確認しておきましょう。
SD 3.5・SDXL・アニメ系モデルで書き分けは必要?
必要です。SDXLとアニメ系モデルは「単語を並べるタグ型」、SD 3.5は「文章で説明する型」が合います。同じ呪文を貼り回すと、どちらかで必ず精度が落ちます。
| モデル系統 | 合う | プロンプト例 | ポイント |
|---|---|---|---|
| SD 1.5系 | タグ型 | masterpiece, 1girl, smile, upper body | 品質タグとネガティブが効きやすい |
| SDXL系 | タグ型+短文 | best quality, a woman in a cafe, soft lighting | 1024pxが標準。短い文も通じる |
| アニメ特化(Animagine XLなど) | タグ型(イラスト投稿サイトのタグ語彙) | 1girl, solo, long hair, absurdres | タグの綴りが一致すると強く効く |
| SD 3.5系 | 文章型 | A woman sitting in a cozy cafe, soft morning light | 文字や構図の再現が得意 |
つまり、使うモデルの「母語」に合わせて書くのがいちばんの近道です。
SD 3.5は顔・文字・構図が安定しやすく、看板の文字なども狙いやすくなっています。文字を入れたいときは a sign that says "OPEN" のように、引用符で囲んで書きます。
アニメ特化モデルは、1girlやsoloのような独特のタグで学習されています。自然な英文より、タグの綴りを正確に合わせるほうが効き目は上。モデル配布ページの説明に推奨タグが書かれていることが多いので、一度目を通してください。
Stable Diffusion以外の画像AIと比べたい人は、Stable Diffusion vs Midjourney|無料と月$10、選び方の分岐点を読むと、呪文の書き方の違いも含めて判断しやすくなります。デザイン素材やロゴ寄りなら、Stable Diffusion vs Recraft V3の違いと選び方が参考になります。
書き分けの感覚がつかめたら、完成形のテンプレートを手元に置いておくと速くなります。
そのまま使えるコピペ用テンプレート4本
50個の呪文を組み合わせた完成形を、用途別に4本用意しました。被写体の部分だけ差し替えれば、すぐに試せます。
1. 写真風ポートレート(SDXL向け)
best quality, highly detailed, a young woman, long hair, gentle smile, photorealistic, upper body, looking at viewer, golden hour, backlighting, depth of field, city street at night
2. アニメキャラクター(アニメ特化モデル向け)
masterpiece, best quality, absurdres, 1girl, solo, long hair, smile, anime style, full body, standing, pastel colors, blue sky with clouds
3. ブログ挿絵(フラット系)
high quality, a person working with a laptop and coffee, flat illustration, wide shot, soft lighting, pastel colors, simple background
4. 商品イメージ(SD 3.5向け・文章型)
A glass perfume bottle on a marble table, studio lighting with soft shadows, sharp focus, photorealistic, white background
ネガティブ欄には、前の章の6語をそのまま入れてください。SD 3.5の4本目だけは、ネガティブを空欄にしても大差が出ないことがあります。
| テンプレ | 使った | 差し |
|---|---|---|
| 1. 写真風ポートレート | 13語 | a young woman / 背景 |
| 2. アニメキャラ | 12語 | 髪型・服装・背景 |
| 3. ブログ挿絵 | 7語 | 人物の行動 |
| 4. 商品イメージ | 文章1本 | 商品名と台の素材 |
つまり、どのテンプレも25語以内に収まっています。長さより組み合わせの的確さが大事、という好例です。
プロンプトの下書きを自分で考えるのが面倒なら、チャットAIに書かせる手もあります。Stable DiffusionとChatGPTを徹底比較では、ChatGPTに呪文を作らせる使い分けに触れています。Geminiで同じことをしたい人はStable Diffusionとgeminiを比較も役立ちます。
テンプレが手元にそろったら、それを動かす環境を決めましょう。
呪文を試す環境はどこで選べばいい?
PCに十分な性能があるなら無料のローカル実行、無ければクラウドかブラウザ型サービスを選びます。呪文そのものはどの環境でも共通なので、手間とコストで決めて構いません。
| 選択肢 | タイプ | 向いている | 向かない |
|---|---|---|---|
| ComfyUI / Comfy Cloud | ローカルUI+クラウド版 | 生成手順を細かく組みたい人 | 設定画面を触りたくない人 |
| Novita AI | API中心のクラウド | 自社アプリに画像生成を組み込みたい人 | コードを書かない人 |
| getimg.ai | ブラウザ型 | インストールなしですぐ試したい人 | 細かい処理手順まで作り込みたい人 |
つまり、呪文を学ぶ段階ならブラウザ型、作り込む段階ならComfyUI、と段階で乗り換えるのが自然な流れです。
ComfyUIは、処理の部品(ノード)を線でつないで生成手順を組むオープンソースの画面です。SD 3.5やSDXLの新しいモデルへの対応が早く、呪文と追加学習データを組み合わせた凝った手順も作れます。自分のPCで動かさないクラウド版のComfy Cloudもあり、GPUを持っていない人の選択肢になります。一方で、線だらけの画面は初見だと正直とっつきにくい部類です。
Novita AIは、他のソフトからAIを呼び出す窓口(API)経由で、画像生成モデルを使えるクラウドサービスです。自分のアプリやサービスに生成機能を組み込みたい開発者に向いています。呪文を画面で試したいだけの人には、遠回りになります。
getimg.aiは、ブラウザ上でプロンプトを入力して画像を作れるサービスです。環境構築なしで呪文の効き方を確かめられるので、入門には重宝します。ただ、ComfyUIのように処理手順そのものを組み替える自由度は期待しないほうがいいでしょう。
料金プランや無料枠の条件は、どのサービスも変わることがあります。契約の前に、最新の条件を各公式サイトで確認してください。
コード生成との役割分担が気になる人は、Stable DiffusionとClaudeの違い、画像とコードの使い分けを読むと、制作フロー全体の組み方がつかめます。ほかの画像生成サービスも見比べたいなら、AI画像生成ツールのランキングが近道です。
AI PICKS編集部の判定
呪文集は「全部覚える辞書」として使うものではありません。型を借りる見本として使うのが正解です。公開情報を突き合わせた見立てでは、上達の差は語彙の量で生まれません。「並び順」「強調の数値」「シード固定での比較」の3点を守れるかどうかで決まります。50個のうち、実戦で毎回使うのは品質2語、構図1語、光1語、ネガティブ4語くらい。これを軸に、被写体と背景だけ差し替えるのが圧倒的に効率のいいやり方です。
モデル選びは呪文以上に効きます。アニメならタグ型のアニメ特化モデル、写真風ならSDXL系の実写モデル、文字や構図の正確さが要るならSD 3.5。この組み合わせに合わない呪文をいくら足しても、正直イマイチな結果にしかなりません。
実行環境のおすすめは、PC性能に余裕があればComfyUIの一択です。ローカルなら生成回数を気にせず試行錯誤でき、呪文の上達速度がまるで違います。GPUが無い人はgetimg.aiのようなブラウザ型で呪文の感覚をつかみ、物足りなくなったらComfy Cloudへ移るのが無駄のない順路です。Novita AIは、画像生成をサービスに組み込む開発者にとっての選択肢と割り切ってください。

有料にすると Entryで毎月3 000クレジットと商用利用権(Entry 月払い¥1,450/月、年払いなら¥1,160/月 (¥13 920を年額請求、税別))
よくある質問(FAQ)
Q. プロンプトは日本語で書いても大丈夫?
Stable Diffusionの多くのモデルは英語で学習されているため、日本語だと意図がずれやすくなります。翻訳サービスやチャットAIで英語にしてから入れるのが確実です。
Q. masterpieceやbest qualityは本当に効果がある?
SD 1.5やSDXL系、アニメ特化モデルでは効果が見られます。文章で理解するSD 3.5では効き目が薄めなので、入れる場合も先頭に1〜2語だけで十分です。
Q. 強調の数値はどこまで上げていい?
1.1〜1.4が安全圏です。1.5を超えると色の飛びや形の崩れが出やすくなります。効かないときは、数値を上げる前に単語を前へ移動させてみてください。
Q. ネガティブプロンプトは長いほど良い?
長すぎると逆効果です。描いてほしい要素まで弱まることがあります。lowres・worst quality・bad anatomy・bad handsの4語を基本に、問題が出たときだけ足すのが安全です。
Q. 手や指が崩れるのはどうすれば直る?
ネガティブにbad handsやextra fingersを入れるのが第一歩です。それでも崩れるなら、hands in pocketsのように手を隠すポーズを指定するのが手っ取り早い対処法です。
Q. 作った画像は商用利用できる?
使うモデルのライセンス次第です。SD 3.5はCommunity Licenseのもとで条件付きの商用利用が認められています。配布サイトの独自モデルは条件がばらばらなので、必ず個別に確認してください。
Q. 高性能なPCが無くても呪文を試せる?
試せます。getimg.aiのようなブラウザ型サービスや、Comfy Cloudのようなクラウド版を使えば、GPUを持っていなくても生成できます。
あわせて見たいツール・カテゴリ
呪文を覚えた後は、実行環境とほかの画像生成サービスを見比べておくと、用途に合った道具が選びやすくなります。
- ComfyUI / Comfy Cloud:生成手順を部品単位で組み立てたい人向けの定番UI
- Novita AI:API経由で画像生成を自社サービスに組み込みたい開発者向け
- getimg.ai:インストールなしでブラウザから呪文を試したい人向け
- AI画像生成カテゴリ:Stable Diffusion以外の画像AIもまとめて探せる
- AI画像生成ツールのランキング:人気の画像生成サービスを一覧で比較できる
- AIデザインカテゴリ:ロゴやバナーなど、デザイン寄りのAIツールを探すなら
- AIデザインツールのランキング:画像を素材として仕上げる工程まで考えるときに
次に読むならこれ。有料の画像AIへ移るべきか迷い始めたら、Stable Diffusion vs Midjourney|無料と月$10、選び方の分岐点がおすすめです。呪文の書き方の違いと、お金を払う価値が出る分岐点が一度に分かります。
各ツールの公式サイト(一次情報)
料金・機能・対応範囲は各社公式が一次情報です。本記事は公開時点の検証に基づきますが、最新かつ正確な条件は必ず各公式ページで確認してください。
- ComfyUI:公式サイト(AI PICKSの詳細)
- Novita AI:公式サイト(AI PICKSの詳細)
- getimg.ai:公式サイト(AI PICKSの詳細)



