Stable Diffusionプロンプトとネガティブプロンプト:実践ガイド
キーワードの順序、的を絞ったネガティブプロンプトの書き方、ウェイトの使用、SD 1.5、SDXL、および新しいチェックポイントに適切な設定の選び方。
Stable Diffusionは、他のホスト型画像生成ツールよりも多くの制御を提供しますが、同時に間違った結果を招く可能性も高くなります。良い結果を得るには、適切に構成されたポジティブプロンプト、的を絞ったネガティブプロンプト、そして適切な生成設定という3つの要素が連携する必要があります。このガイドでは、SD 1.5、SDXL、およびそれ以降のチェックポイントについて、これら3つの要素すべてをカバーします。
ポジティブプロンプトの構成要素
Stable Diffusionのテキストエンコーダーは、プロンプトの冒頭に最も注意を払います。キーワードを重要度の高い順に並べます。
- 被写体 — 画像の内容: 雪の中に座るアカギツネ
- 媒体 — 写真、デジタルペインティング、水彩画、3Dレンダリング
- スタイル — シネマティック、アールヌーボー、スタジオジブリ風、フィルムノワール
- アーティストまたは影響 (オプション) — 控えめに、責任を持って使用する
- 詳細 — 服装、小道具、表情、テクスチャ
- 色とライティング — ゴールデンアワー、リムライト、ティールとオレンジのパレット
- 品質タグ — 高精細、シャープフォーカス、8k
例:
a red fox sitting in fresh snow, wildlife photograph, telephoto lens,
early morning mist, soft backlight, frost on fur, highly detailed, sharp focus
SD 1.5とSDXLおよびそれ以降のモデル
- SD 1.5のチェックポイントは、カンマ区切りのタグや、masterpiece, best qualityのような品質ブースターによく反応します。
- SDXLおよびそれ以降のモデルは、より自然な文章をはるかによく理解します。「A red fox sits in fresh snow while morning mist drifts behind it(朝霧が後ろに漂う中、アカギツネが新雪の中に座っている)」のように記述でき、ほとんどの品質ブースターを省略できます。
- booruタグ(例:1girl, solo, long hair)で学習されたアニメのチェックポイントは、そのタグスタイルを期待します — モデルカードを確認してください。
ネガティブプロンプト
ネガティブプロンプトは、サンプラーが避けるべきものをリストアップします。これはStable Diffusionの最も強力な機能の一つであり、最も誤用されやすい機能の一つでもあります。
適切な汎用ネガティブプロンプト
lowres, blurry, jpeg artifacts, watermark, signature, text, cropped,
out of frame, worst quality, low quality
実際に見られる問題に対する的を絞った用語を追加する
| 問題 | ネガティブプロンプトに追加 |
|---|---|
| 悪い手 | bad hands, extra fingers, fused fingers, missing fingers |
| 歪んだ解剖学的構造 | bad anatomy, extra limbs, deformed, disfigured |
| 不要なスタイル | cartoon, anime, 3d render (写真の場合) または photo, realistic (イラストの場合) |
| 彩度が高すぎる見た目 | oversaturated, overexposed |
| 不要な要素 | 特定のオブジェクト、例:people, cars, trees |
ネガティブプロンプトは短く、具体的に保ちましょう。インターネットからコピーした200語のネガティブプロンプトは、実際には望むものを抑制し、画像を平坦に見せてしまう可能性があります。
ネガティブエンベディング
EasyNegativeやbad-hands-5のようなテキストインバージョンは、多くのネガティブな概念を1つのトークンにまとめます。これらはUIにインストールする必要があり、通常、学習されたベースモデルファミリー(例:SD 1.5)でのみ機能します。名前は正確に入力してください — ハイフンやスペースが変更されているとロードされません。
プロンプトの重み付け
AUTOMATIC1111、Forge、ComfyUIでは、単語が適用される強度を変更できます。
(word)は重みを約1.1倍に増加させます((word))は重みを約1.21倍に増加させます(word:1.4)は正確な重みを設定します[word]または(word:0.8)は重みを減少させます
おおよそ0.5から1.5の範囲に留めてください。重みを高くしすぎると、アーティファクトが発生したり、その概念が画像全体に焼き付いたりする傾向があります。
重要な生成設定
| 設定 | 制御するもの | 良い開始点 |
|---|---|---|
| サンプリングステップ | 精製パス | 20–30 (これ以上増やしても効果は稀) |
| CFGスケール | プロンプトにどれだけ厳密に従うか | SDXLで5–7、SD 1.5で7 |
| サンプラー | デノイズアルゴリズム | DPM++ 2M Karras または Euler a |
| 解像度 | 出力サイズ | SD 1.5で512×512、SDXLで1024×1024 |
| シード | 初期ノイズ | プロンプトを調整中は固定する |
モデルのネイティブ解像度で生成し、その後アップスケールする方が、大きな画像を直接生成するよりもはるかに良い結果が得られます。
一貫した結果を得るためのワークフロー
- 被写体と媒体のみを含む短いプロンプトを作成します。4枚の画像をバッチ生成します。
- 最も良い結果を選び、そのシードを固定します。
- スタイル、ライティング、詳細を一度に1つのグループずつ追加し、各変更を確認します。
- 見られる問題に対してのみネガティブな用語を追加します。
- アップスケールし、インペインティングを使用して手や顔などの小さな領域を修正します。
例
ポートレート写真
Prompt: portrait of an elderly woman laughing, natural window light,
85mm lens, shallow depth of field, film grain, warm tones
Negative prompt: cartoon, 3d render, blurry, deformed, watermark, text
ファンタジーイラスト
Prompt: a floating castle above the clouds at sunset, digital painting,
epic fantasy, volumetric light, intricate details, vibrant colors
Negative prompt: photo, lowres, blurry, text, watermark
商品写真
Prompt: a glass perfume bottle on wet black stone, water droplets,
studio lighting, reflections, product photography, sharp focus
Negative prompt: people, text, logo, lowres, overexposed
プロンプトとネガティブプロンプトを同時に生成する
Stable Diffusion Prompt Generatorは、一行のアイデアからポジティブプロンプトとネガティブプロンプトの両方を返します。それらをUIにコピーし、シードを固定してそこから調整してください。
Stable Diffusionプロンプトジェネレーターを試す
SDおよびSDXL向けのポジティブ・ネガティブプロンプト. 無料、登録不要。