ローカルでの Stable Diffusion:インストールと モデル
Stable Diffusionは、重みが公開された画像生成モデルのファミリーであり、アプリケーションではありません。ローカルのインターフェースで動かします。初めて使うなら、Fooocus、ComfyUI Desktop、またはMacではDraw ThingsでSDXLを使ってください(ファイルサイズは6.94 GB、快適に使うには8 GBのVRAM)。SD 1.5はメモリ容量の少ないグラフィックカードに適しており、2024年10月22日に発表されたSD 3.5は12 GB以上のカード向けです。FluxやZ-Imageなど、より新しいモデルファミリーは、主にComfyUIで利用します。
Stability AI は2022年8月22日に Stable Diffusion の一般公開を発表しました。これは、アカウントも利用量の制限もなく、ご自身のコンピュータ上でテキストを画像に変換するモデルです。2026年9月28日時点で、この名称には3世代のモデル、4〜5種類のインターフェース、そしてそれぞれ異なるライセンスが含まれます。このガイドでは、バージョンとインターフェースを選び、Windows、Mac、Linux に一式をインストールする方法と、生成画像のどのような利用が認められているかを説明します。
#Stable Diffusionとは何ですか?
Stable Diffusionは潜在拡散モデルです。純粋なノイズ画像から出発し、入力したテキストに導かれながら段階的にノイズを除去して、まとまりのある画像を生成します。計算は潜在空間と呼ばれる圧縮された空間で行われます。そのため、初期の拡散モデルでは計算センターが必要だったのに対し、一般向けのグラフィックスカードで十分に実行できます。
広く知られるようになった理由は、性能そのものではなく、そのオープンさです。2022年の公開時に、Stability AIはCreativeML OpenRAIL-Mライセンスを選びました。同社はこのライセンスを「許容的」と説明しており、商用・非商用の利用を認めています。モデルの重みはダウンロード、変更、再学習が可能です。特定の用途に特化した派生モデルが数千種類存在します。Stable Diffusionはアプリケーションではなく、好みのインターフェースで実行するモデルファイルです。
この名称は、用語の混同を招きやすいものです。Hugging FaceにあるSD 1.5の参照用リポジトリは、現在、非推奨となった旧RunwayMLリポジトリのミラーとして紹介されており、同社とは関係がありません。また、2024年以降、最も話題になっているオープンな画像生成モデルは、Flux、Qwen Image、Z-Imageなど、ほかの研究機関から登場しています。これらは同じインターフェースで動作しますが、Stable Diffusionという名前ではありません。
#バージョンと、どのバージョンを選ぶか
ローカルでの AI 画像・動画生成、制限なし:ComfyUI、Flux、Z-Image、Wan 2.2 を GPU や Mac で — ワークフローはそのまま読み込め、法的枠組みも解説。
- 永久に利用できるオンラインスペース
- PDF + ファイル
- 生涯アップデート
| バージョン | 公開日 | メインファイル | ネイティブ解像度 | 余裕のあるVRAM容量 | 要点 |
|---|---|---|---|---|---|
| SD 1.5 | 2022 | 4.27 GB (v1-5-pruned-emaonly) | 512 × 512 | 4 から 6 GB | 軽量で、バリアントやLoRAが豊富に揃っています。細部や手の描写には改善の余地があります。 |
| SDXL 1.0 | 2023年7月 | 6.94GB (sd_xl_base_1.0) | 1024 × 1024 | 8 GB:Stability AIは、8 GBのグラフィックカードで正常に動作すると発表しています | 良いスタート地点:品質が明確に優れ、エコシステムが成熟しています。 |
| SD 3.5 | 2024年10月22日 | Medium:25億パラメータ;Large:81億パラメータ;Large Turbo:4ステップ版 | Medium:0.25 から 2 メガピクセル;Large:1 メガピクセル | Medium:テキストエンコーダーを除いて9.9 GB(Stability AI)。Large:16ビットで16 GBを超える容量(当サイトの計算) | プロンプトの指示により忠実に従います。ライセンスは異なります。詳細は下記をご覧ください。 |
購入やダウンロード時の誤りを避けるための2つの詳細があります。まず、SD 1.5は2つのファイルとして存在します。v1-5-pruned-emaonly.safetensors(4.27 GB)は、モデルの仕様書においてVRAM使用量が少なく推論に適していると説明されており、v1-5-pruned.safetensors(7.7 GB)は再学習用に設計されています。画像を生成する場合は、前者を選択してください。次に、81億のパラメータを持つSD 3.5 Largeは、Mediumの仕様だけで判断すべきではありません。8 GBのカードでは、これに頼らないでください。
8GBのグラフィックカードで初めて取り組むなら、SDXLから始めてください。品質、速度、利用できるドキュメントのバランスが最も優れています。12〜16GBなら、ComfyUIで使える最近のモデルも検討してください。ComfyUIのREADMEには、Flux.1、Flux.2、Qwen Image、Z-Imageへのネイティブ対応が記載されています。
#必要なハードウェア
| あなたのハードウェア | うまく機能する点 |
|---|---|
| メモリ4〜6 GBのNVIDIA製カード(GTX 1660、RTX 2060、RTX 3050) | SD 1.5。SDXL を使用する Fooocus は、Windows の仮想メモリを利用する前提で、VRAM 4GB、RAM 8GB を最低要件として案内しています。動作は遅いものの、実行は可能です。 |
| NVIDIA製8 GBグラフィックカード(RTX 3060 Ti、RTX 4060、RTX 5060) | SDXLが快適に動作(Stability AIが公表した基準) |
| 12〜16GBのNVIDIA製グラフィックカード(RTX 3060 12GB、RTX 4070、RTX 5070 Ti) | LoRAとアップスケーリングを併用するSDXL、SD 3.5 Medium、Z-Image Turbo(モデルページによると16 GB)、FP8のFlux |
| 最近の AMD カード(RX 7000、RX 9000) | Linux では ROCm で良好;Windows では、2026年1月から ComfyUI Desktop で公式に ROCm をサポート |
| Apple Silicon搭載Mac | すべての M シリーズチップ: ユニファイドメモリが VRAM として機能します。同等クラスの NVIDIA カードよりも遅いです。 |
| グラフィックスカードなし | 技術的には可能ですが、はるかに遅いため、テスト用途に限定してください |
ディスク容量も確保してください。SDXL のファイルは1つだけでも 6.94 GB あり、LoRA や派生版のコレクションはすぐに容量が増えます。Fooocus は、「RuntimeError: CPUAllocator」エラーが発生する場合、各ディスクに少なくとも 40 GB の空き容量を確保することを推奨しています。
#どのインターフェースをインストールするか
| インターフェース | 対象者 | 強み | 制限 |
|---|---|---|---|
| Fooocus | 初心者向け | テキスト入力欄とボタン、よく調整されたデフォルト設定。READMEによると、ダウンロードから最初の画像生成まで3クリック未満 | SDXL 限定:プロジェクトは長期サポートが限られており、バグ修正のみが提供されます |
| Forge (lllyasvielのリポジトリ) | タブインターフェースを用いるユーザー | AUTOMATIC1111 のインターフェースを、より少ないメモリ使用量で利用でき、Flux にも対応 | 2025年6月以降、メインブランチへのコミットは途絶えており、開発はForge Neoなどのフォークに引き継がれています |
| AUTOMATIC1111 | 過去のチュートリアルを参考にする人々 | 古くから使われている、ドキュメントが最も充実したインターフェース | 最終リリースは2025年2月、Fluxには非対応 |
| ComfyUI | 上級ユーザーや好奇心旺盛なユーザー | 最新モデルのネイティブサポート、再現可能なワークフロー、非常に活発な開発プロジェクト | 学習曲線 |
| Draw Things | Mac、iPhone、iPad | ネイティブアプリ。無料版はローカルかつオフラインで計算を行い、デバイス上でLoRAを学習できます | Appleのエコシステム限定です。有料のクラウドサービスもオプションとして用意されていますが、100%ローカルで使いたい場合は避けてください。 |
- Fooocus:インストールして最初の画像を生成する
- ComfyUI:インストールと使い始め方
- AUTOMATIC1111 : Stable Diffusion WebUIのインストール
- 概観:ローカルで画像を生成
#システムごとの最短の導入手順
- 01NVIDIAのGPUを搭載したWindows最も手早く始められるのはFooocusです。公式GitHubページからアーカイブをダウンロードし、解凍してrun.batを実行してください。初回起動時に、モデルがFooocus\models\checkpointsにダウンロードされます。新しいモデルに対応していくツールを求めるなら、代わりにComfyUI Desktopをインストールしてください。ComfyUIのREADMEでは、新規ユーザー向けに推奨されています。
- 02RTX 50 カード:PyTorch を確認してくださいForgeのオールインワンアーカイブでは、CUDA 12.1とPyTorch 2.3.1が推奨バージョンとして示されています。しかし、RTX 50シリーズのカードには新しいPyTorchが必要です。AUTOMATIC1111の協力者は、これらのカードに正式対応した最初のバージョンとしてPyTorch 2.7.0を挙げています。RTX 50ではComfyUIをお勧めします。ComfyUIのドキュメントでは、最近のNVIDIAカードにCUDA 13.0が必要とされています。
- 03Apple Silicon搭載MacApp StoreからDraw Thingsをインストールしてください。無料版はコマンドラインを使わずに、ローカルかつオフラインで処理を行います。Macから何も外部に送信したくない場合は、クラウド機能を有効にしないでください。ComfyUI Desktopにも、Apple Silicon搭載MacのmacOS向け版があります。
- 04Linux、またはAMD製グラフィックスカードComfyUIの手動インストール:リポジトリのクローン、Python環境、CUDAまたはROCmベースのPyTorchをカードに応じて選択。詳細な手順は私たちのComfyUIガイドに記載されています。FooocusもAnacondaによるLinuxインストールを提供しています。
- 05GPUが使われていることを確認する生成中は、nvidia-smiコマンドの出力にVRAMの使用量が表示され、GPU使用率が100%近くになっているはずです。画像の生成に数分かかる場合、インターフェースはCPUで動作しています。ほとんどの場合、原因は適合しないバージョンのPyTorchです。
#モデルの入手先と避けるべきモデル
主な入手先は2つあります。Hugging Faceは研究機関の公式モデルをホストしています。Civitaiには、ファインチューニング済みモデル、LoRA、スタイルなど、コミュニティが作成したバリエーションが集まっています。LoRAは、ベースモデルを置き換えずにスタイルや被写体を追加する小さなファイルです。対応するモデルの系統が一致している必要があり、SDXL用のLoRAはSD 1.5では動作しません。
#効果的なプロンプトを書く
- 説明してください、指示は出さないでください
- これらのモデルは指示に従いません。「年配の女性のポートレート、窓からの光、85 mmレンズ、浅い被写界深度」なら機能しますが、「きれいな写真を作って」は機能しません。
- 英語で記述してください
- SD 1.5 のモデルカードには「Language(s): English」と記載されており、テキストエンコーダーには凍結された CLIP ViT-L/14 が使われています。フランス語も理解されますが、細かなニュアンスの理解は劣ります。
- 被写体、次に背景、最後にスタイル
- 順序は重要です。最初に置いたものが最も強く影響します。
- ネガティブプロンプト
- 画像に含めたくないものを列挙します。特にSD 1.5とSDXLで有用です。最近のモデルでは、ネガティブプロンプトが考慮されるかどうかをモデルカードで確認してください。
- シード値を保存してください
- 同じシード、同じ設定、同じ画像。2つのプロンプトを比較する場合は、シードを固定し、一度に1つだけ変更してください。
#ライセンスおよび商業利用
| モデル | ライセンス | 画像の商業利用 |
|---|---|---|
| SD 1.5 | CreativeML OpenRAIL-M | 許可されています。Stability AIはこのライセンスについて、商用・非商用の利用を広く認めるものと説明していますが、倫理的な利用制限がライセンスに列挙されています。 |
| SDXL 1.0 | CreativeML OpenRAIL++-M | 許可されています。同じ原則が適用されます |
| SD 3.5 | Stability AI Community License | 非商用利用は無料で、商用利用も年間売上高100万ドルまでは無料です。それを超える場合は、エンタープライズライセンスについてStability AIに問い合わせること。生成した画像の所有権は利用者に残ります。 |
モデルのライセンスだけですべてが決まるわけではありません。生成画像の著作権や実在する人物の画像の使用は、ソフトウェアのライセンスではなく、お住まいの国の法律によって規定されます。本ガイドは、各ライセンスの作成者が公開した内容を説明するものであり、法的助言に当たるものではありません。
#FAQ
Stable Diffusionは無料ですか?+
グラフィックスカードなしでStable Diffusionを使用できますか?+
SD 1.5、SDXL および SD 3.5 のいずれのバージョンを選ぶべきでしょうか?+
自分の画像のプライバシーは保たれますか?+
Stable Diffusion か Flux か?+
Mac上でStable Diffusionを使用することは可能ですか?+
生成された画像を販売することは可能ですか?+
ご意見、誤りのご指摘、補足はありますか?ぜひお知らせください。皆さんにとってより良いガイドにするために役立ちます。