📌 本文重點(30 秒速讀)
- Stable Diffusion 是開源 AI 繪圖模型,可免費自架使用
- 主流版本從 SDXL、SDXL Turbo 到 SD 3.5 Large
- SDXL Turbo 可單步驟即時生成圖片
- 搭配 LoRA、ControlNet 可大幅提升控制力
什麼是 Stable Diffusion?
Stable Diffusion 是由 Stability AI 推出的開源圖像生成模型,只要用文字描述(Prompt)就能產生高品質圖片。與 Midjourney 不同,它開放原始碼、可離線自架,還能自行訓練與微調,深受進階玩家喜愛。
近年模型持續演進,從 SD 1.5、SDXL 到 SD 3.5,生成品質、速度與控制力都有大幅提升。
模型版本比較
| 模型 | 參數量 | 特色 | 適合用途 |
|---|---|---|---|
| SDXL | 3.5B | Base + Refiner 兩階段管線 | 高品質美術圖、插畫 |
| SDXL Turbo | 3.5B | 1 步即時生成 | 快速迭代、即時創作 |
| SD 3.5 Large | 8B | 1MP 高品質、文字理解更佳 | 專業創作、細節要求高 |
💡 新手建議:先從 SDXL 開始,生態系最成熟、教學資源最多;有顯卡加速需求再考慮 SDXL Turbo。
安裝與環境準備
硬體需求
- 建議 NVIDIA 顯示卡(VRAM 8GB 以上)
- 16GB 以上 RAM
- 儲存空間:模型檔 5–15GB
- 也可用 Google Colab 免費雲端執行
選擇操作介面
- Automatic1111(WebUI):最主流、外掛最多,適合進階玩家
- ComfyUI:節點式流程,控制力強、速度較快
- SD 官方網頁版 / DreamStudio:免安裝、適合新手
提示詞撰寫技巧
Stable Diffusion 的品質高度依賴提示詞與參數:
- 正面提示詞:描述主體、風格、光線、鏡頭與品質詞
- 負面提示詞:排除不想出現的元素(模糊、多餘手指等)
- 權重調整:用 (word:1.2) 強調、[word] 弱化
- 種子(Seed):固定種子可重現相同構圖
📌 範例:「a beautiful forest landscape, golden hour, cinematic lighting, highly detailed, 8k」+負面詞「blurry, low quality, deformed」。
進階技巧
🎯 LoRA
輕量微調模型,不需重訓整個模型就能學特定角色、畫風或概念。
🎛️ ControlNet
透過姿勢骨架、邊緣偵測或深度圖,精準控制構圖與姿勢。
🖼️ 圖生圖(img2img)
以現有圖片為基礎重繪或改風格,Denoise 值控制保留程度。
🖌️ 放大(Upscale)
用 ESRGAN 等外掛把圖放大到 4K 而不失真,適合列印輸出。
與 Midjourney 比較
| 項目 | Stable Diffusion | Midjourney |
|---|---|---|
| 價格 | 免費(需自架) | 訂閱制 |
| 原始碼 | 開源 | 閉源 |
| 控制力 | 極高(LoRA/ControlNet) | 中等 |
| 上手難度 | 較高 | 較低 |
常見問題
Stable Diffusion 免費嗎?
模型開源免費,但需自備電腦或雲端資源。不想自架可用官方 DreamStudio 或免費的 Colab 方案。
SD 3.5 和 SDXL 差在哪?
SD 3.5 Large 有 8B 參數,文字理解與細節表現更佳,但硬體需求也更高。
生成的圖片可以商用嗎?
依授權條款而定,多數自架生成可商用,但使用第三方模型時請確認其使用條款。
結語
- ✅ 開源免費,可離線自架
- ✅ SDXL 生態系成熟,SD 3.5 品質更佳
- ✅ LoRA + ControlNet 控制力極強
- ✅ 一次投入硬體後無需月費
- ✅ 適合想深度掌握 AI 繪圖的創作者