博主头像

Stable Diffusion - automatic1111 与 ControlNet 安装使用

外来客 • 2026-08-27 02:58:49

分享
𝕏 f
声明:本文为对公开内容的摘要整理, 未经本站独立核实,可能与原内容存在出入,不代表本站立场、观点或建议; 观点与版权归原作者及原平台所有。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

(原标题:How to Install and Use Stable Diffusion - automatic1111 with ControlNet Tutorial)

🖥️ 系统要求与基础环境配置

  • 硬件前提:Stable Diffusion 最佳运行环境为 NVIDIA 20 系列及以上 GPU,操作系统以 Windows 为例。
  • 软件依赖:必须安装 Python 3.10.6 版本(新版 Python 存在兼容性问题),安装时需勾选“Add Python to Path”;需安装 Git 用于获取 UI 代码及后续更新。
  • 安装步骤
  1. 在命令提示符中进入目标安装目录。
  2. 执行 `git clone` 命令从 GitHub 仓库下载 Stable Diffusion Web UI 代码。
  3. 运行 `webui-user.bat` 文件,等待自动安装剩余组件。
  4. 安装完成后,通过浏览器访问本地地址即可看到用户界面。

🎨 模型选择与基础生成设置

  • 模型来源:推荐从 Civitai 网站下载用户创建的自定义模型,以替代基础模型,从而提升画质或特定风格(如写实、动漫)。
  • 模型部署
  • 主模型文件需放入 `models/stable-diffusion` 文件夹。
  • 若模型需要 VAE 文件,需单独下载并放入 `models/VAE` 文件夹。
  • 在 UI 设置中搜索 `SD_VAE` 并启用,以便在界面中选择对应的 VAE。
  • 提示词策略
  • 正向提示词:描述媒介(如“照片肖像”)、主体(如“穿奇幻盔甲的男人”)及细节(如“40岁、棕色头发”)。
  • 负向提示词:描述不想要的内容,特别是质量缺陷或风格冲突(如“卡通、单色”),对控制结果风格至关重要。
  • 核心参数
  • 采样器:推荐 DPM++ 2M Karras,兼顾质量与速度。
  • 采样步数:20 步用于快速测试,50 步左右为质量与时间的平衡点,过高步数收益递减。
  • 分辨率:建议保持模型训练时的原生分辨率(如 512x512 或 768x768),非正方形比例可能导致多头等异常。
  • CFG Scale:控制 AI 对提示词的遵循程度。低值(约 3)创意性强但细节缺失;高值(如 15)细节多但可能审美不佳。
  • 批量设置:Batch Size 为单次生成数量,Batch Count 为连续生成次数。

🕸️ ControlNet 扩展应用

  • 功能定位:ControlNet 是 Stable Diffusion 的核心优势,能精确控制构图、姿态和边缘,优于 MidJourney 等竞品。
  • 安装流程:在扩展仓库中搜索 ControlNet 并安装,重启 UI 后,下载对应的模型文件(如 depth、canny、openpose)放入 `extensions/ControlNet/models` 文件夹。
  • 具体模式
  • Depth(深度):识别参考图的 3D 空间结构(近白远黑),用于保持场景构图一致,但不保留颜色。
  • Canny(边缘):识别参考图的轮廓线条,用于保留物体形状和位置细节(如窗户、门的位置)。
  • OpenPose(姿态):识别人物姿态和面部表情,用于生成特定动作的人物图像。
  • 注意事项:ControlNet 主要控制结构,不直接复制颜色信息;首次使用某些预处理器时需下载额外文件。

🛠️ 图像细化与局部重绘

  • 图生图(Img2Img)
  • 用于在保留原图大致色彩和构图的基础上生成变体。
  • 去噪强度(Denoising Strength):关键参数。低值(如 0.2)变化微小;高值变化大但可能偏离原图。
  • 局部重绘(Inpainting)
  • 模型选择:需下载专门用于 Inpainting 的模型版本(如 Cyber Realistic 的 inpainting 版)。
  • 操作逻辑
  1. 使用画笔涂抹需要修改的区域。
  2. Masked Content:设为 "fill" 用于移除物体(如手表);设为 "original" 用于保留原图细节并优化(如修复面部)。
  3. Inpaint Area:设为 "only masked" 可在全分辨率下仅处理遮罩区域,适合细节修复。
  4. 提示词:负向提示词用于排除不想要的元素(如“watch”);正向提示词用于描述期望的细节(如“微笑的黑人男性,面部细节丰富”)。
  • 偏见提示:AI 模型存在训练数据偏见,例如默认生成白人男性,需在提示词中明确指定种族特征(如“black man”)以获得预期结果。

0 条评论

发表评论

请先 登录 后参与讨论。