前言
随着人工智能技术的飞速发展,AI 绘画已成为内容创作领域的重要工具。相比 Midjourney 等闭源商业软件,Stable Diffusion(简称 SD)以其开源、免费、可本地部署的特性,为技术爱好者提供了更高的自由度和可控性。本文将详细介绍 Stable Diffusion 的入门安装、核心功能配置以及基于蒙版和 ControlNet 的写真生成实战流程。
AI 绘画与 Stable Diffusion
提到 AI 绘画,Midjourney 因其高质量出图而广为人知,但其使用门槛较高(需网络环境)且订阅费用不菲。对于希望深入理解原理或进行定制化开发的技术人员而言,Stable Diffusion 是更优的选择。
Stable Diffusion 是一个基于潜在扩散模型(Latent Diffusion Model)的开源项目。它允许用户在本地运行,通过调整参数、更换模型和使用插件,实现从文生图到图生图的多种效果。其强大的扩展性和社区生态支持,使其成为目前最流行的开源 AI 绘图方案之一。
环境准备与安装
1. 系统要求
- 操作系统:Windows 10/11 或 Linux。
- 显卡:推荐使用 NVIDIA 显卡,显存建议 8GB 及以上(如 RTX 3060)。若显存不足,可使用优化版本或云端算力。
- 内存:建议 16GB 以上。
- 存储:预留至少 50GB 空间用于模型文件。
2. 安装步骤
方式一:整合包安装(推荐新手)
为了简化环境配置,建议使用整合包(如秋叶启动器、B站大佬发布的整合包)。
- 下载整合包压缩包。
- 解压至非中文路径的文件夹。
- 运行
webui-user.bat或start.bat。 - 首次运行会自动下载依赖库和 WebUI 界面。
方式二:源码安装(适合开发者)
- 安装 Python 3.10.x 版本。
- 安装 Git。
- 克隆仓库:
git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git - 进入目录并安装依赖:
pip install -r requirements.txt - 启动服务:
python webui.py
3. 模型管理
SD 的核心在于模型(Checkpoint)。常用模型包括 SD 1.5、SDXL 等。模型文件需放置在 stable-diffusion-webui/models/Stable-diffusion 目录下。启动后在设置中刷新即可选择。
基础操作界面
启动 WebUI 后,主要包含以下标签页:
- txt2img:文生图模式,输入提示词生成图片。
- img2img:图生图模式,基于原图进行修改。
- Extras:图像修复与放大。
- Settings:全局参数配置。
实战:蒙版变装写真生成
本章节介绍如何通过局部重绘(Inpainting)结合 ControlNet,实现人物脸部不变、背景或服装变化的写真效果。
1. 制作面部蒙版
为了固定人物特征,我们需要精确提取人脸区域。
- 启用插件 Inpaint Anything。
- 上传原始人像照片。
- 点击'下载模型'以加载 Segment Anything 模型。
- 点击'运行 segment anything',系统会自动识别图中主体。
- 使用画笔工具涂抹人脸区域。


