在本地部署 Stable Diffusion 3.5
背景与准备
Stable Diffusion 3.5 是目前图像生成领域较为成熟的工具之一,支持文本到图像的高质量转换。相比云端服务,本地部署能更好地保护数据隐私,且不受网络延迟影响,适合需要频繁调整参数或批量生成的场景。
注意:不同版本的模型对硬件要求差异较大。以 Large Turbo 版本为例,建议至少配备 8GB 显存以保证流畅运行。
环境要求
- 操作系统:Windows 10/11 专业版
- 显卡要求:NVIDIA 显卡,显存 8GB 及以上
1. 部署 ComfyUI 环境
ComfyUI 是一个基于节点的工作流界面,相比 WebUI 更灵活高效。
获取并解压
访问 ComfyUI 官方 GitHub 仓库,下载免安装版本(Portable Version):
解压后得到独立文件夹,无需复杂的环境配置。

启动脚本选择
解压目录内包含两个启动脚本:
run_cpu.bat:使用 CPU 解码,速度较慢。run_nvidia_gpu.bat:调用 NVIDIA 显卡加速,推荐优先使用。
双击 run_nvidia_gpu.bat 即可启动服务。

启动成功后,浏览器会自动打开或访问 http://127.0.0.1:8188 进入控制界面。

语言设置
默认界面为英文,为了方便操作,可以安装中文插件。
- 下载中文翻译插件:AIGODLIKE-ComfyUI-Translation
- 将解压后的文件夹放入
ComfyUI/custom_nodes目录下。 - 重启 ComfyUI 或在设置中切换语言。


2. 获取模型文件
SD3.5 系列包含多个版本,本教程以 Large Turbo 为例,兼顾速度与质量。
- Large:画质最佳,需 16GB+ 显存。
- Large Turbo:速度快,8GB 显存即可,推荐。
- Medium:轻量级,适合低配硬件。
下载主模型
从 HuggingFace 下载核心模型文件 sd3.5_large_turbo.safetensors,并放入 models/checkpoints 目录。

下载 Clip 编码器
SD3.5 依赖特定的文本编码器,请分别下载以下文件并放入 models/clip 目录:

3. 生成测试
加载工作流
将示例工作流文件 SD3.5L_Turbo_example_workflow.json 拖入 ComfyUI 界面,系统会自动补全节点连接。

配置与生成
- 在左侧节点中选择刚才下载的 SD3.5 模型。
- 在 CLIP Text Encoder 中输入提示词(Prompt)。
- 点击右侧 "Queue Prompt" 按钮开始生成。

结语
至此,本地 Stable Diffusion 3.5 环境已搭建完成。后续可根据需求尝试更换 LoRA、ControlNet 等扩展功能,进一步丰富创作能力。如果遇到显存不足的情况,可考虑使用 FP8 量化版本模型。

