跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客GitHub 精选镜像AI 生图工具UI配色美学隐私政策关于联系
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

Stable Diffusion WebUI 使用指南与核心功能详解

Stable Diffusion WebUI 的使用方法,涵盖硬件配置要求、环境部署方案、性能优化技巧(CUDNN、PyTorch、Xformers)、界面参数设置、提示词工程(Prompt、Embedding、LoRA)以及进阶功能(Hires.fix、局部重绘、ControlNet)。文章还补充了常见问题排查与优化建议,旨在帮助用户快速上手并高效利用 AI 图像生成工具进行创作。

人间失格发布于 2025/2/6更新于 2026/7/2543 浏览
Stable Diffusion WebUI 使用指南与核心功能详解

Stable Diffusion WebUI 使用指南

前言

人工智能技术近年来发展迅猛,从早期的区块链、虚拟现实到如今的生成式 AI,技术浪潮不断更迭。2022 年开始的 AI 图像生成浪潮标志着人类智能化进程的重要一步。Stable Diffusion 作为当前主流的开源 AI 图像生成工具,以其高自定义程度和强大的扩展性,成为了社区广泛使用的选择。

本文聚焦于 AI 图像生成领域,主要介绍 Stable Diffusion WebUI 的使用。简单来说,Diffusion(扩散)模型通过添加噪声再去除噪声的过程,结合用户的意图提示词,在潜在变量空间中生成图片。WebUI 则是控制这一过程的图形化界面工具。

硬件篇

显卡选择

Stable Diffusion WebUI 目前最主流的搭配是 Windows 系统配合 Nvidia 显卡。为了获得最佳体验,建议配置如下:

  • 显卡算力:影响出图速度。过低的算力会严重影响使用体验,建议至少 RTX 3060 以上。
  • 显存大小:影响生成分辨率及模型训练规模。推荐显存大于 8GB。通常 512x1024 比例的图片 8G 显存即可满足需求。

部署环境

Windows 环境

部署需要安装 Python 环境及相关库。由于涉及网络问题及依赖配置繁琐,推荐使用整合包以开箱即用。若希望深入了解环境搭建,可参考官方文档自行部署。

Mac 环境

Mac 用户可通过特定适配版本运行,但速度相对较慢。M1/M2 芯片支持较好,但性能仍不及同级别 N 卡。

在线平台

若无本地高性能机器,可使用 Google Colab 等在线平台租用 GPU 资源进行训练或部署,适合临时体验或轻量级任务。

提速篇

整合包封装了繁琐操作,但若追求极致性能,需手动优化环境:

  1. 开启 CUDNN 加速:NVIDIA CUDA 深度神经网络库,启用后可提升约 30%~40% 的生成速度。
  2. 升级 PyTorch 至 2.0:新版 PyTorch 针对深度学习优化,可提升约 20% 速度。
  3. 开启 Xformers 加速:Facebook 出品的 Transformer 加速库,可显著减少显存占用并提升生成速度(部分情况接近 100%),但仅适用于 Nvidia 显卡。

界面与参数

安装完成后,熟悉界面布局至关重要。关键参数包括:

  • 采样器 (Sampler):如 Euler a, DPM++ 2M Karras 等,影响生成质量与速度。
  • 步数 (Steps):通常为 20-50,步数越多细节越丰富,但耗时增加。
  • CFG Scale:提示词引导系数,值越高越贴近提示词,过高可能导致画面失真。
  • 种子 (Seed):固定随机种子可复现相同结果。

提示词工程

Prompt(提示词)是指导 AI 生成的核心。一个优秀的提示词应包含主体、风格、环境、光照等要素。

通用模板

(主描述), (风格关键词), (质量修饰词), (负面提示词)

Embedding 提示词打包

Embedding 是一种将一组特征词打包的技术,常用于负向提示词以提高出图质量。例如,使用特定的 Embedding 文件可以自动修正手部结构或优化光影。

LoRA 低秩适应模型

LoRA (Low-Rank Adaptation) 源自微软论文,用于微调大模型。在 SD 中,LoRA 体积小、训练成本低,可用于精确控制角色风格、画风或特定物体。

  • 应用场景:游戏角色二次创作、特定画风迁移。
  • 优势:相比完整模型,加载速度快,显存占用低。

进阶功能

高清修复 (Hires.fix)

原理是先以低分辨率生成底图,再通过放大算法补充细节。优势在于不改变构图,能有效解决高分辨率下的人脸崩坏或多头问题。

局部重绘 (Inpainting)

当画面大部分满意仅需修改局部时使用。WebUI 提供三种方式:

  1. 局部重绘:用画笔涂抹区域进行重绘。
  2. 涂鸦重绘 (InPaint Sketch):输入草图指导 AI 绘制。
  3. 上传蒙版 (InPaint Upload):导入专业软件制作的精细蒙版。

ControlNet 构图控制

ControlNet 插件能从参考图中提取边缘、深度或姿态信息,精确控制生成图的构图。这对于商业化应用尤为重要,能大幅降低 AI 出图的随机性。

ComfyUI 节点式生图

ComfyUI 采用节点式工作流,允许用户自由组合输入输出,实现比 WebUI 更高的控制自由度,适合复杂流程定制。

常见问题与优化建议

显存不足怎么办?

  • 开启 --medvram 或 --lowvram 启动参数。
  • 使用 xformers 优化。
  • 降低分辨率或使用分块放大插件。

生成图片模糊?

  • 检查是否使用了正确的模型(Checkpoint)。
  • 尝试开启 Hires.fix。
  • 调整 CFG Scale 避免过度引导。

提示词无效?

  • 确保语法正确,权重使用 (keyword:1.2)。
  • 检查模型是否支持该风格(不同模型对提示词敏感度不同)。
  • 尝试更换采样器。

结语

Stable Diffusion WebUI 提供了丰富的生态和扩展能力,掌握其核心功能与优化技巧,能够显著提升创作效率。随着技术发展,建议持续关注官方更新及社区新插件,以保持工具的先进性与实用性。

目录

  1. Stable Diffusion WebUI 使用指南
  2. 前言
  3. 硬件篇
  4. 显卡选择
  5. 部署环境
  6. Windows 环境
  7. Mac 环境
  8. 在线平台
  9. 提速篇
  10. 界面与参数
  11. 提示词工程
  12. 通用模板
  13. Embedding 提示词打包
  14. LoRA 低秩适应模型
  15. 进阶功能
  16. 高清修复 (Hires.fix)
  17. 局部重绘 (Inpainting)
  18. ControlNet 构图控制
  19. ComfyUI 节点式生图
  20. 常见问题与优化建议
  21. 显存不足怎么办?
  22. 生成图片模糊?
  23. 提示词无效?
  24. 结语
  • 免费图片AI生成工具免费生成了解详情
  • Magick API 一键接入全球大模型注册送1000万token查看
  • 免费图片视频在线生成30秒,将你的创意变成现实开始设计
  • X/Twitter免费视频下载器免登陆无限额度免费视频解析下载了解详情
  • 100+免费在线小游戏爽一把
极客日志微信公众号二维码

微信扫一扫,关注极客日志

微信公众号「极客日志V2」,在微信中扫描左侧二维码关注。展示文案:极客日志V2 zeeklog

更多推荐文章

查看全部
  • Python 爬虫副业指南:主流接单平台与注意事项
  • Web 前端基础知识点汇总
  • 基于中文金融知识的 LLaMA 系微调模型智能问答系统
  • 大模型技术演进与核心应用场景深度解析
  • AI 辅助开发:用 DeepSeek 构建高性能贪吃蛇游戏
  • 论文笔记:OmniVTLA 视觉 - 触觉 - 语言 - 行动模型与语义对齐触觉感知
  • OpenClaw Gateway 卡死假死问题诊断与预防方案
  • 大数据基于Python的在线考试与评估系统设计与实现
  • Clawdbot 部署指南:反向代理与 WebAuth 安全配置
  • MySQL 核心原理与实战:从基础到高可用架构
  • Proxmox VE 部署 Kali Linux 完整实战指南
  • Testsigma 开源自动化测试平台新手入门指南
  • LangFlow 对接主流大模型教程:Llama、ChatGLM、Qwen
  • AR 眼镜光学镜头设计实战与核心技巧解析
  • PHP 调用 DeepSeek API 接口示例
  • 第二届人工智能、数字媒体技术与社会计算国际学术会议(ICAIDS 2026)
  • Neo4j 5.26 版本下载安装配置步骤
  • OpenClaw Agent Skills 核心技能推荐及安装指南
  • 开源 ROS 智能割草机器人:硬件选型、软件架构与部署指南
  • 25% → 90%!别让 Skills 吃灰:Hooks + Commands + Agents 协同激活 AI 全部能力:Claude Code 工程化实践

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online