跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

Windows 本地部署 ComfyUI 运行 Qwen-Image 大模型详细步骤

Windows 环境下使用 ComfyUI 部署阿里 Qwen-Image 文生图大模型的完整流程。涵盖模型下载、环境配置、工作流加载及 LoRA 风格扩展,对比了不同生成效果,并分析了资源消耗情况。

imJackJia发布于 2026/2/8更新于 2026/9/1082 浏览
Windows 本地部署 ComfyUI 运行 Qwen-Image 大模型详细步骤

前言

Stable Diffusion 本地部署往往面临显卡驱动、环境配置等繁琐问题。随着阿里推出 Qwen-Image 开源文生图模型,结合 ComfyUI 工作流可以更方便地实现高质量图像生成。本文将详细介绍在 Windows 环境下部署 ComfyUI 并加载 Qwen-Image 模型的完整流程。

ComfyUI 部署与配置

环境准备

确保已安装 Python 环境及 CUDA 驱动。下载 ComfyUI 官方版本,解压至本地目录。

启动脚本: 双击 ComfyUI 根路径下的 run_nvidia_gpu.bat 文件。 终端窗口将自动初始化,随后默认浏览器会打开 ComfyUI 操作界面。

模型下载

需下载以下核心模型文件(基于 HuggingFace):

  1. Diffusion Model: qwen_image_fp8_e4m3fn.safetensors

  2. Text Encoder: qwen_2.5_vl_7b_fp8_scaled.safetensors

  3. VAE: qwen_image_vae.safetensors

建议目录结构如下:

📂 ComfyUI/
├── 📂 models/
│ ├── 📂 diffusion_models/
│ │ └── qwen_image_fp8_e4m3fn.safetensors
│ ├── 📂 vae/
│ │ └── qwen_image_vae.safetensors
│ └── 📂 text_encoders/
│ └── qwen_2.5_vl_7b_fp8_scaled.safetensors

运行步骤

  1. 加载模型节点:

    • Load Diffusion Model: 加载 qwen_image_fp8_e4m3fn.safetensors
    • Load CLIP: 加载 qwen_2.5_vl_7b_fp8_scaled.safetensors
    • Load VAE: 加载 qwen_image_vae.safetensors
  2. 设置参数:

    • 设定图像尺寸(如 1024x1024)。
    • 输入提示词。
  3. 生成图片: 点击生成按钮等待输出结果。

阿里模型简介

Qwen-Image 是通义千问系列的文生图开源模型,参数量达 20B,采用 MMDiT 多模态扩散架构,遵循 Apache 2.0 许可证。该模型擅长中文文本渲染,能够准确将文字内容嵌入图像细节中,支持背景替换、颜色调整等操作。

配置 ComfyUI 相关内容以及 Qwen-Image Json WorkFlow

下载工作流

官方示例工作流地址: https://comfyanonymous.github.io/ComfyUI_examples/qwen_image/

JSON 模板链接: https://raw.githubusercontent.com/Comfy-Org/workflow_templates/refs/heads/main/templates/image_qwen_image.json

启动 ComfyUI 加载工作流

  1. 打开 ComfyUI 界面。
  2. 将下载的 .json 工作流文件拖拽至 ComfyUI 界面中。
  3. 界面会自动解析出对应的节点连线结构。
  4. 在对应输入框填入官方推荐的提示词。

示例提示词:

宫崎骏的动漫风格。平视角拍摄,阳光下的古街热闹非凡。一个穿着青衫、手里拿着写着'阿里云'卡片的逍遥派弟子站在中间。旁边两个小孩惊讶的看着他。左边有一家店铺挂着'云存储'的牌子,里面摆放着发光的服务器机箱,门口两个侍卫守护者。右边有两家店铺,其中一家挂着'云计算'的牌子,一个穿着旗袍的美丽女子正看着里面闪闪发光的电脑屏幕;另一家店铺挂着'云模型'的牌子,门口放着一个大酒缸,上面写着'千问',一位老板娘正在往里面倒发光的代码溶液。

LoRA 模型加持

如需特定写实风格,可额外下载 LoRA 模型(通常后缀为 .safetensors 或 .ckpt)。

  1. 从模型分享网站(如 CivitAI)搜索并下载所需风格的 LoRA。
  2. 将 LoRA 文件拖入 ComfyUI 界面。
  3. 在工作流中找到 Load Lora 节点,关联文件名。
  4. 重新输入提示词并生成。

可灵、即梦、Qwen-Image 对比

使用同一混合中英文提示词进行测试:

"A warm, golden-lit ancient tower interior in Tang dynasty style..."

测试结果对比显示,Qwen-Image FP8 量化版本在 ComfyUI 中运行时,画面锐度、文字渲染准确性及光影质感表现优异,尤其在中文场景描述上具有显著优势。

资源消耗

根据官方实测数据,FP8 精度模型对显存需求相对友好。用户可根据硬件条件尝试 BF16 精度以获得更佳效果,具体资源占用视显存大小而定。

总结

通过本地部署 ComfyUI 并结合 Qwen-Image 模型,可以实现高质量的中文文生图任务。无需依赖特定云平台,本地 GPU 即可满足推理需求。该方案适合需要精细控制生成过程及处理中文文本渲染的用户。

目录

  1. 前言
  2. ComfyUI 部署与配置
  3. 环境准备
  4. 模型下载
  5. 运行步骤
  6. 阿里模型简介
  7. 配置 ComfyUI 相关内容以及 Qwen-Image Json WorkFlow
  8. 下载工作流
  9. 启动 ComfyUI 加载工作流
  10. LoRA 模型加持
  11. 可灵、即梦、Qwen-Image 对比
  12. 资源消耗
  13. 总结

更多推荐文章

查看全部
  • 微搭低代码:手机号登录与RBAC路由控制
  • ERNIE-4.5-0.3B 轻量模型部署指南与性能测评
  • C++ 多态详解:概念、语法与底层实现
  • RAGFlow Python API 中文文档
  • MySQL 核心技术详解:架构、索引与高可用实战
  • Flutter modular_core 鸿蒙适配:依赖注入与模块化管理实践
  • 基于 STM32F407 与 K230 的二维云台激光打靶系统设计
  • Python 文件操作深度解析与避坑指南
  • MidJourney 创作 AI 艺术详细教程
  • Anaconda 开始菜单快捷方式丢失及 mkmenus 报错修复
  • VSCode Copilot 配置文件提示警告分析与解决
  • 哈希表原理与实现:线性探测及链地址法
  • Stable Diffusion v2-1-base 模型使用指南与代码实践
  • 清华团队发布 OpenClaw 研究报告:AI 智能体生态闭环解析
  • 华为 OD 机试双机位 C 卷 - 评委评分与选手排名
  • Python 学习过程中的核心难点与分阶段突破指南
  • 大模型核心技术解析:提示工程、函数调用、RAG 与微调
  • Stable Diffusion Windows 环境搭建与使用指南
  • Ubuntu 20.04 系统下 QGroundControl 地面站安装教程
  • DockerHub 镜像加速配置指南(Windows、Mac、Linux)

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online