跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

Qwen-Image-2512 V2 模型特性与 ComfyUI/WebUI 部署指南

Qwen-Image-2512 是阿里开源的最新文生图模型,V2 版采用 FP8 量化,支持消费级显卡运行。相比旧版,其在人物表现、自然细节及文字渲染上显著提升,性能接近闭源顶级模型。该模型在创意设计、教育等领域的应用,并提供了基于 ComfyUI 和 WebUI 的部署教程及文件结构说明,支持自定义模型切换与 LoRA 扩展。

魔法巫师发布于 2026/4/5更新于 2026/9/874 浏览
Qwen-Image-2512 V2 模型特性与 ComfyUI/WebUI 部署指南

Qwen-Image-2512 V2 模型特性与 ComfyUI/WebUI 部署指南

Qwen-Image-2512 是 Qwen-Image 文生图基础模型的 12 月更新版本,这是一个最新的文本生成图像模型,特点是画面更真实、细节更精致,提升了人物与自然细节的真实感,适合在创意设计、教育展示、内容生产等领域使用。

今天分享的 Qwen-Image-2512 V2 版基于阿里最新开源的 Qwen-Image-2512 的 FP8 量化版(同时支持 BF16),支持消费级显卡最低 12G 显存流畅运行,支持更适合小白操作的 WebUI 模式和专业选手的 ComfyUI 两种模式。相比较旧版本,V2 版因使用精度更高的 FP8 模型,所以在生成效果上更好,同时对硬件的要求也更高,大家根据需要选择适合自己的版本。

模型特点

  • 更真实的人物表现:相比旧版本,人物的面部细节、表情和环境都更自然,不再有明显的'AI 感'。
  • 更精细的自然细节:风景、动物毛发、水流等元素渲染更逼真,层次感更强。
  • 更准确的文字渲染:在生成带文字的图像(如海报、PPT)时,排版和字体更清晰,图文融合更好。
  • 更强的整体性能:在超过一万次盲测中,表现优于大多数开源模型,甚至接近闭源顶级模型。

应用领域

  • 创意设计:用于插画、广告、海报、角色设定。
  • 教育与培训:生成教学用图、科普展示、信息图表。
  • 内容生产:辅助媒体、社交平台快速生成高质量配图。
  • 虚拟场景构建:游戏、美术、影视前期概念设计。

使用教程

(建议 N 卡,显存 12G 起,支持 50 系显卡)

整合包包含所需所有节点,下载主程序和模型(ComfyUI 文件夹),解压主程序后,将 ComfyUI 文件夹移动到主程序目录下即可。

支持自定义模型切换,模型下载,显卡≥16G 显存的用户,可以使用更高精度的 BF16 模型,生成效果最佳。

WebUI

启动后,输入提示词,设置参数,生成即可。

ComfyUI 工作流

双击启动,浏览器输入 http://127.0.0.1:8188/ 进入页面后,点击左侧的工作流程,选择对应的工作流,如需切换模型,UNET 加载器切换自己需要的模型。输入提示词,设置参数,最后运行即可。

支持 LoRA 扩展,目前少有支持 Qwen-Image-2512 的 LoRA 模型,WebUI 和 ComfyUI 都留有 LoRA 支持,后期有对应 LoRA 模型,可以直接使用。

软件目录结构

📂 qwen-image-package/
├── 📂 ComfyUI/
│   ├── 📂 models/
│   │   ├── 📂 diffusion_models/
│   │   │   └── qwen_image_2512_fp8_e4m3fn.safetensors
│   │   ├── 📂 text_encoders/
│   │   │   └── qwen_2.5_vl_7b_fp8_scaled.safetensors
│   │   └── 📂 loras/
│   │       └── Qwen-Image-2512-Lightning-4steps-V1.0-bf16.safetensors
├── 📂 ...

目录

  1. Qwen-Image-2512 V2 模型特性与 ComfyUI/WebUI 部署指南
  2. 模型特点
  3. 应用领域
  4. 使用教程
  5. WebUI
  6. ComfyUI 工作流
  7. 软件目录结构

更多推荐文章

查看全部
  • LLaMA Factory 大模型训练与微调指南
  • 使用 ssprompt 工具生成小红书爆款文案
  • RAG 的基石:大语言模型文本向量化能力对比
  • 2026 年中国 200 多家机器人及具身智能公司名单
  • llama.cpp 量化模型部署实战:从模型转换到 API 服务
  • AI 原生重构低代码开发:从工具到智能体的范式变革
  • HTML5 结合 AI 的安全防护与应用实践
  • AR 健身教练实践:基于 Rokid CXR-M SDK 的落地实现
  • SkyWalking Python 应用追踪:基于 skywalking-python 的埋点实践
  • Go 语言 Map 取值详解:单值与双值返回的源码剖析
  • Vue3 + Python 校园排球俱乐部信息管理系统
  • 一网统飞无人机巡检系统落地方案
  • C++ STL 容器适配器详解:stack、queue 与 priority_queue
  • 为什么选择 Python:核心特性与优势解析
  • 在 Linux Ubuntu 上安装 Qt 5 详细教程
  • ARINC 825 航空通信协议核心百问与工程实践
  • 基于 DJL 与 PaddlePaddle 的菜品图像识别实现
  • 二分查找:山峰数组的峰顶索引与寻找峰值
  • text-generation-webui 本地大语言模型部署完整指南
  • 基于 Q-Learning 的无人机三维动态环境自主避障路径规划

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online