
本地运行 Qwen-Image:Windows 上 ComfyUI 部署记录
记录在 Windows 上使用 ComfyUI 加载 Qwen-Image 20B 文生图模型的完整过程,涵盖环境配置、模型下载、工作流导入及 LoRA 扩展,无需云平台即可完成中文文本嵌入图像的高质量生成。FP8 量化版本显存友好,适合追求本地控制的用户。
博客作者
这位作者暂未填写个人简介。
223
已发布文章
1.5K
博客获赞
23K
博客浏览
第 1 页

记录在 Windows 上使用 ComfyUI 加载 Qwen-Image 20B 文生图模型的完整过程,涵盖环境配置、模型下载、工作流导入及 LoRA 扩展,无需云平台即可完成中文文本嵌入图像的高质量生成。FP8 量化版本显存友好,适合追求本地控制的用户。

记录通过 MCP 协议将 Dify 与 MySQL 整合的实操过程:搭建 MCP server 作为中间层,在 Dify 中安装 MCP SSE 插件并配置 Agent 工作流,使大模型能根据自然语言问题直接生成并执行 SQL 查询。文章包含完整的环境准备、建表语句、MCP server 安装与 Dify 工作流配置步骤,并针对常见连接失败、工具调用错误等问…

用 Python 处理日常重复任务,包括批量下载简历模板、识别网页中的文档链接、按扩展名自动整理文件夹、合并去重多个 Excel、定时监控商品价格以及用 yfinance 分析基金表现。每个场景附有可直接运行的代码片段,并指出了实际使用时需要注意的错误处理、请求频率控制和数据源替换等细节。脚本虽小,但能显著提升效率,前提是遵循爬虫规范和法律法规。

Clawdbot 接入飞书机器人时,核心工作是先在飞书开放平台创建应用并记录 App ID、App Secret,再通过命令行安装飞书插件。真正容易出问题的是权限、长连接和插件注册状态:飞书侧要按文档逐项授权并切到长连接模式,Clawdbot 侧如果安装中断或启动失败,通常需要清理 clawdbot.json 里 plugins 和 channels 的飞书…

大模型智能体把社会模拟拆成个体、任务和社会三个层次:先用角色设定、短期/长期记忆和反思机制稳定单个智能体,再通过通信、协商和工具调用完成多智能体任务,最后在网络结构和互动规则下观察舆论传播、规范形成等涌现现象。文章也指出了当前的主要障碍,包括幻觉、评估困难、伦理风险和高算力成本,并认为多模态、可解释性、人机协同和标准化会是后续重点。

反爬不再是改 UA 就能过的阶段,常见拦截点主要是人机验证、设备指纹和频率限制。文章按这三层拆开说明了它们各自的检测重点:验证看操作轨迹和行为顺序,指纹看浏览器与环境特征的一致性,限流看请求节奏和计数方式。实际处理时,重点不是单点破解,而是让会话状态、环境特征和请求频率保持连贯和稳定。

辞掉前端工作去韩国读CS硕士,这段经历带来的不仅是成绩GPA 4.5/4.5和专业前1%,更是能力结构的改变:在卷的环境中学会自驱,用GPT加速学习并建立起自己的使用边界,写博客意外换来讲师机会,同时失去松弛感、社交连续性和熟悉领域的掌控感。期末周的高强度交付让人疲惫,但前端三年积累的工程化思维和拆解能力成功迁移到研究生学习中。最终选择回到前端,带着更宽的视…

微信官方推出 ClawBot 插件,实现个人微信与开源 AI 助手 OpenClaw 的直连。该方案无需企业微信或第三方协议,降低了使用门槛。详细说明了安装前提(本地 OpenClaw、iOS 微信版本),对比了 Mac 与 Windows 下的不同安装路径,重点解决了 Windows 端因系统命令差异导致的 npx 报错问题。同时梳理了 ClawBot 与…

档详细讲解了 ABB 机器人虚拟示教器的基础操作与编程要点。内容涵盖手动与自动模式切换、单轴及线性动作模式选择、四大坐标系的应用,以及工具数据、工件数据和有效载荷的核心配置方法。此外,还介绍了操纵杆控制技巧、程序编辑器结构、运动指令参数设置、中断处理机制及编程规范。通过实际代码示例和排错指南,帮助工程师快速上手 ABB 机器人调试,强调安全操作与数据准确性的…
前端国际化涉及多语言支持与格式本地化。硬编码字符串导致维护困难,推荐采用 i18next 等专业库统一管理资源。方案涵盖参数化翻译、浏览器语言自动检测、日期时间数字货币格式化及 RTL 布局支持。配合懒加载与自动提取工具可提升开发效率与用户体验。
本文演示了如何使用 OpenClaw 构建多 Agent 系统并对接飞书机器人。核心在于实现每个 Agent 独立的工作空间、知识库及模型配置,确保数据与状态严格隔离。通过命令行工具添加 Agent、设置身份标识,并启用 Feishu 插件以支持群聊与文档交互。过程中需注意 API 密钥安全及模型版本兼容性,最终实现多角色协同处理业务场景。

在网络项目中,将错误处理下沉至 Axios 拦截器层是实现业务逻辑与网络状态解耦的关键。通过构建请求与响应拦截器,集中处理 HTTP 错误、业务异常及网络超时等情况。设计错误分级策略映射,针对不同状态码执行如无感刷新或统一提示等动作。同时标准化错误对象结构,确保业务层只需面对统一的错误类型,降低维护成本并提升代码可拓展性。最终目标是建立一套可配置、可扩展的网…
基于 OpenCV 的传统算法方案'AI 印象派艺术工坊'与基于深度学习的 Stable Diffusion 在图像风格迁移任务中表现迥异。测试表明,前者显存占用低、启动快且支持完全离线,适合移动端、边缘设备及标准化图像处理场景;后者风格多样但资源消耗大,适用于数字艺术创作与创意探索。技术选型应依据资源约束与功能目标进行权衡,轻量算法在特定领域具备工程落地优…
OpenCode 是一款 100% 开源的 AI 编程代理,支持终端、桌面及 IDE 扩展。详细介绍安装方法、Provider 配置、TUI 界面操作、Agent 系统、自定义命令及 MCP/LSP 集成。涵盖 Plan 与 Build 模式切换、权限管理、主题个性化及常见问题解答,帮助开发者利用 AI 提升编码效率与项目维护能力。
硕士论文盲审中 AIGC 检测已成为关键环节,处理方式包括直接拦截、随文送审或内部存档。评委态度各异,高 AI 率可能影响评审结论甚至导致重审。有效降低 AI 率需提前规划,预留一至两周时间进行预检与修正。选择正规工具时需注意保护数据安全,同时保持专业术语准确、逻辑连贯及引用规范。建议盲审前进行多平台交叉验证,确保符合学校要求,以保障顺利毕业。

国产 AI 编程助手对比分析,聚焦通义灵码、Comate、CodeBuddy 等工具在代理式闭环能力上的表现。梳理各平台定价模式与企业级功能差异,为开发者提供从免费试用到私有化部署的选型参考。重点评估多文件修改、自动测试生成及 CLI 交互体验,帮助团队控制成本并匹配合规需求。

SpringAI 结合 Ollama 本地部署 Deepseek 模型构建对话机器人的实战方案。涵盖基础模型调用、RAG 检索增强生成、pgvector 向量数据库集成、PDF 文档解析、Function Call 自定义函数及多模态图片理解功能。通过配置本地模型与向量存储,实现在离线环境下的高效智能交互。
timed_out 错误常见于网络请求或数据库连接。传统调试依赖人工日志分析与参数调整,耗时且易遗漏细节。AI 辅助工具通过智能诊断上下文、提供优化建议及实时验证,显著缩短排查时间并降低门槛。实际案例显示,AI 方案在效率与准确性上均优于传统方法,适合快速迭代场景。

Qwen3.5-4B 模型结合 LLaMA-Factory 框架进行垂直领域微调的完整流程。涵盖硬件选型、环境搭建、数据集构建、LoRA 参数配置及部署方案。重点解决显存优化与医疗场景适配问题,提供从训练到合并导出的实操步骤。

DeepSeek 模型通过冷启动数据和多阶段训练提升推理能力。冷启动数据利用少量高质量样本解决初期推理混乱问题,为后续训练奠定基础。多阶段训练包含冷启动微调、推理导向强化学习、拒绝采样与监督微调及多场景强化学习四个步骤,逐步优化模型逻辑一致性与任务适应性,确保复杂推理任务的准确度和稳定性。