
基于 NVIDIA DGX Spark 部署 Stable Diffusion 3.5 与 ComfyUI
在搭载 Blackwell 架构 GPU 和 Grace CPU 的 NVIDIA DGX Spark 设备上部署 Stable Diffusion 3.5 Large 模型的完整流程。主要步骤包括构建兼容 CUDA 13 和 ARM64 架构的 Conda 环境,从 Hugging Face 下载模型权重,安装并修复 ComfyUI 的 ARM 依赖,配置…
博客作者
非主流
348
已发布文章
12K
博客获赞
805K
博客浏览
第 6 页

在搭载 Blackwell 架构 GPU 和 Grace CPU 的 NVIDIA DGX Spark 设备上部署 Stable Diffusion 3.5 Large 模型的完整流程。主要步骤包括构建兼容 CUDA 13 和 ARM64 架构的 Conda 环境,从 Hugging Face 下载模型权重,安装并修复 ComfyUI 的 ARM 依赖,配置…

测评了 Pi0 机器人视觉 - 语言 - 动作(VLA)大模型在华为昇腾 Atlas 800I A2 服务器上的部署情况。通过 CANN 神经网络计算架构,利用官方开源仓库 cann-recipes-embodied-intelligence 完成环境配置。测试核心指标包括推理速度、控制精度及功能完整性。结果显示单次推理耗时约 65 毫秒,误差控制在 1 厘…

介绍基于 LlamaFactory 的大模型微调实战。涵盖全量微调、LoRA、QLoRA 等参数更新方式,以及 SFT、DPO、PPO 等训练目标。详解 Docker 环境配置、数据集处理及关键超参数(rank、alpha、target)调优技巧,并提供评估指标设置建议,适用于 LLM 抽取任务等场景。
Counterfeit-V3.0 是一款针对 Stable Diffusion 的模型,旨在解决 AI 绘画中构图僵化、风格不统一及细节控制不足的问题。该模型采用构图优先训练理念与负嵌入技术,提供基础版、修复版和半精度版三种选择。实战案例显示其在动漫角色创作和科幻场景构建中表现优异,相比传统模型构图满意度提升显著。文章提供了环境配置步骤、参数设置建议及常见问…

OpenClaw 中 IDENTITY.md 文件的作用,强调其与 SOUL.md 的区别,即身份展示与核心价值观的分离。文章详细解析了 IDENTITY.md 的五个核心要素,包括角色定义、语气规范、交互风格、专业知识领域及平台适应。提供了 10 个专业场景下的 IDENTITY.md 模板,涵盖法律、情报、健身、开源社区等多个领域。同时对比了 Claud…

在 Ubuntu 22.04 环境下配置 NVIDIA 驱动、CUDA、PyTorch 及 Isaac Lab 的步骤。详细说明了如何注册自定义机器人模型(URDF 转 USD)、编写环境配置文件(地形、奖励、观测)以及调整强化学习参数。最后提供了使用 RSL-RL 框架进行训练和测试的具体命令,帮助用户从零开始实现双足机器人的行走训练。

使用 AI 数据标注工具提升标注效率的实战经验。通过集成预训练模型(如 YOLO、ResNet)与 Label Studio,实现了自动化初标与人工审核结合的工作流。实测数据显示,标注速度提升 225%,错误率从 18% 降至 7%。文章详细讲解了环境搭建、代码集成、置信度阈值设置及质量保障机制,并提供了避坑指南,帮助团队在智能安防等场景中实现高效、高质量的…
对 Whisper-large-v3 模型进行了 100 条样本的人工校验评估。测试涵盖中文、英文及混合语言,包含清晰录音、背景音、多人对话及低质量录音等场景。结果显示整体字准确率为 94.7%,召回率 96.3%。在清晰录音下表现接近完美,但在嘈杂环境及多人重叠语音时精度下降。文章提供了不同场景下的性能数据、错误类型分析及实际应用建议,表明该模型适合会议记…
介绍 Stable Diffusion 3.5 FP8 量化模型的技术原理及本地部署方案。FP8 格式通过降低精度减少显存占用并提升推理速度,适合消费级显卡运行。文章详细讲解了 Python 虚拟环境创建、PyTorch 依赖安装、FP8 模型加载代码示例以及生产级部署架构设计。同时提供了常见问题排查指南,帮助用户在 RTX 30/40 系列显卡上实现高效图…
介绍在 Linux 系统上安装配置 libwebkit2gtk-4.1-0 库的方法。解释了包名命名规则及依赖关系(如 libjavascriptcoregtk-4.1-0)。针对 Ubuntu 等旧版本系统可能无法通过 apt 直接找到该包的问题进行了说明,指出这是常见的新手入门问题。
NotoSansSC-Regular.otf 是 Adobe 与 Google 合作开发的开源简体中文无衬线字体,属于思源黑体家族。其设计旨在消除缺字显示的方块问题,覆盖 GB18030 标准及通用规范汉字表字符。采用 SIL Open Font License 协议,允许免费商用。适用于界面设计、屏幕显示及正文排版等多场景,具有中性均衡、清晰易读的特点,是…

汇川机器人软件 RobotLab 的常规操作注意事项,涵盖权限管理(登录及控制权配置)、过渡点使用(避免干涉与安全风险)、全局点位移动(编号与标签调用)、点位示教(坐标系与工具号选择)、全局变量监控(添加与刷新机制)以及程序备份(防止配置冲突)。重点强调了操作中的安全规范与常见错误排查方法。

通过 Python 从零构建一个基于 ReAct 范式的 AI Agent。涵盖环境配置、核心组件(LLM 客户端、工具系统、对话记忆)、Agent 逻辑实现及运行测试。包含计算器、文件读写、网络请求等工具示例,并提供扩展优化建议与常见问题解答,适合希望深入理解 Agent 底层逻辑的开发者。

基于 ClawdBot (OpenClaw) 框架在 Discord 平台部署 AI 对话机器人的完整流程。主要步骤包括创建 Discord 应用与 Bot、配置 OAuth2 权限、全局安装 ClawdBot、初始化 Daemon 服务、接入智谱 GLM 等 AI 模型 API、启动 Gateway 服务以及调试运行。文档涵盖了网络环境要求、Token 管…
SimVascular 开源医学影像血流仿真工具的完整使用指南。内容涵盖软件核心优势、系统环境要求、安装配置方法(含源码编译)、核心功能模块(影像预处理、血管分割、网格生成、仿真分析)以及实战案例(冠脉疾病评估、主动脉瘤风险预测)。此外还包含 Python API 集成开发、常见问题排查及性能优化建议,适合心血管研究领域的研究人员和临床医生参考使用。
ManiSkill 是一个基于 SAPIEN 引擎的机器人操作模拟平台。在不同系统(Ubuntu, Windows, MacOS)上的安装步骤与环境配置要求。内容包括基础依赖检查、Vulkan 驱动安装、GPU 加速设置及常见问题排查。此外,还展示了 PickCube、StackCube 等典型任务场景及性能优化技巧,帮助开发者快速搭建仿真环境并进行机器人学…

如何在绿联 NAS 上配置 WebDAV 服务以实现公网访问,并通过 RaiDrive 将 NAS 存储挂载到本地计算机。主要步骤包括确认 IPv6 支持、购买域名、配置腾讯云访问凭证、启用 NAS WebDAV 及 DDNS 服务、设置反向代理(推荐使用 Lucky)、以及在 RaiDrive 中完成挂载。同时提供了防火墙设置建议,确保公网访问的安全性与可…
对比了 Llama-Factory 与传统手工微调方法在大语言模型微调任务中的效率与成本差异。通过实测数据(基于 NVIDIA A4000 GPU 及 5 万条中文指令),展示了 Llama-Factory 在环境配置、数据预处理及训练周期上的显著优势,配置与预处理效率提升可达 6-12 倍,训练周期缩短 2-3 倍。文章强调了自动化工具在降低时间消耗和优化…

在 Java 项目中集成高德开放平台 WebAPI 的方法,重点演示 POI 搜索功能的实现。内容包括获取 API Key、使用 Uniapi 定义接口、发送 HTTP 请求及解析返回数据。通过关键字搜索和多边形搜索示例,展示了完整的调用流程、参数配置及结果处理,并讨论了常见问题如频率限制和安全性优化。

DApp 开发涉及合约、前端、索引与运维四大模块。合约需注重权限模型、升级方案、事件日志、Gas 成本及链上链下边界划分。前端核心在于交易状态管理,需设计状态机处理签名、广播、回执及异常。上线部署需建立多 RPC 容灾、事件索引及基础监控体系。成熟 DApp 应确保权限清晰、参数可追踪、升级可审计、链路完整及具备运维对账能力。