LLaMA-Factory 自定义评估指标完整实现指南
在 LLaMA-Factory 框架中构建自定义评估指标的完整流程。内容涵盖评估系统架构解析,包括评估器、模板处理器和指标计算器。详细说明了如何定义新的评估函数(如 BLEU 分数),将其集成到 Evaluator 类中,以及配置评估参数。此外,还涉及多指标综合评估系统的构建、结果可视化保存方法、最佳实践与性能优化建议,以及处理大规模数据集时的增量计算策略。…
博客作者
霸绝天下
346
已发布文章
8.2K
博客获赞
582K
博客浏览
第 5 页
在 LLaMA-Factory 框架中构建自定义评估指标的完整流程。内容涵盖评估系统架构解析,包括评估器、模板处理器和指标计算器。详细说明了如何定义新的评估函数(如 BLEU 分数),将其集成到 Evaluator 类中,以及配置评估参数。此外,还涉及多指标综合评估系统的构建、结果可视化保存方法、最佳实践与性能优化建议,以及处理大规模数据集时的增量计算策略。…

GitHub Copilot 是一款 AI 编程助手,其在 VS Code 中的安装、授权及状态验证流程。内容涵盖中文环境下的专属配置优化,包括 Inline 行内建议、Panel 对话模式及 Agent 实验性功能的使用技巧。此外,文章提供了企业级团队规范预设、框架专属配置模板及自定义快捷键方案,并针对建议延迟、中文输出质量及代码重复率等常见问题给出了解决…

介绍使用霹雳设计助手在 PPT 中嵌入 VR 图片及全景图的实操方法。涵盖兼容格式(JPG/PNG/TGA/Web)、本地与网络资源导入、占位符调整、自动旋转与缩放设置、放映模式下的页面切换技巧以及图片替换功能。通过插件可直接在 PPT 内实现 360° 交互预览,无需切换外部软件,适用于产品展示、教学演示等场景。

介绍基于 Spring Boot、MyBatisPlus 和 Thymeleaf 的全栈分页实现方案。内容包括 MyBatisPlus 环境搭建、实体类定义、业务层分页逻辑编写及控制层接口设计。前端通过 Ajax 请求后端数据并渲染表格,同时集成分页条组件。文中还解决了分页插件未配置导致分页失效的常见问题,提供了完整的配置代码示例,帮助开发者快速构建高效稳定…
一种在禁止 SSH 环境下实现跨平台文件传输的方案,采用 WebDAV 配合 Rclone 工具。文章详细记录了在 Windows 上配置 Apache 开启 WebDAV 服务的步骤,包括模块加载、目录权限、防火墙设置及大文件传输优化参数。同时提供了 macOS 和 Windows 下安装 Rclone 的方法,以及基本的连接配置和常用命令示例。该方案适用…
深度解析 2026 年人工智能领域两大里程碑突破:FARS 全自动科研系统与 AIGC 动画电影《团圆令》。FARS 系统在无人干预下连续产出百篇论文,验证了多智能体协作架构在科研工业化中的应用;《团圆令》则展示了 AI 在文化创作全流程中的能力。文章阐述了两者共享的技术逻辑,包括四智能体流水线设计、基于文件系统的多智能体通信机制以及大规模算力驱动。通过提供…
记录了 GitHub Copilot 的使用体验,涵盖订阅计划、安装配置、基本操作及优缺点分析。介绍了代码补全、修复、生成三大场景,并演示了 Kotlin 代码示例。指出其提示精准、多行支持好,但也存在依赖代理、上下文局限及可能生成错误代码等问题。适合辅助编程,但需人工审核。

AR 眼镜光学镜头的设计实例,涵盖消费级、工业及医疗应用场景。详细阐述了视场角、眼动距、畸变等关键指标的实现逻辑,如自由曲面透镜应用、光路折叠设计及高透光材料选择。系统采用 4P1BS 非对称结构,分阶段优化策略包括基础框架锁定、畸变重影优化、效率轻量化平衡及环境适应性测试,最终确保量产良率与佩戴舒适度。

GitHub Copilot Workspace 推出 100 万 Token 上下文支持,旨在解决大型项目开发中的上下文缺失痛点。文章分析了其技术逻辑、实际效果及局限性。优势包括全项目代码感知、跨模块调试及团队协作效率提升;局限性涉及接入层限制(实际约 128K)、代码质量安全隐患及版权风险。结论指出工具无法替代开发者思考,需结合良好工程实践与审查流程,在…
探讨前端安全核心问题,指出直接存储密码和使用 localStorage 保存 Token 的风险。通过对比不安全代码与修复方案,介绍了 HTTPS 传输、HttpOnly Cookie 存储 Token、XSS 输入转义、CSRF Token 验证以及依赖包审计等关键防护措施。旨在帮助开发者构建更安全的 Web 应用,防止数据泄露和恶意攻击。
Maxar Open Data 是提供高分辨率卫星影像的开源项目,支持紧急规划和应急响应。数据通过 STAC 目录以 CSV、GeoJSON 和 MosaicJSON 格式提供,适用于自然事件监测、环境追踪及城市规划。项目涵盖飓风、地震、洪水等多种灾害数据集,采用标准化处理流程。开发者可通过克隆仓库、安装依赖并运行示例代码快速上手,利用高质量影像数据进行空间…
Happy Coder 是专为 Claude Code 和 Codex 设计的移动端与 Web 客户端工具,支持实时语音与端到端加密。它允许开发者通过手机或浏览器远程监控和控制 AI 编程助手,实现多设备无缝切换与状态同步。项目包含 CLI 集成、安全配置及通知提醒功能,适用于远程办公、团队协作及应急处理场景。

介绍如何在 Windows 系统本地部署 ComfyUI 并接入通义万相 Wan2.1 模型,实现文字生成 AI 视频。内容包括软件准备(ComfyUI、文本编码器、VAE、模型文件)、整合配置、本地运行测试以及通过内网穿透工具实现公网远程访问的方法。适合拥有 N 卡且显存 8G 以上的用户尝试开源 AI 视频创作。

记录了在 4 张 NVIDIA A30 显卡环境下部署 Qwen-VL-32B 模型的实战经验。发现 vLLM 因依赖张量并行(TP)导致 PCIe 通信瓶颈而卡死,而 Ollama(基于 llama.cpp)采用流水线并行(PP)成功运行。文章分析了 NVLink 缺失对 TP 的影响,并建议在无 NVLink 的多卡环境中优先使用 llama.cpp 或…

对比了 GitHub Copilot 和 Claude Code 两款 AI 编程工具。Copilot 专注代码补全,Claude Code 侧重全栈开发与架构设计。核心差异在于模型规模与推理方式,Claude 支持项目级多文件分析。功能上,Claude 在测试生成、文档编写及团队协作方面表现更佳,Copilot 在 IDE 即时补全上更流畅。成本模式分别为…

机器人轨迹规划的基本概念,区分了任务规划、路径规划与轨迹规划。阐述了关节空间与笛卡尔空间规划的区别及优缺点。详细讲解了多项式插值、带抛物线过渡线性插值等常用方法,并重点分析了关节空间轨迹规划的步骤,包括约束设定、函数拟合及加速度连续性处理。旨在帮助读者理解如何通过规划算法实现机器人平滑、高效的运动控制。

面向前端工程师,梳理了转型 AI Agent 开发工程师的学习路线。文章指出前端在 Web 技术、API 调用及产品交互方面的优势,同时强调需补齐 LLM、RAG、Agent 架构及后端 Python 能力。内容涵盖核心概念(LLM、RAG、Agent)、后端技能(Python、FastAPI)、工程能力(Prompt、Tool Calling、Memory…

记录了在华为昇腾 NPU 环境下部署和运行 Llama 2 大模型的完整流程。内容包括环境配置、模型加载、性能基准测试及优化方案。通过实测,昇腾 NPU 在 FP16 精度下吞吐量约为 20 tokens/s,使用 INT8 量化后可提升至约 45 tokens/s。文章提供了具体的代码示例和避坑指南,适合需要国产化算力替代或预算有限的开发者参考。
介绍稳定扩散 WebUI 中 LyCORIS 扩展的安装、配置及故障排查。涵盖扩展市场、URL 及手动安装三种方式。详述了模型加载失败、权重无效等问题的解决步骤,包括版本检查、启动参数配置。提供基础与高级提示词语法示例,解释文本编码器和 UNet 权重参数。强调直接重启进程的注意事项,帮助用户高效使用 LyCORIS 模型。

介绍如何使用 TRAE CN IDE 结合 MasterGo MCP 协议,将设计稿直接转化为前端代码。主要流程包括:准备账号权限与环境,获取 MasterGo Personal Access Token,在 TRAE CN IDE 中配置 MCP Server,创建自定义智能体并输入指令生成代码。文章涵盖了 DSL 技术原理、API 能力、具体操作步骤、代…