LLaMA Factory+QLoRA 微调 70B 大模型实战
介绍使用 LLaMA Factory 框架结合 QLoRA 技术,在消费级显卡上微调 70B 大模型的方法。主要解决显存不足和技术门槛高的问题。内容包括环境准备、命令行启动微调、进阶配置优化及常见问题解决方案。通过量化和梯度累积等技术,可在有限显存下实现高效微调。
博客作者
移动开发
328
已发布文章
12K
博客获赞
578K
博客浏览
第 4 页
介绍使用 LLaMA Factory 框架结合 QLoRA 技术,在消费级显卡上微调 70B 大模型的方法。主要解决显存不足和技术门槛高的问题。内容包括环境准备、命令行启动微调、进阶配置优化及常见问题解决方案。通过量化和梯度累积等技术,可在有限显存下实现高效微调。

央视 AI 短片《流金谷恩仇录》的成功案例,探讨了 AI 视频生成的技术栈、挑战及产业趋势。文章指出当前技术已具备叙事能力,但仍面临时序一致性和镜头控制难点。未来人机协同模式将成为主流,短视频和广告素材将率先规模化应用。

对比了 AI Agent 两种主流推理架构:ReAct 与 Plan-and-Execute。ReAct 采用边想边做模式,灵活但缺乏全局视野,长任务下易受上下文污染且成本递增,存在链式崩塌风险。Plan-and-Execute 先规划后执行,具备全局视角,上下文隔离更干净,成本可控且支持自我纠错。针对复杂任务,建议采用混合架构:以 Plan-and-Exe…

文章分享了搭建本地化竞品监控选品系统的经验。传统方案存在爬虫规则维护成本高、模块耦合紧、数据泄露风险等问题。通过整合 Scrapling v0.4 本地自适应爬虫与 OpenClaw v1.2 本地工业级 Agent 框架,实现了从网页到智能体的全本地数据管道,解决了数据不出本地服务器、模块解耦及扩展性难题。
VS Code 在使用远程 SSH 连接时,Copilot 的 Claude 模型及 Agent 模式可能因代理设置和扩展运行位置不当导致工作区识别错误。解决方法是将代理配置在远程服务器端 settings.json 中,而非强制将 Copilot 扩展设为本地 UI 运行,从而确保工作区路径正确识别并正常访问模型服务。

LLaMA-Factory 框架微调 Qwen3.5-4B 模型以构建医疗 AI 助手的完整流程。涵盖硬件要求、环境配置、数据集准备、LoRA 微调参数设置、推理测试及模型导出部署。包含显存优化方案、常见训练问题排查及医疗场景下的免责声明。
Stable Diffusion v1-5-pruned.safetensors 模型的本地部署方法及 LoRA 微调实战。首先解释了 pruned 和 safetensors 格式的优势,包括体积减小、安全性提升及内存优化。接着阐述了 LoRA 原理及其在显存占用、训练速度和即插即用方面的工程优势。提供了自动化训练工具的配置示例,涵盖数据集准备、参数设置、…

Meta 于 2025 年发布的 Llama 4 Scout 是首款引入 MoE 架构的轻量化 Llama 模型。总参数 109B,单 token 激活 17B,支持 10M token 上下文窗口及原生多模态能力。在 MMLU、ChartQA 等基准测试中表现优异,可在单张 H100 GPU 上部署。采用 iRoPE 技术解决长文本位置编码问题,通过 FP…

对比了 GitHub Copilot、Cursor 和 Codex 三款 AI 编程工具。Copilot 擅长多 IDE 环境下的代码补全;Cursor 基于 VS Code 深度集成 AI,支持多模型切换与跨文件编辑;Codex 侧重云端处理与大上下文窗口,适合团队协作及大型项目。开发者可根据具体需求选择合适工具。
介绍 Python AI 开发入门,涵盖环境搭建、线性回归、神经网络基础及 MNIST 图像分类实战。通过 PyTorch 框架演示模型构建与训练流程,对比 Rust 语言特点,帮助开发者快速掌握 AI 核心概念与代码实现。

在微信中部署 AI 助理的需求背景及常见方案的局限性。传统 Python 脚本易导致封号,企业微信功能受限,第三方 SaaS 存在隐私风险。OpenClaw 提供零代码解决方案,支持本地私有化部署,对接开源大模型,实现消息自动回复、群聊汇总等功能,保障数据安全并降低封号风险。文章旨在帮助开发者避开常见问题,快速搭建私人微信 AI 助理。

Neo4j Aura Agent 现已全面商用,旨在解决企业级智能体在数据集成和构建过程中的挑战。该平台通过知识图谱深度集成,支持从数据模式自动生成智能体草稿,提供精准的 GraphRAG 检索能力、高级推理与可解释性,并实现一键部署到安全托管的 MCP 服务器。它消除了技术栈复杂性,内置 LLM 和嵌入服务,适用于制药、金融等对准确性要求高的领域,显著缩短…
介绍如何在 Mac Mini 上部署 OpenClaw 开源 AI 智能体框架。内容包括环境准备(系统优化、工具安装)、核心配置(API 密钥、模型选择)、安全加固(沙箱隔离、权限控制)、消息渠道集成(Telegram/iMessage)及生产级运维监控。通过本地优先执行策略,实现文件管理、终端指令执行及应用控制的自动化,保障数据隐私与系统安全。

介绍开源 UI/UX Pro Max 插件,旨在解决 AI 生成界面缺乏美感的问题。该插件内置 57 种 UI 风格、95 套配色方案及 98 条 UX 准则,支持 Claude Code、Cursor 等 AI 助手。通过结构化设计数据库,将隐性经验转化为显性规则,辅助开发者生成符合行业标准的代码。支持 React、Vue、Tailwind 等多技术栈,提…
智谱 AI 发布 GLM-4.5 系列开源大模型,打破推理、编码、智能体能力难以兼得的困局。该系列基于 MoE 架构,含旗舰版、轻量版及视觉版,支持混合推理模式。架构采用深度优先策略、无损失平衡路由及多 Token 预测优化。训练流程分为预训练、中期训练和后训练三阶段课程式学习。
如何在 VS Code 中配置 GitHub Copilot 以实现高效的 Vibe Coding。内容包括环境准备、界面布局优化、常用快捷键、GitHub 集成流程以及 Copilot Chat 的 Ask、Edit、Agent 三种模式详解。此外还涵盖了斜杠命令、上下文引用、提示工程技巧及命令行工具的使用建议,旨在帮助开发者提升编程体验与效率。

Enterprise Architect 16 是一款支持 UML、BPMN 等多种建模语言的企业级建模工具,具备版本控制、协作及文档管理功能。该软件的主要特性、官方下载渠道、详细安装步骤以及试用版的注意事项,帮助用户了解和使用该工具进行系统设计与开发。

介绍基于 iTwin Capture Modeler 软件的无人机航测内业处理流程,涵盖工程新建、区块创建、影像导入、空三解算、刺点校正、三维重建、精度检查、土方算量及模型分享。重点说明了硬件配置要求、坐标系设置、像控点导入及 OSGB 模型导出步骤,适用于测绘与土木工程领域的三维建模需求。
Whisper 和 Faster-Whisper 语音识别模型的分类、两种主要安装方式(pip 安装与 HuggingFace 下载)以及对应的代码运行示例。内容涵盖了基础环境配置、模型加载方法、GPU/CPU 运行选项及音频处理流程,旨在帮助开发者快速上手部署相关模型。

探讨了利用 AIGC 技术实现测试周报自动化的方案。针对传统手工整理 Jira、Git 及 CI 日志耗时易错的问题,提出构建自动化数据管道与智能指标提炼模型。通过接入核心系统 API,提取测试通过率、缺陷密度等关键指标,并利用大语言模型生成具备洞察力的分析报告。该方案旨在将测试人员从重复劳动中解放,转向质量分析与策略设计,提升测试工作的价值呈现与智能化水平…