跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
编程语言AI算法

大模型应用合规指南:提示工程、微调与 RAG

探讨大模型系统中提示工程、微调(Fine-tuning)和检索增强生成(RAG)三种技术路径的合规要点。分析指出,尽管三者互补,但法律监管主要关注安全性而非单纯数据保护。提示工程需防范越狱风险及用户隐私泄露,设计时应赋予用户控制权和清除记忆功能。微调涉及新模型系统备案,需注意训练数据来源的知识产权与个人信息风险。RAG 则强调外部知识库的权威性与版权合规。在构建 AI Agent 工作流时,合规复杂度显著提升,建议实施独立数据处理者身份标识、算法备案及严格的权限控制。

Qiny01发布于 2025/2/7更新于 2026/9/1059 浏览
大模型应用合规指南:提示工程、微调与 RAG

在大模型系统中,提示工程(Prompt Engineering)、微调(Fine-tuning)和检索增强生成(Retrieval Augmented Generation,RAG)分别扮演了不同但互补的角色,共同构成了大模型产品优化的核心路径。

虽然这三项技术在大模型开发和运营中的地位至关重要,但在数据及人工智能法律合规领域,鲜有人深入讨论其背后的运行原理与合规风险。只有深入研究这些技术细节,才能发表更贴切的法律合规意见。

OpenAI 在其大模型优化指南中提出了一个基本线性流程:从提示工程开始,然后转到检索增强生成,最后再进行微调。但更重要的是不同方法之间的杠杆比例运用,而非单纯的前后顺序。

01 提示工程

提示工程(Prompt Engineering)通过设计和优化提示词来引导生成式 AI 模型生成所需的输出。它涉及到自然语言处理、机器学习和人机交互等多个领域的知识。提示工程解决的是提出准确有效的问题。

从目前来看,提示工程是现阶段所有大模型补丁升级中最经济便捷的路径。一般而言,如果能够通过提示工程解决的,不宜直接使用 RAG 特别是微调机制来处理,否则成本代价过高。

假设你在编写一个旅游指南,需要大模型为你生成一些内容。如果你直接问:'请告诉我巴黎的有趣景点',模型可能会给出一些通用的信息。通过提示工程,你可以调整提示来获得更具体的答案,比如:'请为我写一篇关于巴黎卢浮宫的详细介绍,包括其历史背景、主要展品和游客须知。'这样的提示会引导模型提供更详细和具体的信息。

安全与越狱风险 在大模型系统及产品中,大模型需要采取一定的措施以防止越狱风险,即通过越狱而规避大模型限制生成的过程。通过精心设计和细化提示工程,用户可能引导 LLM 绕过限制。

大模型的越狱可能导致大模型产品的生成物泄露特定用户的个人信息(如该用户曾输入的 Prompt 内容),特定用户设计的智能体(AI agent)中知识库中的全量数据,以及企业知识库中的商业信息。因此,不管大模型是开源还是闭源,提升大模型的鲁棒性仍然是一项重要的课题。

合规设计建议 针对单纯的提示词,无论是用户的输入还是大模型系统的预设,提示词的输入本身应当赋予用户一定的控制权利。《生成式人工智能服务管理暂行办法》第十一条规定:'提供者对使用者的输入信息和使用记录应当依法履行保护义务,不得收集非必要个人信息,不得非法留存能够识别使用者身份的输入信息和使用记录,不得非法向他人提供使用者的输入信息和使用记录。提供者应当依法及时受理和处理个人关于查阅、复制、更正、补充、删除其个人信息等的请求。'

基于此,产品设计需满足以下 PBD(Privacy by Design)合模需求:

功能点实现要求合规说明
清除上下文清除上下文后,重新开启对话,确保清除后上下文不再记忆关联提示词及答复需区分是清除问答原文内容,还是仅清除上下文的关联记忆
删除问答记录删除选择项或者同一智能体下的全部问答记录信息须同时清空上下文关联记忆
账号关联提示工程内容非和用户账号或相关标识实施绑定中国大模型须基于账号提供服务,此项合规在中国法环境下并不现实
分库保存提示工程内容本身具有一定的敏感性,可能会基于提示注入攻击而泄露宜私有数据库服务端独立保存,不被输出侧所调用
模型训练允许大模型将提示工程内容用于训练模型,优化用户体验获得用户的同意(opt-in)

截止目前,大模型提示工程已经从提示工程师职业,衍生发展出了一个庞大的商业模式,大量科技型企业进入提示工程领域创业。例如,promptperfect 已将提示工程 AI 化后作为插件嵌入大模型产品中的输入框之中。

在插件、SDK 或者 API 模式下的提示工程中,用户可以直接在任何可接入提示工程插件的大模型产品中调起提示词服务。例如在文心一言中,用户在输入框中可以直接@三方插件方式共同输入提示词。

法律定性 从法律定性上来看,提示工程服务属于独立的数据处理者,不仅要进行独立入驻身份标识,也需要独立向用户取得授权同意提示。如果提示工程服务本身属于基于大模型的生成服务,在中国法语境下还需要实施算法备案。退出中国市场的 promptperfect,兴许就是基于难以备案的原因。

02 检索增强生成

检索增强生成(RAG)是一种技术,它通过优化大型语言模型的输出,使其能够在生成响应之前引用训练数据来源之外的权威知识库。RAG 通过引入信息检索组件,利用用户输入从新数据源提取信息,并与 LLM 结合生成更好的响应。

有趣的是,香港隐私管理机构给 RAG 起了另一个通俗易懂的名字——接地(grounding),意思是将 AI 模型与可验证的现实世界的知识以及外部来源的范例联系起来的过程。

从技术原理来看,RAG 本身也是一种基于预训练的深度学习模型,旨在通过结合检索和生成的方式提高数据检索的精度和效率。

技术实现与合规 在预处理阶段,需要将外部数据源(通常表现为开发者平台中的'知识库')内容进行向量化并存储到向量数据库。比如对于大段法律法规文本数据来说,需要进行切分并得到许多文本块,对于每个文本块进行向量化并进行存储。

合规要点

  1. 数据版权:RAG 引用的外部数据必须拥有合法的使用权,避免侵犯第三方知识产权。
  2. 数据时效性:需建立定期更新机制,确保检索到的知识库内容是最新的,避免因过时信息导致误导。
  3. 访问控制:向量数据库应实施严格的权限管理,防止未授权访问敏感知识库。
03 微调

微调(Fine-tuning)是指在预训练模型的基础上,使用特定领域的额外数据(集)进行进一步训练,以使模型在该领域表现更佳。可以将微调看作是对大模型进行专门训练,使其在某些特定任务上更为精通。

想象你是一名数据合规律师顾问,正在为客户准备一份关于数据保护的详细报告。你可以首先通过提示工程设计出精确的问题:'请详细说明最新的 GDPR 修正案对跨境数据传输的影响。'接着,你可以利用微调过的大模型,该模型已经通过大量的内部数据保护法律文献数据集进行训练,能够提供非常专业和场景式回答。最后,使用 RAG 技术,模型会先检索最新的相关法律文献,确保提供的答案是基于最新的信息和法规。

通过这样综合应用,你不仅能够获得详细而专业的答案,而且答案还能够及时反映最新的法律动态。提示工程优化了问题的表达,微调提升了模型在特定领域的专业性,而检索增强生成则保证了信息的时效性和准确性。

备案与登记 而对于微调(Fine-tuning)而言,在中国意味着一个'相对全新'的大模型系统或产品。基于开源大模型微调场景就像是接入一个全新的未经评估的语料库,但这个语料库的数据集可能涉及到侵犯知识产权、个人信息或商业信息的可能性。

微调模式下,基于全新数据集的预训练后,其本质是新的大模型系统。我国的大模型备案区别为两种类型,一是备案,二是登记。前者是自研大模型,需要严格的备案程序,包括提交《生成式人工智能 (大语言模型) 上线备案表》、自评估报告以及测试题等;而后者的本质是'套壳',仅仅只是调用第三方大模型能力后提供自身的前端交互界面。

《北京市生成式人工智能服务已备案(登记)信息公告》指出:'对于通过 API 接口或其他方式直接调用已备案大模型能力的生成式人工智能应用或功能,按照国家有关规定,经北京市网信办同意,拟采用登记方式,允许上线提供服务。'因此,单纯'套壳'需要登记即可,微调仍然是需要实施备案。

整改义务 但需要说明的是,微调本身也可能是一项法律义务。《生成式人工智能服务管理暂行办法》第十四条规定:'提供者发现违法内容的,应当及时采取停止生成、停止传输、消除等处置措施,采取模型优化训练等措施进行整改,并向有关主管部门报告。'在此条件下,需要将自研模型微调和三方基于开源大模型微调场景进行区别。前者非常类似书籍出版后二次出版,或者是游戏出版后热更新版本迭代,既然在传统领域无须再申请版号,那么在产品自行微调条件下,自研微调大模型进行重新备案就显得有些多余了。

事实上,这对检索增强生成(RAG)这种接入大模型外部数据知识库而生成内容的模式而言,道理亦是同样的。但需要区别的是,检索增强生成(RAG)接入的是私有或本地知识库,如果只是面向内部提供使用可得法规豁免。

04 合规打补丁的逻辑与 Agent 工作流

从法律法规角度来看,不管是提示工程、微调还是检索增强生成,目前绝大部分的数据保护或人工智能法规一般只关注这类模式的安全性问题,而不是数据保护。

提示工程、微调以及检索增强生成各自均沿着不同的路径实现了发展和跃变。以提示工程为例,其已从最开始的单纯提示词发展出了诸多变种,而不同模式下,提示工程的法律性质以及数据合规均有本质差别。

Agent 工作流的复杂性 如果将上述三个补丁纳入形成 AI Agent 的工作流时,似乎将可能变得更加复杂,毕竟从补丁到流程,可能是质的飞跃。

在 Agent 工作流中,模型不仅需要具备生成能力,还需要具备规划、工具调用和记忆管理能力。这带来了新的合规挑战:

  1. 状态持久化:Agent 的记忆模块可能长期存储用户敏感信息,需符合最小化原则。
  2. 工具调用审计:Agent 调用的外部 API 接口需经过安全评估,防止数据泄露至不可信第三方。
  3. 决策可解释性:当 Agent 做出关键决策时,需提供可追溯的日志记录,以满足监管审计要求。
05 总结与建议

综上所述,大模型技术的合规建设是一个系统工程,涉及技术架构、数据处理和法律流程的多个层面。

  1. 分级分类管理:根据应用场景的风险等级,对提示工程、微调和 RAG 实施不同程度的合规审查。
  2. 全链路监控:建立从输入到输出的全链路日志监控体系,确保异常行为可被及时发现和处置。
  3. 持续合规培训:定期对开发团队进行数据安全与人工智能法规的培训,提升全员合规意识。
  4. 第三方评估:在模型上线前,引入第三方专业机构进行安全评估和合规检测,降低法律风险。

随着技术的演进,大模型合规标准也将不断完善。企业和开发者应保持敏锐的政策嗅觉,及时调整技术路线,确保在创新的同时守住合规底线。

目录

  1. 01 提示工程
  2. 02 检索增强生成
  3. 03 微调
  4. 04 合规打补丁的逻辑与 Agent 工作流
  5. 05 总结与建议

更多推荐文章

查看全部
  • Ubuntu 22.04 配置 VMware 共享文件夹实战指南
  • JDK 8、JDK 17 与 JDK 19 版本特性及性能对比
  • 链表分割算法实战:以指定值划分节点顺序
  • 在浏览器中运行 Python:Pyodide 实战指南
  • 无项目经验如何转行 AIGC 产品经理:职责、技能与成长路径
  • Flutter WebView 在 iOS 18.2 上点击失效问题分析与解决方案
  • 基于 Continue 插件本地部署 AI 代码助手替代 Cursor 或 Copilot
  • AI 辅助游戏开发:基于 DeepSeek 构建贪吃蛇游戏
  • 多模态模型开发实战:文本、图像与语音融合应用
  • 使用 Java 将 PDF 转换为 Excel:基础转换与高级设置
  • Mac 抹除重装卡在激活锁的两种解锁方案
  • 2024 年医疗 AI 行业趋势与未来发展解析
  • RAG 在大模型中的角色:高效文档切分与长上下文探讨
  • 循环神经网络(RNN)与序列数据处理实战
  • 算法优选技巧:位运算实战解析
  • 前端开发中 dist 目录详解:概念、配置与部署
  • 人工智能与大模型核心技术体系及学习路径指南
  • Flutter 投票系统:数据统计与排序算法深度解析
  • Ubuntu20.04 + ROS Noetic + Gazebo 实现 UR5 机械臂视觉抓取乐高积木仿真
  • 文心一言开源模型部署与多维测评实例

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • Base64 字符串编码/解码

    将字符串编码和解码为其 Base64 格式表示形式即可。 在线工具,Base64 字符串编码/解码在线工具,online