
基于 LangChain 构建具备记忆功能的聊天机器人
如何使用 LangChain 框架开发一个支持多轮对话记忆的聊天机器人。内容涵盖环境搭建、基础模型调用、消息历史管理、提示词模板设计、上下文窗口优化以及流式输出实现。通过引入 RunnableWithMessageHistory 和自定义过滤函数,解决了模型无状态问题并有效控制了 Token 消耗,同时提供了持久化存储和错误处理的扩展建议,帮助开发者快速构建…
博客作者
内核研究爱好者
354
已发布文章
10K
博客获赞
801K
博客浏览
第 17 页

如何使用 LangChain 框架开发一个支持多轮对话记忆的聊天机器人。内容涵盖环境搭建、基础模型调用、消息历史管理、提示词模板设计、上下文窗口优化以及流式输出实现。通过引入 RunnableWithMessageHistory 和自定义过滤函数,解决了模型无状态问题并有效控制了 Token 消耗,同时提供了持久化存储和错误处理的扩展建议,帮助开发者快速构建…

基于大语言模型(LLM)的智能运维 Agent 系统的设计与实现。系统采用多 Agent 协同架构和事件驱动模式,包含监控分析、故障诊断、执行操作、决策协调及知识管理等核心模块。技术栈涵盖 Kubernetes、Kafka、LangChain 及 Python。核心功能实现了基于 RAG 的智能故障诊断、Prometheus 告警处理及 K8s Operat…

Ollama 是一款用于本地运行大语言模型的开源工具,支持多种操作系统。详细阐述了在 Linux 环境下通过脚本或离线包安装 Ollama 的步骤,涵盖环境变量配置、服务启动及模型管理命令。此外,还介绍了如何通过 Modelfile 自定义模型参数以及利用本地 API 进行交互,帮助开发者快速构建私有化 AI 应用环境。

ChatGPT 插件数量近期增长显著,总数达 390 个。利用 AI Agents 配合联网插件实现自动写书的玩法,并针对 ChatGPT 无法感知实时插件信息的痛点,提出了两种解决方案:一是借助联网插件读取外部数据,二是通过思维链提示词分批发送数据。实测表明,这两种方法均能让 ChatGPT 识别并使用插件,但需注意上下文长度管理和模型选择。此外,文章还指…

探讨了确保大型语言模型输出结构化 JSON 格式的三种主要策略:推理前的提示词工程、推理中的动态限制解码以及推理后的数据后处理。文章分析了 LLM 概率生成特性导致的格式错误原因,对比了 OpenAI 等厂商的方案,并提供了基于 Sglang 库的本地部署代码示例。通过实验验证,动态限制解码可实现 100% 格式合规,而提示词优化可将成功率提升至 95%。文…

AI产品经理在电信行业需掌握需求处理、市场调研、产品设计及数据驱动等全流程技能。通过KANO模型、PEST分析等方法挖掘用户痛点,结合MVP验证与A/B测试优化体验。强调跨部门协作与持续学习,利用机器学习与大数据技术推动产品智能化升级,实现商业价值与技术落地的平衡。内容涵盖需求评估、可行性分析、竞品分析及数据回馈机制,旨在构建完整的AI产品方法论体系。

DeepSeek-R1 和 Kimi-1.5 均采用基于规则的奖励机制替代传统的过程奖励模型,强调结果导向。DeepSeek 采取两阶段训练策略,先通过无监督强化学习提升推理能力,再进行有监督微调;Kimi 则在一阶段训练中同步监控输出质量。两者均观察到模型涌现出反思能力,这可能与输出长度增加及探索行为有关。文章探讨了小模型蒸馏与大模型规则强化学习的适用性差…

汇总了字节跳动、饿了么、网易伏羲、好未来等大厂 AGI 与大模型算法岗位的面试经验。内容涵盖多模态算法、AIGC 实习生的一二面流程,重点记录了关于 Transformer 结构、位置编码、RLHF、RAG、DDPM 等技术问题的考察,以及字符串旋转、岛屿数量、组合总和等算法题。文章同时补充了核心知识点的详细解析,旨在帮助求职者系统复习大模型相关理论与工程实…

13 款程序员常用的开发工具,涵盖代码编辑、版本控制、容器化部署、API 测试、项目管理及持续集成等领域。包括 Visual Studio Code、Git、Docker、Postman 等工具的详细功能说明与使用示例,旨在帮助开发者提升工作效率并规范开发流程。文章还补充了各工具的适用场景、配置建议及最佳实践,并提供了关于如何构建个性化工具链的总结建议,帮助…

详细分析了大模型中 Attention 机制面临的计算复杂度高、显存占用大及串行解码限制等问题。介绍了包括稀疏 Attention、矩阵分解、局部敏感哈希、Kernel Attention、KV-Cache、Multi-Query Attention (MQA)、Grouped-Query Attention (GQA) 及 FlashAttention 在…

针对考公群体普遍存在的心理压力与现实困境,公务员岗位的真实稳定性、晋升天花板及薪资现状,指出盲目追求上岸可能带来的机会成本与身心健康风险。结合程序员背景,探讨了在智力与情商评估基础上的职业选择策略,并提供了技术路线下的自我提升与副业发展建议,旨在帮助读者认清自身优势,做出更理性的职业规划。文章强调不应与弱项死磕,而应发掘自身优势,通过建立个人品牌、参与开源等…

探讨了 Agent 开发的三个演进层次。第一阶段将 LLM 视为理解语义的 API,主要用于文本生成和总结;第二阶段将其作为自然语言编程工具,支持 Function Calling 和工具调用,实现业务流程自动化;第三阶段则是真正的智能体开发,采用多 Agent 协作、规划与执行(Plan-and-Execute)等模式,赋予其自主决策能力。文章详细分析了各…

Hugging Face 团队基于 DeepMind 研究,开源了扩展测试时计算的方法。通过在 Llama 1B 和 3B 模型上应用多样化验证器树搜索(DVTS)等策略,小模型在数学基准测试中的表现显著超越更大参数量的模型,甚至超过计算机科学博士生平均水平。文章详细对比了 Best-of-N、Beam Search 与 DVTS 三种搜索策略的实验结果,指…

如何使用 Python 的 python-pptx 库进行 PPT 自动化办公。内容包括环境安装、基础 API 操作(创建演示文稿、添加幻灯片、设置文本、插入图片与表格)、以及基于 Excel 数据的批量生成实战方案。文章提供了完整的代码示例,涵盖错误处理、字体设置及性能优化建议,旨在帮助读者快速掌握利用编程手段替代人工重复性 PPT 制作任务的方法。

18 款适用于产品经理的 AI 工具,涵盖搜索、写作、数据分析等场景。同时提供了需求文档、流程图、周报及竞品分析四大核心提示词模板,帮助提升工作效率。内容包含工具特性解析及 Prompt 使用指南,旨在辅助产品人员利用人工智能优化工作流。文章还补充了 AI 辅助工作的最佳实践原则,强调明确指令、人工复核及隐私保护的重要性。

提供网络安全入门的系统学习路线,涵盖计算机基础、编程语言选择、法律法规认知及常用安全工具的使用。内容包含操作系统原理、网络协议、Linux 命令、Web 框架、数据库语法以及 Python 和 Shell 脚本编写建议。同时介绍了 OWASP Top10 漏洞类型及 Nmap、BurpSuite 等渗透测试工具的基本应用场景,旨在帮助初学者建立扎实的安全知识…

探讨了从非计算机专业转行网络安全的可行性与路径,分析了行业人才缺口及薪资前景。内容涵盖零基础学习策略、核心安全知识点(如 SQL 注入、文件上传漏洞、Redis 配置等)以及面试常见问题的应对技巧。通过分享实际案例与学习心得,为希望进入网络安全领域的从业者提供系统性的参考指南,强调逻辑思维与持续实践的重要性。

大模型训练数据白皮书于第七届数字中国峰会发布,指出大模型是数据要素价值释放的最短路径。文章分析了训练数据类型、高质量数据标准、合成数据方案及治理思路。强调通过政府与社会力量协同构建数据生态,解决数据供给不足问题,推动人工智能健康发展。

网络安全旨在保护系统硬件、软件及数据免受破坏和泄露。文章介绍了 CISO、安全架构师、渗透测试员等十二个核心岗位的职责,详细阐述了网络协议、编程语言、逆向工程、AI 及大数据分析等关键技能要求。针对零基础学习者,提供了涵盖计算机网络、操作系统、算法数据结构的基础学习路径,并给出了 Shell 和 Python 的代码示例。文章还对比了自学与专业培训两种学习方…

提供网络安全自学路径,涵盖操作系统、编程语言、数据库及 Web 安全基础。内容包含 Linux 命令、Python 脚本编写、常见漏洞原理及防御策略,旨在帮助初学者建立知识框架,通过分阶段学习掌握渗透测试技能,为从事安全研发或渗透测试岗位做准备。