
利用 GraphRAG + GLM-4 构建《红楼梦》全文的中文增强检索系统
基于 graphrag-practice-chinese 项目,结合 GLM-4 大语言模型,实现了针对《红楼梦》全文的 GraphRAG 中文增强检索系统。通过优化文本切分策略、替换英文提示词为中文以及适配国内大模型接口,解决了原生 GraphRAG 对中文支持不足的问题。文章详细阐述了环境搭建、配置文件修改、索引构建及全局与本地查询测试的全过程,并对比了…
博客作者
岁月静好
347
已发布文章
11K
博客获赞
911K
博客浏览
第 16 页

基于 graphrag-practice-chinese 项目,结合 GLM-4 大语言模型,实现了针对《红楼梦》全文的 GraphRAG 中文增强检索系统。通过优化文本切分策略、替换英文提示词为中文以及适配国内大模型接口,解决了原生 GraphRAG 对中文支持不足的问题。文章详细阐述了环境搭建、配置文件修改、索引构建及全局与本地查询测试的全过程,并对比了…

2025 年大模型技术浪潮席卷全球,企业对 AI 人才需求激增。梳理了 NLP、CV、多模态等主流大模型分类,并制定了从基础系统到行业应用的七阶段学习路线。涵盖提示词工程、LangChain 开发、模型微调及部署实战,旨在帮助开发者掌握全栈大模型技能,适应未来软件重构趋势。文章详细分析了不同背景人群的学习方案及岗位薪资前景,提供了 Python 环境与 La…

基于 Anthropic 官方经验,详细解析了 AI Agent 的构建范式与技巧。文章首先区分了智能体与工作流程的定义,指出应在需要灵活性和模型驱动决策时使用智能体。接着深入探讨了七种核心工作流模式,包括增强型 LLM、提示词连接、自动路由、并行化、协调器 - 工作器、评估器 - 优化器及自主智能体,并结合具体场景说明了适用条件。文中还提供了 Python…

介绍利用 LangChain 框架结合 ChatGLM 大模型构建私有化本地知识库问答系统的完整方案。内容涵盖环境准备、文本数据加载与切分策略、Embedding 生成方式对比(OpenAI 与 HuggingFace)、向量数据库选型(Chroma 与 FAISS)以及检索增强生成链路的实现细节。通过本地部署模型,有效避免调用外部 API,保障数据安全并降…

Flutter 作为跨平台移动应用开发框架的核心优势,包括高性能渲染引擎、单一代码库跨平台能力、丰富 UI 组件及活跃社区生态。同时梳理了从 Dart 语言基础到 Flutter 实战项目的完整学习路径,涵盖异步编程、网络请求、状态管理及核心原理等关键知识点,为开发者提供系统化的入门与进阶参考。

基于 LangChain 和 FastAPI 搭建 RAG(检索增强生成)知识库的完整流程。内容涵盖 RAG 技术原理、文档加载与切片、向量数据库构建、Prompt 设计及代码实现。通过具体示例展示了如何快速构建一个支持自然语言问答的服务端,并提供了环境依赖、QA 组织方式及测试方法。文章最后总结了知识库动态更新、混合检索、系统扩展性等优化方向,旨在帮助开发…

Mem0 是一款由 YC 孵化的开源技术,旨在为大语言模型和 AI 代理提供长期记忆能力。相比传统 RAG 方案,Mem0 通过关注实体关系、上下文连续性和自适应学习,实现了跨应用的个性化 AI 体验。 Mem0 的核心架构、与 RAG 的关键区别、Python 环境下的安装配置方法、API 使用示例以及高级应用场景,帮助开发者构建具备持久记忆的智能应用系统…

Hugging Face Transformers 库提供了丰富的预训练模型和简洁的 API,大幅降低了自然语言处理及多模态任务的开发门槛。该库的核心功能模块,包括利用 Pipelines 快速执行文本分类、问答等任务,使用 Tokenizer 进行文本编解码,以及通过 Models 接口加载保存模型。文章阐述了其在跨框架兼容性、社区支持及灵活定制方面的优势…

DeepSeek-V3 采用 MoE 架构,结合 MLA 注意力机制与 FP8 混合精度训练,在保持高性能的同时显著降低训练成本。模型通过动态负载均衡策略优化专家路由,利用多 Token 预测加速收敛。实测显示其在编程、数学及多语言任务上表现卓越,部分能力媲美闭源大模型,且支持超长上下文处理。

如何使用 LangGraph 构建具备状态管理和循环计算能力的 AI 智能体。通过太阳能板节能计算示例,演示了从环境配置、工具定义、状态管理到图结构构建的完整流程。内容涵盖 LangChain 集成、AWS Bedrock 模型调用、错误处理机制及对话持久化策略,帮助开发者掌握复杂多步任务编排技术,实现可交互、自适应的企业级 AI 应用开发。重点讲解了 St…

2024 年中国 AI+ 营销进入数字营销 3.0 时代,核心特征包括 AI 成为必备能力、融入工作流程及个体化营销等。报告概括了八大趋势,涵盖内容消费变化与媒体通路演变。针对企业落地,提出组织能力升级与数据基础建设建议,为战略指导与实践路径提供全面支持。文章详细解析了技术架构参考,包括 Python 代码示例及模型部署方案,强调数据治理与隐私合规的重要性。

大模型应用开发的核心技术体系,涵盖 GPT-4 与 ChatGPT 原理、文本生成、问答系统及内容摘要等应用场景。重点讲解了提示工程优化、模型微调方法及 LangChain 框架在构建应用中的作用。文章梳理了从系统设计、提示词工程到垂直领域微调的完整学习路径,旨在帮助开发者掌握大模型全栈技能,解决实际项目需求并实现行业落地。

MaxKB v1.4.0 版本正式发布,社区版新增 OpenAI、Ollama 及本地向量模型支持,允许设置模型权限并支持知识库自定义向量模型以优化索引和召回率。专业版引入 X-Pack 增强功能,涵盖自定义 Logo 主题、LDAP 认证、开放 API 及对话框个性化设置。更新还包含文档索引流程优化、分段长度调整、应用关联限制及多处 Bug 修复,提升了系…

Python 中文分词库 Jieba 的核心功能与使用方法。内容包括安装配置、四种分词模式(精确、全模式、搜索引擎、Paddle 模式)的区别与应用场景、自定义词典的添加与管理、关键词提取算法(TF-IDF 与 TextRank)的使用、词性标注及分词位置定位。此外,文章还补充了性能优化建议和最佳实践,帮助开发者高效利用 Jieba 进行文本分析与 NLP…

Python 字符串格式化 % 运算符详解。涵盖类型码 %s/%d/%f 用法,精度控制 .precision,宽度与对齐 flags 参数设置。包含字典与元组格式化示例,对比现代 f-string 写法,解析常见错误及最佳实践。

Python 基础语法,涵盖基本数据类型(int、float、str、bool 等)、命名规范、注释方法、常用运算符及优先级。详细讲解了变量赋值、元组与列表的区别及转换、条件判断语句(if/elif/else)和循环结构(for/while)。此外还包含文件操作的基础知识,包括打开模式(r/w/a)及读写实例,适合初学者快速掌握 Python 核心概念。

详细介绍在 AutoDL 云端平台部署 Stable Diffusion WebUI 的全流程。从账号充值、GPU 算力选型到镜像创建与启动命令配置,提供完整的操作指引。重点解析启动参数含义、成本控制策略及常见报错解决方案,帮助用户以低成本方式体验 AI 绘图功能,无需依赖本地高性能硬件即可完成文生图任务。

详细阐述了大模型学习的五个进阶阶段,从基础概念认知到本地环境搭建,再到应用开发、业务整合及深度定制。文章提供了具体的技术要点,如 LangChain 框架使用、Agent 工具集成、Python 代码示例以及生产环境的注意事项。同时梳理了包含概念理解、模型选型、部署、数据处理、推理解析、项目实战及持续优化的七步学习路线,帮助开发者系统掌握大模型技术并应用于实…

计算机科学与技术学科广泛,自学需系统规划。提出六步自学法:设定清晰目标、掌握算法数据结构等核心概念、构建系统化学习路径、利用优质在线资源、注重实践与项目应用、加入技术社区交流经验。推荐从 Python 等易上手语言入门,结合理论代码练习巩固基础。强调持续努力与独立思考,避免盲目跟风,通过合理路径提升就业竞争力与技术深度。

Python 学习需要明确目标方向,掌握基础语法如变量、流程控制、函数及面向对象编程。初学者常犯缩进、符号混用等错误,需通过大量动手练习巩固知识。建议结合数据分析、Web 开发或自动化测试等实际项目提升技能,避免盲目照搬他人路线。详细梳理了学习路径、核心知识点、常见错误及练习方法,帮助新手建立系统的认知体系。