跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客GitHub 精选镜像AI 生图工具UI配色美学隐私政策关于联系
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

Langchain-Chatchat 项目搭建指南

Langchain-Chatchat 项目支持两种搭建方式:命令行与网页端。核心流程包括创建 Conda 环境、安装 Xinference 框架、加载 LLM 及 Embedding 模型、配置 Chatchat 参数及启动服务。命令行方式需手动执行 pip 安装与模型加载命令,网页方式则通过 Xinference UI 操作模型注册。配置阶段需注意 model_settings.yaml 中的模型名称匹配及知识库路径设置。若遇到对话功能异常,建议检查 xinference 版本兼容性并进行降级处理。

t ag发布于 2025/2/8更新于 2026/7/3036 浏览
Langchain-Chatchat 项目搭建指南

方式一:通过命令方式搭建

搭建该项目分为两部分:安装 xinference 框架以载入 LLM 和嵌入模型,以及配置 Langchain-Chatchat 项目。

第一步:创建 xinference 的 conda 环境

conda create -n xinference python=3.10

进入该环境:

conda activate xinference

第二步:安装 xinference 框架

pip install "xinference[transformers]" -i https://mirrors.tuna.tsinghua.edu.cn/pypi/web/simple

拉起 xinference 服务:

XINFERENCE_HOME=自定义路径 xinference-local --host 0.0.0.0 --port 9997

详细信息请查看 xinference 官网。注意不同模型要求的引擎可能不同(如 Transformers),请根据模型查询官方文档。

第三步:装载 LLM 模型

确保模型文件完整后再加载。使用本地下载模型或参考官网自动下载。

xinference launch --model-engine Transformers --model-name qwen-chat --size-in-billions 7 --model-format pytorch --quantization none --model_path ~/.cache/modelscope/hub/Qwen/Qwen-7B-Chat

参数说明:

  • --model-name:固定为模型注册名,不可随意更改。
  • --model_path:本地模型存储路径,若使用 modelscope 下载通常在 ~/.cache/modelscope/hub 下。
  • --model-engine:在 xinference 管理页面查看对应引擎类型。

第四步:装载嵌入模型

例如使用 bge-large-zh-v1.5:

xinference launch --model-name bge-large-zh-v1.5 --model-type embedding --model_path ~/.cache/modelscope/hub/Xorbits/bge-large-zh-v1.5

第五步:创建 chatchat 的环境

conda create -n chatchat python=3.10
conda activate chatchat

第六步:安装 Langchain-Chatchat 项目

pip install "langchain-chatchat[xinference]" -U -i https://mirrors.tuna.tsinghua.edu.cn/pypi/web/simple

第七步:初始化项目配置与数据目录

设置 Chatchat 存储配置文件和数据文件的根目录(可选):

# Linux or macOS
export CHATCHAT_ROOT=/path/to/chatchat_data

# Windows
set CHATCHAT_ROOT=/path/to/chatchat_data

若不设置环境变量,则自动使用当前目录。

第八步:执行初始化

chatchat init

该命令会创建数据目录、复制知识库内容并生成默认 yaml 配置文件。

第九步:修改配置文件

配置模型(model_settings.yaml) 根据步骤中使用的模型推理框架与加载模型进行配置,主要修改以下内容:

DEFAULT_LLM_MODEL: qwen1.5-chat
DEFAULT_EMBEDDING_MODEL: bge-large-zh-v1.5

在 MODEL_PLATFORMS 中修改对应模型平台信息。

配置知识库路径(basic_settings.yaml) 默认知识库位于 CHATCHAT_ROOT/data/knowledge_base。如需修改存储位置或数据库连接 URI,可在此调整。

配置知识库(kb_settings.yaml) 默认使用 FAISS 知识库,如需切换其他类型可修改 DEFAULT_VS_TYPE 和 kbs_config。

第十步:初始化知识库

chatchat kb -r

第十一步:启动项目

chatchat start -a

启动成功后应显示 Web 界面。

注意事项: 若部署后无法对话,可能是 xinference 版本兼容性问题,建议降低 xinference 版本至稳定版(如 0.15.3)。

pip install xinference==0.15.3 -i https://mirrors.tuna.tsinghua.edu.cn/pypi/web/simple

方式二:通过网页搭建

使用网页搭建与命令方式类似,区别在于通过 Xinference 网页界面装载模型。

  1. 安装并拉起 Xinference 服务:
    XINFERENCE_HOME=自定义路径 xinference-local --host 0.0.0.0 --port 9997
    
  2. 访问 http://127.0.0.1:9997/ui。
  3. 在网页中注册模型,选择引擎并点击 Run 加载。
  4. 嵌入模型加载方式类似。
  5. 后续步骤(环境创建、安装、配置、启动)与命令方式一致。

目录

  1. 方式一:通过命令方式搭建
  2. 第一步:创建 xinference 的 conda 环境
  3. 第二步:安装 xinference 框架
  4. 第三步:装载 LLM 模型
  5. 第四步:装载嵌入模型
  6. 第五步:创建 chatchat 的环境
  7. 第六步:安装 Langchain-Chatchat 项目
  8. 第七步:初始化项目配置与数据目录
  9. Linux or macOS
  10. Windows
  11. 第八步:执行初始化
  12. 第九步:修改配置文件
  13. 第十步:初始化知识库
  14. 第十一步:启动项目
  15. 方式二:通过网页搭建
  • 免费图片AI生成工具免费生成了解详情
  • Magick API 一键接入全球大模型注册送1000万token查看
  • 免费图片视频在线生成30秒,将你的创意变成现实开始设计
  • X/Twitter免费视频下载器免登陆无限额度免费视频解析下载了解详情
  • 100+免费在线小游戏爽一把
极客日志微信公众号二维码

微信扫一扫,关注极客日志

微信公众号「极客日志V2」,在微信中扫描左侧二维码关注。展示文案:极客日志V2 zeeklog

更多推荐文章

查看全部
  • Arch Linux 安装 Niri 桌面环境完整指南
  • 15 个值得收藏的前端开源项目推荐
  • GitHub 国内镜像站汇总与加速配置指南
  • Open-AutoGLM 开源模型下载与本地运行配置
  • OpenClaw + GitHub Copilot GPT-5.4 技术修复指南
  • 打造你的家庭 AI 助手(四):单 OpenClaw 配置多 Agent、多 QQ、飞书机器人
  • Python 制作大麦网抢票程序
  • AI 变现误区解析:为何掌握工具不等于获得收益
  • Qwen3-ASR 开源语音识别模型架构与使用指南
  • 精选 GitHub 开源量化交易系统与工具推荐
  • WorkBuddy 安装使用完全指南:腾讯 AI 桌面智能体工作台
  • 国内 GitHub 镜像方案:Gitee、华为云与腾讯云加速实践
  • Kubernetes 企业级云原生运维实战:AIGC 智能重构与实践
  • 手机检测系统上传失败重试机制与用户体验优化
  • ComfyUI:AI 绘画与图像生成的高效工作流指南
  • 3 款免费 AI 视频修复工具,有效提升视频画质
  • Python 编码风格与规范
  • Ubuntu 与 Windows 系统实现共享文件夹
  • Mac Mini 部署 OpenClaw 实战指南
  • 无人机飞行空域申请全流程指南

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online