
Kotaemon:基于 RAG 技术的多语言模型问答系统
Kotaemon 是一款基于检索增强生成(RAG)技术的开源工具,旨在通过自然语言交互实现文档的高效检索与理解。该系统支持多种大语言模型 API,包括 OpenAI、Azure OpenAI 及本地部署模型,并提供混合检索管道以优化查询质量。其核心功能涵盖文档管理、多用户协作、多模式内容解析(图表与表格)以及基于 Gradio 的可扩展 UI 定制。用户可通…
博客作者
一尘不染
360
已发布文章
12K
博客获赞
651K
博客浏览
第 17 页

Kotaemon 是一款基于检索增强生成(RAG)技术的开源工具,旨在通过自然语言交互实现文档的高效检索与理解。该系统支持多种大语言模型 API,包括 OpenAI、Azure OpenAI 及本地部署模型,并提供混合检索管道以优化查询质量。其核心功能涵盖文档管理、多用户协作、多模式内容解析(图表与表格)以及基于 Gradio 的可扩展 UI 定制。用户可通…

从计算视角深入解析大型语言模型(LLM)的内部结构,涵盖张量形状(Tensor Shape)、Embedding 层、多头注意力机制(MHA)及前馈神经网络(MLP)的输入输出数据结构与计算量分析。详细阐述了各算子的矩阵运算逻辑、维度变换过程及浮点运算次数估算,帮助读者建立对 LLM 推理过程中数据流转与计算负载的直观理解。文中还补充了 PyTorch 代码…

对初学者如何系统入门大语言模型提供了详细指南。首先强调了仅调用 API 的局限性,主张从开源模型入手理解原理。文章涵盖了编程基础准备,包括熟练使用 Python 进行数据处理与可视化(Matplotlib),以及掌握 PyTorch 深度学习框架中的关键操作(如 Embedding、矩阵运算、Mask 计算、位置编码相关函数等)。随后介绍了大模型核心原理,涉…

介绍向量数据库的概念及其与大语言模型(LLM)的集成方法。通过向量嵌入技术,将非结构化数据转化为高维向量,解决 LLM 知识滞后和幻觉问题。文章对比了向量数据库与传统数据库的差异,详细解析了索引策略如 HNSW 和 IVF 的性能优化方案。实战部分展示了基于 Falcon-7B 模型和 ChromaDB 构建封闭式问答机器人的流程,涵盖环境配置、知识库构建及…

介绍如何利用 Ollama 本地部署的大模型服务,结合 TypeScript 开发 VS Code 插件,实现私有化的代码补全功能。方案涵盖环境准备、插件架构设计、核心代码实现及 API 交互细节。通过本地运行模型保障数据隐私,支持自定义提示词模板,并可进一步结合 RAG 技术增强代码理解能力。

全面解析大模型算法面试所需的核心知识体系,涵盖 Transformer 架构、注意力机制、分布式训练技术(数据/流水线/张量并行)、微调方法(LoRA/SFT)、推理优化(vLLM/量化)、RLHF 及 RAG 技术等。文章详细阐述了数据集选择、显存优化策略及模型评估方法,并结合 LangChain、思维链等实际应用案例,提供从基础理论到工程落地的完整学习路…

详细阐述了大模型产品经理转行的核心技能要求、自我评估维度、系统学习路径及实战场景挖掘方法。内容涵盖 Transformer 原理、Prompt Engineering、RAG 架构、LangChain 框架等技术知识点,同时分析了行业应用案例与团队协作策略。文章强调了对 AI 技术的深入理解、数据洞察力及用户同理心的重要性,并提供了具体的学习资源与实践建议,…

探讨了生成式人工智能与大模型技术如何重构教育行业。文章分析了 AI 在平衡教育公平与个性化学习中的作用,指出大模型能通过类脑智能机制模拟人类学习过程,实现能力涌现。通过对比传统学习机与新一代 AI 学习设备,阐述了硬件转型如何提升学习效率。文中强调 AI 在教育中应扮演辅助角色,无法替代人类教师在情感与价值观引导上的作用。最后讨论了教育普惠的实现路径,包括资…

谷歌发布的 Gemma 开源模型,涵盖 2B 和 7B 两种尺寸。通过对比测试展示了其在知识储备、逻辑推理及文本理解方面的表现,指出其性能优于部分同量级模型。文章详细说明了本地部署所需的硬件配置,并提供了基于 Ollama 的一行代码部署方案及常用指令,同时整理了官方微调与开发资源链接,适合希望快速体验本地大模型的用户参考。

针对程序员面临的 35 岁职业危机,从技术深耕、管理转型及副业增收三个维度提供应对策略。建议通过系统学习核心编程语言夯实基础,结合行业趋势向管理层或架构师方向发展,同时谨慎拓展副业渠道以分散风险。强调持续学习与综合能力的提升是突破年龄瓶颈的关键。

介绍 Python3 中整型、浮点型和布尔型的基本运算规则。涵盖数学运算、位运算、比较逻辑运算及赋值运算。重点解析整除与幂运算的区别,浮点数精度问题,布尔值转换规则,以及逻辑运算符的正确用法。通过代码示例展示各类运算的实际效果,帮助初学者掌握基础数据类型操作。

DSPy 是一个用于编程而非提示的大型语言模型框架,旨在自动化优化提示词和响应。 DSPy 的核心概念,包括分离流程与参数、引入优化器以及如何使用签名和预测器。通过配置环境、加载数据、定义检索增强生成管道以及设置评估指标,展示了如何利用 DSPy 构建高效的问答系统。文章涵盖了从基础环境搭建到自定义数据加载、思维链应用及模型优化的完整流程,帮助开发者摆脱手动…

梳理了百度文心一言、科大讯飞星火、阿里通义千问等国内主流大模型,以及 OpenAI GPT 系列、Claude 系列、Meta Llama 系列等国外代表性模型的技术特点与应用场景。文章分析了算力提升、多模态支持及开源协同等技术发展趋势,探讨了 RAG 架构、零代码平台在大模型企业知识库构建中的实际价值,并展望了未来人机交互与行业落地的方向。

详细解析了大模型二次开发的四个关键阶段:增量预训练、有监督微调、奖励模型对齐及人类反馈强化学习。重点阐述了 SFT、RLHF 与 DPO 的技术差异,并深入探讨了持续学习中的 Prompt-based、Representation-based 及 Model Mixture 三种主流方法及其优缺点。内容涵盖从领域知识注入到偏好对齐的完整技术路径,以及部署时的…

基于对美国就业市场超千万职位数据的分析,总结了 2023 年收入最高的十大编程语言。调研显示 Python 以平均 18.8 万美元年薪位居榜首,主要得益于其在人工智能和数据科学领域的广泛应用。Solidity 和 Rust 因区块链及系统级开发的人才稀缺性,薪资分别达到 17.7 万和 15.6 万美元。Java、Swift、Go 等主流语言也保持了稳定的…

企业数据常以多模态形式存在,传统文本嵌入无法有效处理图像。通过引入多模态嵌入模型,可直接对文字与图像生成统一向量,存入单一向量空间。文章展示了利用 LlamaIndex、Cohere 多模态嵌入模型及 Qdrant 向量库构建 RAG 应用的实例。该方法支持文本到图像、图像到图像的混合检索,简化了索引流程并降低了成本,提升了跨模态检索精度与响应质量,适用于企…

在 Intel 芯片 Mac 上安装 Stable Diffusion WebUI 的详细步骤,包括环境配置、依赖安装、模型部署及运行参数设置。重点解决了旧款 Mac 无法使用 GPU 的问题,通过 Conda 管理 Python 版本并配置 CPU 计算模式,确保用户能够顺利启动本地 AI 绘图服务。

对 Stable Diffusion WebUI 生态中的 16 款常用插件进行了详细测评与推荐。内容涵盖环境准备、通用安装流程以及各插件的功能解析。重点介绍了 prompt-all-in-one 提示词辅助、After Detailer 面部修复、Ultimate SD Upscale 高清放大、Openpose 姿态控制等核心工具的使用场景与优缺点。文章…

基于 GPT-4 和 ChatGPT 的大模型应用开发入门指南。内容涵盖 Python 开发环境搭建、OpenAI API 基础调用方法、提示词工程最佳实践、LangChain 框架的使用以及模型微调与部署流程。通过代码示例和步骤解析,帮助开发者快速上手构建智能应用,解决实际业务需求。

LangGraph Studio 这一用于可视化调试基于 LangGraph 构建的 AI 智能体的集成开发环境。文章首先回顾了 LangGraph 的核心特性,如基于图结构的工作流、状态持久化及循环控制,并提供了构建简单搜索增强智能体的完整代码示例。接着详细阐述了 LangGraph Studio 的安装配置、项目结构要求及 Docker 部署流程。重点讲…