
深度解读国产大模型Kimi:功能、使用与背景分析
深度解析了国产大模型 Kimi 的核心功能、使用技巧及背后团队背景。Kimi 由月之暗面开发,主打 200 万字超长上下文、文件解析及联网搜索能力,适合处理长文档和实时信息查询。文章详细介绍了 Prompt 工程的最佳实践,如明确指令、分步提问和利用上下文,并与 GPT-4 进行了多维度对比。同时回顾了月之暗面创始团队的学术背景、战略选择及融资历程,分析了其…
博客作者
开源社区贡献者
363
已发布文章
11K
博客获赞
897K
博客浏览
第 17 页

深度解析了国产大模型 Kimi 的核心功能、使用技巧及背后团队背景。Kimi 由月之暗面开发,主打 200 万字超长上下文、文件解析及联网搜索能力,适合处理长文档和实时信息查询。文章详细介绍了 Prompt 工程的最佳实践,如明确指令、分步提问和利用上下文,并与 GPT-4 进行了多维度对比。同时回顾了月之暗面创始团队的学术背景、战略选择及融资历程,分析了其…

大语言模型(LLM)推理过程涉及分词、嵌入、注意力机制及自回归生成等核心步骤。文章以 LLAMA 模型为例,解析了 Transformer 解码器结构、Tokenization 分词、Embedding 嵌入层、位置编码、多头自注意力机制(MHA)及 RMSNorm 归一化等技术细节。同时阐述了从输入预处理、模型前向传播到 logits 后处理采样的完整 P…

深入探讨了 AI 产品经理如何理解大模型的技术边界与工程化落地。文章分析了大模型在成本、性能、窗口大小及稳定性方面的固有局限,指出单纯依赖模型无法解决所有问题,需结合工程手段如 RAG、Agent 工作流进行优化。同时从媒介理论角度阐述了 AIGC 在跨模态内容生产中的价值,强调数据质量与业务场景的重要性。最后为产品经理提供了调用 API、设计 Agent…

如何在 OpenCV C++ 中使用 FileStorage 类进行 XML 和 YAML 文件的读写操作。内容包括基础数据类型、OpenCV 数据结构(如 Mat)、容器(Map 和 Seq)以及自定义数据结构的序列化与反序列化方法。文章提供了完整的代码示例,演示了如何打开文件、写入数据、遍历节点以及处理缺失节点的情况,并解释了不同文件格式扩展名的作用及压…

Awesome-Chinese-LLM、Transformers-Tutorials、StoryDiffusion、TimesFM 等开源项目,涵盖中文大语言模型底座、垂直领域微调、图像视频生成及时间序列预测。内容包含各项目的核心功能、技术特点及应用场景,并提供从基础理解到私有化部署的系统学习路径建议,帮助开发者快速掌握大模型技术栈。

如何在本地环境中使用 Docker 部署 Ollama 和 Dify,构建私有化大模型知识库。内容涵盖环境准备、服务启动、模型配置、知识库创建及工作流编排等步骤,帮助用户实现离线或内网环境下的大模型应用开发。

详细整理了腾讯大模型算法实习生面试中的核心技术问题,涵盖分布式训练框架对比、DeepSpeed ZeRO 显存优化原理、Transformer 架构细节、推理参数调优策略以及 RAG 与大模型协同机制。内容补充了各知识点的理论深度与工程实践要点,包括并行通信开销分析及手撕代码题解,旨在帮助求职者系统掌握大模型算法岗位的核心考核点。

如何利用本地部署的 Ollama 大模型配合 ComfyUI 工作流,实现 AI 绘画提示词的自动化优化。通过安装自定义节点,构建包含汉译英、结构化润色及结果提取的三个处理阶段,用户可以将简单的中文构思转化为符合 SDXL 标准的高质量英文提示词。教程涵盖了环境准备、模型选择、节点配置、工作流搭建及常见问题排查,旨在帮助用户在不依赖云端服务的前提下,提升 A…

详细阐述了从传统产品经理转型为 AI 产品经理的必要性与实施路径。首先定义了 AI 产品经理与传统 PM 在技术理解、场景洞察及数据思维上的核心差异。接着分析了转行动机,包括顺应 AI 时代趋势及个人职业发展的薪资与前景优势。核心部分提出了五大转型步骤:夯实 PM 基础、系统学习 AI 技术(含 Python、Prompt Engineering 等)、在当…

LangChain-Chatchat 是基于 ChatGLM 和 Langchain 的开源 RAG 本地知识库项目。介绍其实现原理,涵盖开发环境准备(Ubuntu、Python、CUDA)、硬件要求、仓库拉取、虚拟环境创建、依赖安装及配置文件初始化。详细说明了模型下载策略、知识库初始化命令、服务启动方式(一键或单独)以及 Web UI 和 API 访问方法…

Ollama 在本地环境下的部署流程、配置方法及核心功能。内容涵盖 Linux 与 Docker 安装步骤、系统服务配置、模型拉取与运行、自定义 Modelfile 开发以及 REST API 集成方案。同时补充了 One-API 与 Open WebUI 的生态整合实践,并提供了常见问题的排查指南与 Python 客户端示例,旨在帮助开发者快速搭建私有化大…

五个基于 Python 的办公自动化实用脚本,涵盖从 Word 提取图片、制作国旗头像、汉字转拼音、发票 OCR 识别到自动整理文件夹的场景。内容详细说明了各功能的安装依赖、代码实现、技术原理及安全注意事项,特别强调了 API 密钥的安全管理和虚拟环境的最佳实践。通过掌握这些自动化技巧,可有效减少重复劳动,提升工作效率。

30 个实用的 Python 编程技巧,涵盖列表推导、枚举、多值返回、链式比较、字符串转换、For-Else 结构、堆操作、字典合并、集合运算及常用内置函数等核心知识点。内容经过清洗去除了无关推广信息,修正了原有代码逻辑错误与拼写错误,并补充了必要的上下文说明与最佳实践建议,旨在帮助开发者提升编码效率与代码质量。

详细讲解了在 Python 中执行 Windows CMD 命令的四种主要方法。首先介绍了标准库 subprocess 模块的最佳实践,包括参数配置、错误处理和超时控制;其次分析了 os 模块的简单用法及其局限性;接着探讨了 pyautogui 在 GUI 自动化中的应用及依赖条件;最后说明了 ctypes 库在 Windows 底层调用中的使用场景。文章重…

大语言模型在处理 13.11 与 13.8 等数值比较时出现常识性错误。研究表明,这源于 LLM 基于 Token 预测而非数值逻辑的本质。Token 分词机制导致数字被拆解为文本片段,训练数据中的版本号或日期习惯干扰了数值判断。此外,上下文提示方式显著影响结果,明确指定数据类型或调整提问顺序可改善表现。此现象揭示了当前 AI 缺乏真正的数学推理能力,依赖统…

北京交通大学 ADaM 团队开源 o1-Coder 框架,旨在复现类 o1 的推理能力。该框架通过测试用例生成器(TCG)构建结果奖励,利用蒙特卡洛树搜索(MCTS)合成推理数据,并支持在无推理过程数据情况下进行强化微调(RFT)。文章详细阐述了六步框架流程、伪代码生成策略,并讨论了系统 2 对齐、世界模型构建等挑战与未来方向。

Safetensors 是一种用于安全存储张量的新格式,旨在替代不安全的 pickle 格式。它通过零拷贝技术提升加载速度,支持惰性加载以优化内存使用,并天然防止反序列化攻击。深入解析其内部结构、安全性优势及在 PyTorch 中的实践应用,涵盖文件头定义、数据偏移量机制以及与 HuggingFace 生态的集成方式,为开发者提供完整的模型权重存储解决方案。

介绍如何使用 LangChain4J 框架结合智谱 GLM-4 大模型,通过 Function Calling 功能开发支持工具调用的智能体(Agent)。示例基于 Kotlin 和 Quarkus 构建,模拟本地商店发现与下单场景,展示了 ChatMemory、SystemMessage、UserMessage 及 Tool 的定义与调用流程。文章还分析了…

深入解析了检索增强生成(RAG)技术的核心原理及其在大模型应用中的关键作用。文章对比了 RAG 与大模型微调的差异,详细阐述了检索与生成的工作流程,并分析了当前面临的检索精度、幻觉及维护成本等局限性。针对这些问题,提出了包括混合检索、重排序、查询重写及自动化维护在内的多种性能提升策略。最后总结了 RAG 的技术趋势,为企业落地提供实践参考。

在本地环境中使用 Ollama 部署大语言模型的完整流程。涵盖 Windows/Linux 系统下的安装步骤、环境变量配置、模型下载与运行方法,以及通过 Node.js 构建聊天界面的操作指南。此外还包括如何在 VS Code 中集成 Ollama 插件进行开发辅助,并提供了常用命令参考及性能优化建议,帮助用户快速实现本地 AI 能力落地。