
LLM 时代下的智能体:核心架构与关键技术
探讨了 LLM 时代下的智能体技术,涵盖定义、架构、核心组件及发展趋势。智能体具备学习、推理、决策和执行能力,LLM 的涌现能力使其具备更强的泛化性。文章详细解析了智能体的四大核心部分:用户请求、大脑、规划和记忆,并深入拆解了反思、工具使用、规划及多智能体协作等组件。文中列举了 Horton、ChatDev 等知名案例,介绍了 LangChain、AutoG…
博客作者
浪漫干饭
387
已发布文章
13K
博客获赞
791K
博客浏览
第 18 页

探讨了 LLM 时代下的智能体技术,涵盖定义、架构、核心组件及发展趋势。智能体具备学习、推理、决策和执行能力,LLM 的涌现能力使其具备更强的泛化性。文章详细解析了智能体的四大核心部分:用户请求、大脑、规划和记忆,并深入拆解了反思、工具使用、规划及多智能体协作等组件。文中列举了 Horton、ChatDev 等知名案例,介绍了 LangChain、AutoG…

DeepSeek 发布下一代统一多模态模型 Janus-Pro,包含 1B 和 7B 两个尺寸。该模型在架构上解耦了多模态理解与生成的视觉编码,通过优化的三阶段训练策略及扩展的训练数据,在多模态理解和文本到图像生成任务上取得了显著进步。7B 版本相比前代规模扩大,收敛速度提升,性能超越以往统一模型并匹配特定任务模型水平。

探讨了 Android 程序员转行车载开发的可行性与具体路径。文章分析了智能汽车行业发展趋势,指出 Android 开发者在 Linux、应用开发及 UI 方面的优势。详细列举了车载开发所需掌握的核心技术,包括 Android Automotive OS 架构、车载硬件接口通信协议、调试工具链、UI 设计规范、网络安全及功耗管理等。内容涵盖从基础构建、内核调…

详细讲解了在图像处理中如何使用矩阵掩码进行卷积运算。通过对比手动编写像素遍历逻辑与使用 OpenCV 内置 filter2D 函数两种方式,深入分析了锐化滤波器的数学原理、边界处理策略及性能差异。内容涵盖 C++ 指针操作优化、内核定义方法以及常见边界模式选择,旨在帮助开发者高效实现图像增强算法。

深入解析了深度学习与大模型的基础原理。首先介绍了神经元网络、正向传播、损失函数及反向传播等核心概念。接着探讨了自然语言处理中的序列建模问题,对比了 RNN 与 CNN 的局限性,重点阐述了自注意力机制(Attention)的工作原理及其在 Transformer 架构中的应用。文章还补充了简单的神经网络代码实现示例,并分析了当前大模型面临的幻觉、算力成本及可…

深入解析 LoRA(Low-Rank Adaptation)在大语言模型微调中的应用。阐述了其通过低秩矩阵分解减少可训练参数的核心原理,对比了全量微调与参数高效微调的差异。文章涵盖了 LoRA 在自然语言处理、计算机视觉等场景的优势,分析了其在计算资源、存储及灵活性方面的价值,并提供了基于 PyTorch 和 Hugging Face PEFT 库的实现示例…

OpenAI 发布 ChatGPT-4o,标志着 AI 大模型正式迈入感知时代。该模型实现了音频、视觉和文本的实时多模态推理,显著降低了交互延迟并提升了情感表达能力。GPT-4o 在文本、语音和视觉基准测试中均超越竞品,且免费向所有用户开放。技术上采用端到端训练架构,API 速度提升两倍且价格减半。发布会展示了其在个人助理、多语言翻译及机器间协作等方面的强大…

详细阐述了语音识别系统中语言模型的核心原理与实现方法。内容涵盖语言模型的定义、N-gram 模型的马尔科夫假设及其数学表达。重点解析了多种数据平滑算法,包括加一平滑、古德 - 图灵、回退平滑、插值平滑、Witten-Bell 及 Kneser-Ney 平滑,分析了各自的适用场景与优缺点。此外,文章介绍了困惑度(Perplexity)作为评估指标的计算方式及其…

针对 PyTorch 推荐系统库 TorchRec 的深度优化方案。通过在 16 个 DGX H100 节点上针对 MLPerf DLRM 基准进行测试,实现了 2.25 倍的加速比,将单次迭代耗时从 7.6 毫秒降低至 3.4 毫秒。优化工作主要涵盖 CPU 启动延迟和 Input Dist 两个方向,具体包括利用 CUDA Graph 减少 Kernel…

深入解析大语言模型(LLM)的核心定义、训练流程及关键技术。涵盖预训练、指令微调、对齐优化(RLHF/DPO)、参数高效微调(LoRA)及提示词工程等内容,并探讨其在自然语言处理、图像生成等领域的实际应用,为初学者提供系统性的技术指南。

总结了企业落地大模型的关键路径与实战经验。战术层面涵盖提示词设计、结构化输入输出、RAG 检索增强生成及微调策略选择。运营层面强调数据质量监控、模型版本控制、人机交互设计及团队角色分配。战略层面建议避免盲目自研模型,优先使用 API,注重评估体系构建与数据飞轮。核心观点是模型非产品,围绕模型的工程系统才是护城河,应坚持从简单开始,通过迭代和评估实现产品与市场…

面向程序员介绍大模型应用开发的基础知识与实战技巧。内容涵盖大模型核心原理、Transformer 架构、RAG 检索增强生成、Agent 智能体设计及微调技术。通过 Python 代码示例演示了 OpenAI API 的调用方法,包括流式响应处理和错误重试机制。此外还深入探讨了提示词工程的最佳实践,如零样本提示、少样本学习及思维链技术。文章旨在帮助开发者快速…

2024 年提示词写作经历了从简单技巧到结构化框架,再到凝练压缩表达的演变。回顾了提示词发展的三个阶段,分析了框架表达的优缺点,并介绍了李继刚等人的压缩表达理念。同时梳理了 DAIR.AI、Anthropic 等关键社区与人物,探讨了提示工程向自然语言编程演进的未来趋势。

机器学习模型评估与选择的完整流程。涵盖数据集划分、交叉验证方法、回归模型指标(MAE、MSE、RMSE、R²)、分类模型指标(混淆矩阵、准确率、召回率、F1-score)及 ROC-AUC 分析。通过 sklearn 实战代码演示了基准模型对比、学习曲线绘制及分类报告生成,帮助读者掌握模型性能优化与选择的关键技术。

基于 LangGraph 框架构建多智能体电影脚本生成应用的方法。通过定义 GraphState 管理状态,利用 create_scene、select_speaker、handle_dialogue 和 write 四个节点实现场景创建、角色切换、对话模拟及剧本导出。文章详细展示了环境配置、提示词设计、工作流编排及代码实现,并提供了优化建议,适用于构建复杂…

Hymba 架构通过在同一层内并行集成注意力头和 SSM 头,解决了 Transformer 计算复杂度高及 SSM 记忆回溯弱的问题。其核心创新包括并行混合头设计、可学习的元令牌及 KV 缓存优化。实验表明 Hymba-1.5B 在准确率、缓存大小和吞吐量上均优于同规模模型,尤其在长序列处理和指令微调任务中表现优异。尽管存在参数量限制等局限性,但其混合架构…

Stable Diffusion 的两种部署方案:云服务器与本地电脑部署。内容包括硬件环境要求、Python 与 CUDA 配置、WebUI 源码拉取、模型下载与管理、插件汉化及基础文生图操作。针对常见问题提供了网络故障排查与显存优化建议,帮助用户从零开始搭建并使用 AI 绘画工具。

详细解析了 Python 异步编程的核心概念,包括阻塞与非阻塞、同步与异步、并发与并行的区别。通过对比同步阻塞、多进程、多线程及非阻塞 Socket 编程的演进过程,阐述了传统方式的局限性。重点介绍了 Python 标准库 asyncio 的工作原理,涵盖事件循环、协程、Future 和 Task 等关键组件,并通过代码示例展示了如何使用 asyncio 实…

LLM 大模型训练的基础概念,涵盖预训练、微调和人类对齐三种范式及其适用场景。内容详述了 PyTorch 框架下的张量操作、自动求导及模型构建流程,并深入解析了 Transformer 架构原理。文章对比了 Transformer 与 CNN、LSTM 的差异,重点讲解了 LLaMA2 和 ChatGLM2 模型的关键组件改进,包括 RMSNorm 归一化、…

本地 AI 知识库构建主要利用 Ollama、Open WebUI 及 AnythingLLM 等工具实现。流程涵盖本地大模型部署、Web 交互界面搭建以及基于 RAG(检索增强生成)技术的知识库管理。通过 Docker 容器化部署,用户可在私有环境中运行开源模型,结合向量数据库存储文档切片,实现数据隐私保护与离线问答。文章详细解析了从环境准备、模型加载、文…