
OpenClaw 开源 AI 智能体框架的诞生背景与历史回顾
OpenClaw 是由奥地利开发者 Peter Steinberger 发起的开源 AI 智能体框架,前身为 Clawdbot。凭借本地优先、开源免费、自主执行三大特质,它在短时间内成为 GitHub 热门项目。回顾了 OpenClaw 从个人实验到独立开源基金会的历程,分析了其诞生的技术背景(长上下文模型突破)及行业影响,标志着 AI 从对话式向执行者的范…
博客作者
加密算法研究者
369
已发布文章
12K
博客获赞
697K
博客浏览
第 5 页

OpenClaw 是由奥地利开发者 Peter Steinberger 发起的开源 AI 智能体框架,前身为 Clawdbot。凭借本地优先、开源免费、自主执行三大特质,它在短时间内成为 GitHub 热门项目。回顾了 OpenClaw 从个人实验到独立开源基金会的历程,分析了其诞生的技术背景(长上下文模型突破)及行业影响,标志着 AI 从对话式向执行者的范…

ComfyUI Mixlab 插件出现 Whisper.available False 报错,通常因 models/whisper 目录缺失导致代码执行 os.listdir 异常。解决方案包括修改 __init__.py 打印堆栈定位错误,手动创建 whisper 目录,并在 Whisper.py 中添加自动创建目录逻辑以防止加载崩溃。同时需下载 Fast…

在 Mac Mini M4 上本地部署大模型环境的步骤。内容包括更新 macOS 系统,安装 Homebrew 包管理工具,配置 Python 虚拟环境,以及安装 Ollama 框架和 Llama 相关依赖。通过命令行操作完成基础环境搭建,为后续运行大模型做准备。

介绍从零开始使用 Python 训练 AI 模型的完整流程。内容包括 AI 基本概念、开发环境搭建(Python、库安装)、数据获取与预处理(加州房价数据集)、线性回归模型训练、深度学习神经网络构建(TensorFlow)、模型优化(正则化、早停法)以及模型部署(Flask API、Streamlit)。通过实战代码示例,帮助读者掌握机器学习核心技能及大模型…

探讨了 AI 对人类能力结构的根本性改变,指出 AI 并非单纯提升能力强度,而是实现了非稀缺、并行化和可复制的结构特性。核心观点认为,未来的竞争力差异将取决于 AI 的可得性,这将重写专业门槛、学习效率及阶层分界线。文章分析了由此带来的社会机会(如能力普惠、复杂问题解决)与风险(如判断力退化、不平等扩大、权力集中),并提出个人应转向 AI 协作型、组织需构建…

介绍如何利用文心一言生成用于智能体调用工作流的稳定提示词。内容涵盖智能体基础信息配置(名称、简介、人设、开场白),工作流节点设计(消息节点、文本处理、插件及图片输出),以及优化提示词的小技巧,包括结构化框架、多轮对话引导、细节强化和常见误区规避,旨在提升智能体响应质量与任务执行稳定性。
Flink History Server 用于在集群关闭后查看已完成作业。JobManager 将归档信息写入文件系统,History Server 轮询并展示 Web UI 及提供 REST API。需配置归档目录、刷新间隔及本地缓存。支持日志集成跳转。生产环境需注意存储权限、插件安装、缓存清理及轮询间隔调整。

讲解如何使用原生 HTML5 Drag & Drop API 实现前端列表拖拽排序功能。内容包括核心事件机制解析(dragstart、dragover、drop 等)、DOM 元素位置交换逻辑以及完整的代码示例。通过配置 draggable 属性和监听事件,用户可直观调整列表顺序,最后模拟向后端提交新顺序数据。该方案无需引入第三方库,适用于管理后台、看板等多…
详细讲解了 CSS 颜色函数(rgb、hsl、lab、lch、color-mix)和三种渐变类型(线性、径向、锥形)的语法与用法。通过按钮悬停、卡片背景、渐变文字、加载动画及渐变边框等实际案例,演示了如何提升前端界面视觉效果。此外还介绍了使用 CSS 变量定义颜色、动态调整颜色亮度饱和度等高级技巧,并提供了浏览器兼容性表及最佳实践建议,旨在帮助开发者掌握现代…

Web-Rooter 是一个面向 AI Agent 的本地化联网 CLI 工具集合。它采用 IR + Lint 机制降低幻觉率,将自然语言任务编译为中间表示并校验。提供 28 个 MCP 工具覆盖搜索、爬虫、研究等场景,支持学术、社交、电商等垂直领域。架构上 CLI 为核心接口,MCP 为适配层,强调联网行为的可追溯与可审计。适用于个人研究、团队开发及合规报…
记录了在本地使用 llama.cpp 部署大模型时遇到的常见问题及解决步骤。内容包括基础启动脚本编写、多分片 GGUF 模型合并方法、SillyTavern 调用 DeepSeek 模型时的推理预算错误处理(需调整参数并指定聊天模板),以及端口绑定失败的原因排查(检查端口占用)。提供了具体的批处理脚本和 Chat Template 修复方案。

探讨了前端开发中防抖和节流函数的实际应用。对比了 Lodash、RxJS、轻量级库及 WASM 实现的特点与优劣。重点分析了定时器清理、异步处理、this 指向及动态参数调整等常见陷阱。提供了搜索框、无限滚动、拖拽排序及窗口 Resize 等场景的最佳实践方案,并给出了通用 Hook 封装技巧与调试方法,帮助开发者避免内存泄漏与性能问题,提升代码质量。
档详细记录了在 Ubuntu 18 环境下配置 ROS Melodic、PX4 SITL 及 XTDrone 仿真平台的过程,重点实现了 Livox Mid360 激光雷达在 Gazebo 中的集成与仿真。内容包括安装 Livox SDK 与驱动、解决 protoc 版本冲突及 Anaconda 环境干扰、修改 PX4 SDF 模型以挂载 Mid360 雷达…

LLaMA Factory 是一款支持多种大语言模型的高效微调平台。涵盖安装部署、数据准备、训练、推理及评估全流程。内容包括 CUDA 环境配置、依赖安装、数据集格式规范(Alpaca/ShareGPT 等)、WebUI 与命令行操作、SFT 训练参数配置、LoRA 合并与量化方法、多模态推理及模型评估指标。旨在提供从零开始的大模型微调实战指南。
体验了 Qwen-Image-2512 文生图模型,重点测试其中文语义理解能力与生成速度。通过赛博朋克风格场景验证,该模型能精准解析中文提示词中的空间关系、光影细节及文化意象,无需翻译或复杂参数配置。实测显示在消费级显卡上可实现秒级出图且显存占用低,适合概念设计、短视频配图等场景,但不适用于商业印刷输出或严格元素替换任务。

介绍使用 Kotlin 和 Rokid AR 眼镜 SDK 开发一款亲戚称呼助手应用。通过蓝牙连接眼镜,实现亲戚信息在 AR 端的实时显示与语音播报。文章涵盖项目搭建、权限配置、数据模型设计、通信模块封装及 UI 实现,并总结了蓝牙权限动态申请、场景控制顺序等常见坑点,解决春节走亲访友称呼尴尬问题。
详细对比了 React 项目中常用的六种状态管理方案:React Context + useReducer、Redux、MobX、Recoil、Zustand 以及 Jotai。通过提供具体的代码示例,分析了各方案的实现逻辑、优缺点及适用场景。文章建议开发者根据应用规模选择合适工具,小型应用可用 Context,中型用 Zustand/Jotai,大型用 R…
在 Ubuntu 系统上通过 Docker 和 Ollama 本地化部署 DeepSeek R1 大模型的步骤。首先安装 NVIDIA 显卡驱动,随后配置并安装 Docker 环境。接着使用官方脚本安装 Ollama 服务,并配置局域网访问权限。最后拉取 deepseek-r1:7b 模型并进行运行测试。整个过程无需联网即可实现本地推理。
Stable Diffusion 3.5 FP8 模型通过量化技术降低显存占用并提升推理效率,但需特定硬件支持。介绍基于 PyTorch 2.3+ 及 CUDA 12.4+ 环境的配置要求,涵盖 Hopper 架构 GPU 检测、FP8 数据类型加载方法、Diffusers 库使用示例及生产环境部署策略。内容包括显存优化、CPU Offload 机制、降级方…
Faster Whisper 语音识别引擎,基于 CTranslate2 优化,相比原版速度提升显著且内存占用更低。内容涵盖安装方法、核心功能(多语言支持、时间戳、VAD)、代码示例及性能优化建议(量化、模型选择)。适用于会议转录、视频字幕等场景。