使用 exo 技术构建 Mac mini AI 推理集群:从架构到实战
使用 exo 分布式推理框架在 Mac mini 集群上部署 AI 推理服务的方法。exo 利用 MLX 作为后端,通过 Thunderbolt 5 RDMA 实现超低延迟通信,支持张量和流水线并行。文章涵盖了集群拓扑设计、硬件选型(M4 Pro)、系统配置(RDMA 启用)、模型部署流程及性能优化策略。通过实测,4 节点 M4 Pro 集群可运行 Qwen…
博客作者
战无不胜
357
已发布文章
11K
博客获赞
746K
博客浏览
第 7 页
使用 exo 分布式推理框架在 Mac mini 集群上部署 AI 推理服务的方法。exo 利用 MLX 作为后端,通过 Thunderbolt 5 RDMA 实现超低延迟通信,支持张量和流水线并行。文章涵盖了集群拓扑设计、硬件选型(M4 Pro)、系统配置(RDMA 启用)、模型部署流程及性能优化策略。通过实测,4 节点 M4 Pro 集群可运行 Qwen…

详细解析了 CTF Web 竞赛中 EZMD5 系列的常见漏洞类型。主要涵盖 PHP 松散比较导致的 MD5 哈希碰撞(如 0e 开头科学计数法)、数组绕过技巧(md5 返回 null)、以及强比较下的哈希碰撞问题。同时介绍了 URL 参数数组定义方法及 PHP 逻辑与位运算符的区别,提供了相应的 Payload 示例与解决方案。
ClawdBot 插件开发实践,旨在为 Telegram 机器人添加自定义快捷命令。文章阐述了 ClawdBot 作为可扩展本地 AI 助手底座的优势,强调插件化开发在可维护性、复用性和隔离性上的价值。通过从零编写 summary 插件的完整示例,展示了目录结构创建、核心逻辑代码、配置声明及加载验证步骤。此外,还涵盖了多模态输入支持、限流缓存优化、与 Mol…
基于 Xilinx 7 系列 FPGA 驱动 USB3.0 外设的完整方案。内容包括利用 GTX 收发器配置物理层链路,选用 Microchip USB3300 PHY 芯片并通过 UTMI+ 接口连接,以及构建包含 DDR3 缓存和 USB 传输调度器的数据通路。文章涵盖了 VID/PID 配置、复位时序、枚举故障排查、ILA 波形抓取等调试步骤,并提供了…

介绍如何在云服务器上部署 OpenClaw 龙虾 AI 助手。步骤包括获取轻量服务器、通过镜像重装系统安装 OpenClaw、配置阿里云通义千问模型 API Key,以及接入 QQ 机器人实现自动化任务。

如何在腾讯云轻量应用服务器上部署 OpenClaw 智能体。内容包括购买带镜像的服务器、连接各类大模型 API(如 GLM、混元、Qwen)、配置 QQ 和飞书机器人通道、通过命令行安装和管理技能(Skill)、以及服务器文件与日志管理。此外还涵盖了数据持久化备份方案及实际应用场景示例,如点单与任务管理。
荣耀在 MWC 2026 展示了首款人形机器人并发布了 Robot Phone。这表明手机厂商不再局限于终端设备,而是向

介绍利用 AI 工具完成本科文献综述的全流程方法。首先分析选题无方向、文献难筛选、框架难搭建和规范难掌握四大痛点。接着拆解为输入标题、确定参考文献、生成范文三个核心步骤,涵盖智能选题辅助、参数设置及文献推荐功能。此外,平台还提供查重、降重、PPT 生成等配套服务。旨在通过智能化手段提升写作效率与质量,缓解学生焦虑,将精力投入学术思考。

探讨企业级私有化大模型部署方案。针对数据隐私、云端成本及网络延迟痛点,提出基于 Ollama 推理引擎与 Streamlit 框架的本地部署路径。内容涵盖开源模型选型(如 Qwen、Llama)、环境搭建步骤、显存优化策略及中文语境适配。通过量化技术与系统架构设计,实现在消费级硬件上安全、可控的低成本智能对话系统,为数据主权与 AI 民主化提供实践参考。

低空无人机 AI 算法涵盖公安执法、消防应急、水利、林业、能源电力、城建、市政、城管、工程、农业及生态七大领域共 74 个应用场景。内容涉及人员车辆识别、违章监测、灾害预警、设施巡检及环境监测等关键技术点,旨在利用无人机低空巡查优势弥补传统人工效率低、覆盖难、风险高的短板,实现智能化监管与快速响应。
回顾了 2015 至 2025 年 AIGC 技术的演进路径。2015 年至 2018 年以 GAN 模型为主,生成低分辨率静态图像。2019 年至 2022 年扩散模型取代 GAN,实现高清文本到图像生成。2023 年起进入视频生成阶段,Sora、Kling、Vidu 等模型推动长时序与物理一致性发展。2025 年迈向 VLA 意图级控制,支持多镜头互动与…
SVGAPlayer-Web-Lite 是专为移动端 Web 优化的轻量级动画播放器,支持 SVGA 2.x 格式。介绍其安装方式(npm/yarn)、基础使用示例及核心配置选项。内容涵盖解析器多线程优化、播放器控制特性(循环、缓存)、动态元素替换以及 IndexedDB 缓存策略。同时提供 Webpack 和 Vite 构建工具集成方案,并给出性能优化建议…
如何在本地使用 Ollama 和 Open WebUI 部署 Google Gemma-1B 模型。内容包括技术架构解析、核心配置文件 config.json 详解、从零搭建步骤(安装 Ollama、拉取模型、配置 Docker)、以及上下文长度优化、GPU 加速和常见问题排查。旨在帮助开发者构建私有化、低成本的本地 AI 助手。

自然语言处理(NLP)在教育领域的应用涵盖智能问答、作业批改及个性化学习等场景。文章探讨了 BERT、GPT-3 等前沿模型的技术实现,分析了教育文本预处理、多学科知识处理及数据隐私等特殊挑战。通过实战项目演示了基于 Hugging Face Transformers 和 Tkinter 构建智能问答系统的完整流程,包括环境搭建、界面设计及核心逻辑开发,为教…
OpenClaw 是一款支持多平台本地部署的 AI 助手工具,通过 WhatsApp、飞书等渠道实现自动化办公。详细记录了在 macOS、Linux 及 Windows 环境下的安装步骤,涵盖 Node.js 环境配置、API Key 设置及飞书应用对接流程。针对常见报错如 node-gyp 编译失败或执行策略限制提供了具体解决方案,并整理了常用终端命令与进…

ar 命令是 Linux 系统中用于创建和管理归档文件的核心工具,常用于静态库构建。支持添加、提取、列出及删除归档成员。常用参数包括 r 插入、x 提取、t 列表、f 指定文件名等。配合 c 标志可新建归档,s 标志生成索引。适用于 C/C++ 开发环境下的库管理,是系统运维与编译流程中的基础工具。

Live VLM WebUI 是一款开源的 Web 界面工具,用于实时测试视觉语言模型(VLM)。它支持通过 WebRTC 将摄像头视频流传输至任意 VLM 后端,如 Ollama、vLLM 或 OpenAI API。工具提供 GPU/VRAM/CPU 实时监控、多平台兼容(PC、Jetson、Mac 等)及多种预设提示词功能。适用于机器人导航、工业质检、安…
Python 脚本运行通常需要安装解释器,增加了用户门槛。六种将 Python 代码打包为独立可执行文件(如 Windows .exe)的主流工具。包括跨平台的 PyInstaller、老牌工具 cx_Freeze、Windows 专用的 py2exe、macOS 专用的 py2app、能提升性能的编译器 Nuitka,以及 Nuitka 结合 PyInst…

总结了 Java 语言中模拟算法的五个经典 LeetCode 例题,涵盖替换问号、提莫攻击、Z 字形变换、外观数列及数青蛙。通过逐步模拟题目逻辑,重点讲解边界条件处理与状态转换技巧,并提供了优化的代码实现及复杂度分析,适合算法初学者巩固基础。

介绍如何在 Linux 服务器上通过 1Panel 面板,结合 Ollama 本地大模型服务与 OpenClaw 应用,搭建 7×24 小时运行的个人 AI 助理。主要步骤包括服务器环境准备、GPU 驱动配置、Ollama 安装、Qwen 模型加载及 OpenClaw 部署配置。方案无需外部 Token 消耗,注重数据隐私,适合具备基础运维能力的用户进行本地…