WorkBuddy 桌面智能体安装与实战指南
WorkBuddy 是腾讯云推出的 AI 原生桌面智能体工作台,基于 CodeBuddy 架构,支持通过自然语言指令直接操作本地文件、生成文档及数据分析。介绍其安装流程、模型选择策略、核心功能如批量文件处理与远程遥控配置,以及 MCP 协议扩展用法,帮助开发者快速上手实现办公自动化。
博客作者
枕着星河
376
已发布文章
12K
博客获赞
672K
博客浏览
第 2 页
WorkBuddy 是腾讯云推出的 AI 原生桌面智能体工作台,基于 CodeBuddy 架构,支持通过自然语言指令直接操作本地文件、生成文档及数据分析。介绍其安装流程、模型选择策略、核心功能如批量文件处理与远程遥控配置,以及 MCP 协议扩展用法,帮助开发者快速上手实现办公自动化。
Web Server for Chrome 是基于 Chrome 扩展的轻量级 HTTP 服务器,无需复杂环境配置即可快速启动本地服务。支持指定根目录、自定义端口及局域网访问,内置 WebSocket 和自定义 HTTP 处理器。适用于前端页面调试、团队资源分享及本地应用集成。具备后台运行、CORS 支持及文件上传管理功能,能有效解决端口占用与跨域测试问题,…

GTC 2026 大会聚焦物理 AI、代理 AI、推理与 AI 工厂四大主轴,标志着行业重心从模型训练转向基础设施竞赛。Rubin 平台不再单指芯片,而是机架级超级计算机,旨在降低每百万 token 成本。英伟达试图将 AI 升级为通用基础设施,通过完整运转平台应对商业系统需求。

AI Infra 是支撑 AI 应用落地的基础设施,涵盖数据、计算、模型、部署四大核心模块。通过 Stable Diffusion 绘画平台、LangChain 企业知识库及端侧模型轻量化三个实战案例,详解从云端训练到边缘部署的全链路流程。内容涉及 FastAPI 服务搭建、向量数据库构建及 TFLite 模型量化优化等关键技术点,并展望了 2026 年轻量…

物理信息神经网络(PINN)将偏微分方程嵌入神经网络结构中,通过最小化包含 PDE 残差及边界条件的损失函数来求解问题。该方法适用于正向与反问题,具有无网格、解析可微及统一框架等优势。综述涵盖了 PINN 的组成模块、网络架构、损失函数设计、优化方法及在各类微分方程中的应用,并讨论了理论挑战与未来方向。现有工具如 DeepXDE 和 Modulus 支持其快…
Stable Diffusion UnCLIP 2.1 基于双编码架构实现图像内容理解与风格转换的平衡。通过引入 CLIP ViT-L/14 图像嵌入,模型能在保留主体特征的同时生成多样化变体。核心流程包括环境部署、模型加载及参数调节,重点掌握噪声水平对创意程度的影响。该技术适用于设计迭代、素材批量生产及商业营销场景,配合 fp16 精度优化显存占用,显著提…
针对需要二次开发管理配置端且非低代码的 Agent 框架需求,对比了 LangGraph+LangServe、AgentScope 和 OpenAGI 三款开源方案。三者均支持 SKILL.md/MCP 标准及 Skill 注册管理。LangGraph 基于 Python 生态,管理后台可全量二次开发;AgentScope 支持多 Agent 协作与 Go/…
2026 年 AI 编程助手市场格局已定,文心快码凭借工程化落地能力位居榜首,GitHub Copilot 在开源生态中保持统治力,Cursor 则在编辑器体验上独树一帜。评测覆盖十大工具,重点对比了智能体能力、免费策略及实测数据。企业团队建议优先考虑支持 SPEC 规范驱动的文心快码,个人开发者可根据对开源生态或本地编辑器的偏好选择 Copilot 或 C…
ClawdBot 是一款支持全链路离线的本地 AI 终端,通过 Docker 容器化部署实现模型推理、多模态处理及工具调用的完全本地闭环。从零启动容器的命令参数、Web UI 设备认证流程、模型热切换配置方法,以及基于 vLLM 和 PaddleOCR 的隐私保护机制。无需联网即可运行 Qwen 等量化模型,确保数据不出内网,适合对隐私敏感的开发者和企业用户…
通过 vLLM 和 Open-WebUI 组合,可快速在本地部署 Meta-Llama-3-8B-Instruct 模型。该方案利用 Docker 镜像一键启动,结合 PagedAttention 技术实现高性能推理,并提供类 ChatGPT 的交互界面。集成 LangChain 后可灵活管理对话记忆,适用于英文客服、代码辅助及私有化知识库场景。相比其他模型…

DGX Spark 部署 vLLM 与 Open WebUI 运行 Qwen3-Coder-Next-FP8(CUDA 13.0)。记录在 NVIDIA DGX Spark(Grace Blackwell 架构)上部署 vLLM 推理服务并接入 Open WebUI 的完整流程。包含 FlashAttention 编译、vLLM wheel 安装、模型加载等…

HarmonyOS 视频封面生成面临处理慢、质量差、资源消耗大等挑战。基于 HarmonyOS 原生 API 与 AI 云端服务,提出分层抽帧策略与两阶段处理流程。通过 AVImageGenerator 实现高效帧提取,结合多维度评分模型提升关键帧识别准确率。代码详解涵盖视频选择、智能抽帧、AI 分析集成及错误降级处理。实践表明,该方案能显著降低内存占用并优…

机器人操作模仿学习综述分析了动作生成与任务规划两大策略分类,涵盖扩散模型、流匹配及自回归等主流技术。文章梳理了 CALVIN、RLBench 等基准测试标准,指出当前在泛化能力、配置多样性、基准标准化及数据效率方面存在挑战。通过结合视觉语言模型与思维链推理,未来有望构建更具适应性的通用机器人操作策略。
TeleAI 发布 TeleBot-M 人形机器人与 TeleAqua-Bee 空海跨域智能体。TeleBot-M 采用单臂 4 自由度与下肢 6 自由度设计,搭载自研 TeleBotOS 及基于 TeleWorld 的自主大脑。TeleAqua-Bee 支持水空两用,具备涵道推进器。系统通过智传网(AI Flow)架构实现端边云协同,利用生成式视频压缩技术…
针对 Ollama 拉取模型速度慢的问题,通过配置国内 HuggingFace 镜像源(如 ModelScope)可显著提升下载效率。结合 LLama-Factory 工具,利用 QLoRA 技术可在消费级显卡上高效完成大模型微调。方案涵盖环境配置、数据准备、可视化训练及部署流程,降低本地化大模型应用门槛,实现低成本私有化部署。

Spring Web MVC 基于 Servlet API 构建,是 Spring 框架的核心 Web 模块。深入解析 MVC 设计模式在 Spring 中的实现,涵盖 Controller、Model、View 的职责划分。通过实战演示了项目搭建、常用注解(如@RequestMapping、@RequestParam)的使用,以及参数接收、JSON 数据交…
无人机视觉语言导航(UAV VLN)是人工智能前沿方向,使智能体依据自然语言指令在视觉环境中自主导航。文章阐述了其定义、形式化模型(MDP)、核心挑战(跨模态对齐、空间推理等)及物流、救援等应用场景。作为系列开篇,内容涵盖基础概念与后续技术路线规划,旨在帮助读者建立完整知识框架并掌握开发实践技能。
AI 编程工具对比涵盖 Claude Code、Cursor、Aider、GitHub Copilot、MetaGPT 及 OpenHands。从技术特性、优缺点及部署门槛分析。Claude Code 推理强但成本高;Cursor 体验流畅但资源占用高;Aider 适合 Git 集成;Copilot 生态完善;MetaGPT 和 OpenHands 适合全流…
AIGC 产品经理面临人才供需错配,核心在于从规则定义者转型为边界掌控者。文章拆解了从 0 到 1 操盘的全链路方法论,涵盖需求定位的黄金法则、MVP 设计的五大核心层级、商业化与成本控制策略。技术层面强调幻觉管控、RAG 与微调的决策逻辑及 Token 成本核算。合规方面梳理了内容安全、版权、隐私及算法备案四大红线。未来趋势指向垂直行业落地、Agent 协…
Google AI Studio 是 Google 提供的免费 AI 开发沙盒,支持极速测试 Gemini 模型及 Prompt 转换代码。文章涵盖账号注册、API Key 获取、界面功能解析及三种核心 Prompt 模式(Chat、Freeform、Structured)。重点演示了如何通过 Python SDK 进行代码集成,包括系统指令设置、JSON…