Unity 2022 + UXR 3.0:Rokid AR 眼镜轻量级消消乐开发实录
基于 Unity 2022 LTS 与 Rokid UXR 3.0 SDK,实现 AR 眼镜端轻量级消消乐游戏。通过解耦场景初始化、状态管理与棋盘逻辑,解决空间锚定、射线交互及递归消除等核心问题。分享代码实现细节、协程动画处理及字体缺失、Z 轴深度等常见调试坑点,提供 AR 应用开发的工程化思路。
博客作者
珍惜当下
334
已发布文章
10K
博客获赞
538K
博客浏览
第 2 页
基于 Unity 2022 LTS 与 Rokid UXR 3.0 SDK,实现 AR 眼镜端轻量级消消乐游戏。通过解耦场景初始化、状态管理与棋盘逻辑,解决空间锚定、射线交互及递归消除等核心问题。分享代码实现细节、协程动画处理及字体缺失、Z 轴深度等常见调试坑点,提供 AR 应用开发的工程化思路。
Windows 系统通过 WSL 安装 Ubuntu 环境,配置 Node.js 与 NVM 后部署 OpenClaw。步骤涵盖基础组件安装、OpenClaw 初始化、Hooks 设置、Web UI 启动、飞书插件接入与权限配置、百炼模型集成以及子 Agent 创建。提供完整命令行操作指南,实现飞书机器人对接大模型功能。

AI 绘画创作核心在于文本构思,需结合文化元素与社会洞察激发灵感。通过融合非遗传统与现代科技、代入特定群体视角,可将日常观察转化为具有深度的视觉隐喻。文中展示了苗绣机器人及聋哑人手语轨迹的案例,演示了如何利用提示词工程构建故事线索,实现技术与人文的融合表达。
Miniconda 结合 Python 3.9 为 Stable Diffusion 提供了轻量且隔离的运行环境,有效解决深度学习依赖冲突问题。通过 conda 管理底层原生库如 PyTorch 和 cuDNN,可快速搭建支持 CUDA 的推理环境。文章演示了使用 diffusers 库加载预训练模型生成图像的完整流程,包括显存优化策略如半精度推理和注意力切…

文章介绍 Flutter 项目中使用 ethereum_addresses 库进行以太坊地址校验的方法。涵盖 EIP-55 Checksum 标准、安装步骤、核心 API 用法及在鸿蒙系统下的性能注意事项。通过代码示例展示地址验证流程与 UI 集成方案,帮助开发者实现安全的区块链地址资产管理。

Flutter 利用 shelf_web_socket 库在 OpenHarmony 环境下构建端侧 WebSocket 微服务端。内容涵盖基础原理、核心 API 配置及典型应用场景,重点解决移动端低能耗休眠下的连接保活及跨 HAP 端口竞合问题。通过 shelf_io 和 shelf_web_socket 配合,实现高性能全双工长连接与协议协商能力,支持分…

OpenClaw 通过统一的 message 工具接口提供强大的 Telegram Bot 集成能力,支持消息收发、群组管理及媒体处理。详解了从环境准备、Bot 创建到 Webhook 配置的全流程,涵盖命令设计、高级功能如内联查询与投票,以及错误处理与性能优化等最佳实践,帮助开发者快速构建功能完善的智能助手。

Qwen-Multiple-Angles 是针对 Qwen-Image-Edit-2511 模型的 LoRA 扩展,核心在于通过单张参考图实现 96 种相机角度的精确控制。该插件利用高维 3D 数据训练,解决了传统 AI 在低角度仰拍等场景下的透视变形问题。支持 ComfyUI 与 WebUI 双模式,用户可通过特定触发词或可视化控件调整视角。适用于角色设计…
mT5 中文-base 模型在零样本文本增强任务中表现优异,但部署时常遇 WebUI 超时与显存溢出(OOM)问题。通过调整 Gradio 超时参数、启用 4-bit 量化加载策略、限制并发请求及优化推理流程,可有效降低资源消耗。实测显示,合理配置后可在消费级显卡上稳定运行,显著提升批量处理效率与系统鲁棒性,适用于生产环境的 API 集成与数据清洗流水线。

Spring AI Agent Skills 允许开发者通过定义 SKILL.md 文件为 AI 模型扩展模块化能力。本文演示了如何在 Spring Boot 项目中集成该功能,包括 Maven 依赖配置、Skill 文件规范及 ChatClient 工具注册流程。同时深入解析了底层加载元数据、构建 ToolCallback 及函数调用的实现机制,帮助开发者…

通过 LLaMA-Factory 完成 Qwen3-VL 多模态大模型的 LoRA 微调、合并及 vLLM 部署全流程。涵盖环境配置、WebUI 操作、命令行导出及 API 对接,解决显存限制与数据集配置问题,适用于多模态应用落地场景。

OpenClaw 是一款支持本地部署的 AI 自动化办公工具。文章详细说明了在 Windows 和 Ubuntu 系统下的前置准备,包括 Node.js、Python、Git 及 Ollama 环境的安装与配置。提供了基于通义千问或本地模型的核心配置方案,涵盖轻量化优化以适配低配置电脑。此外,还介绍了基于 TypeScript 的插件开发流程,包含文件压缩示…

Meta 发布的 Llama 系列开源大模型经历了从 Llama-1 到 Llama-3 的演进。文章梳理了各版本发布时间、参数量及核心特性,对比了 Llama-1 至 Llama-3 在模型架构、训练数据规模、训练方法及基准测试效果上的差异。重点分析了 Llama-3 在上下文长度、Tokenizer 优化及多语言能力上的提升,并探讨了其对开源社区的影响及…
Stable Diffusion 结合 ComfyUI 节点化工作流实现图像服装替换。通过语义分割识别衣物区域,利用 ControlNet 控制姿态,配合局部重绘技术生成新服装。流程涵盖模型准备、工作流导入、参数配置及常见问题排查,支持跨风格换装与 3D 模型生成,降低 AI 创作门槛。

AI 辅助前端设计工作流通过结合 ASCII 原型、SVG 线稿及多种前端设计技能,将传统 1-2 周的产研周期压缩至 1-2 天。文章详细解析了 ASCII Design 用于秒级验证、Wireframe Design 用于专业定稿、以及 Frontend Design Skills 在 Vue3 等框架下的代码生成策略。实战部分演示了从零构建工单列表页的…

视觉 - 语言模型通过统一建模视觉与自然语言,使人形机器人具备理解指令与场景的能力。文章介绍了 CLIP、BLIP 及 Flamingo 等核心模型的演进与分工,阐述了文本与视觉的语义对齐机制,包括嵌入空间构建、对比学习与跨模态注意力。此外还探讨了基于语言的视觉任务控制流程,从指令解析到行动意图映射,展示了大模型如何支撑机器人在复杂环境中的闭环感知与决策。

无人机三维路径规划常面临障碍物规避与能耗平衡的多目标优化难题。基于 MATLAB 平台,利用多目标粒子群算法(MOPSO)构建路径规划模型。通过维护非支配解集与拥挤度距离策略,在确保避障安全的前提下优化路径长度与飞行时间。文中展示了核心算法逻辑,包括粒子初始化、适应度评估及外部存档更新机制,为复杂环境下无人机的自主导航提供可参考的实现方案。

汽车雷达共置 MIMO 系统面临多径反射导致幽灵目标问题。提出基于广义似然比检验(GLRT)的检测器,将幽灵检测建模为复合假设决策问题。通过稀疏增强压缩感知与 Levenberg-Marquardt 优化估计角度参数,并结合凸波形优化提升性能。仿真与实验表明该方法优于传统网格基估计器,能有效消除幽灵目标并保留真实路径。

Ubuntu 25.04 环境下通过 Ollama、DeepSeek 和 OpenWebUI 构建本地私有大模型。步骤包括系统优化、组件安装、Docker 配置及性能调优。涉及 NVIDIA 显卡驱动、容器网络设置及安全加固方案。解决连接异常与显存溢出问题,实现低成本隐私安全的 AI 辅助开发环境。

OpenClaw 是一款开源 AI 智能体,定位为能自主执行任务的'数字员工'。其核心采用网关 - 节点 - 渠道三层解耦架构,网关基于 Node.js 构建,负责消息路由与安全校验;智能体层通过 Lobster 循环模式实现思考、执行、观察与反馈闭环;节点层支持分布式设备扩展。系统具备纯文本存储、Lane 命令队列及混合记忆机制,保障数据透明与并发稳定。O…