无人机航拍目标检测与语义分割数据集汇总
汇总了面向无人机视觉任务的大规模多场景标注数据集,涵盖地理农业、智慧城市、基础设施巡检及灾害监测等领域。数据支持 VOC/YOLO 检测格式与 LabelMe 分割格式,包含路面损坏、建筑缺陷、农作物识别、红外热成像等多种目标检测与分割资源,为遥感、安防、农业等行业的算法研发提供数据基础。
博客作者
必有回响
314
已发布文章
8.3K
博客获赞
453K
博客浏览
第 4 页
汇总了面向无人机视觉任务的大规模多场景标注数据集,涵盖地理农业、智慧城市、基础设施巡检及灾害监测等领域。数据支持 VOC/YOLO 检测格式与 LabelMe 分割格式,包含路面损坏、建筑缺陷、农作物识别、红外热成像等多种目标检测与分割资源,为遥感、安防、农业等行业的算法研发提供数据基础。
探讨前端代码分割与懒加载技术。通过减少初始加载时间和优化资源利用,提升大型应用性能。对比了未分割代码的弊端与 React.lazy、Webpack 配置的正确实践。介绍了基于路由和条件的懒加载方案,强调需根据实际场景平衡策略,避免过度优化影响体验。
在AMD显卡上部署llama.cpp Vulkan后端的完整流程,涵盖问题诊断、驱动优化、编译配置及性能调优。内容包含常见故障识别、Vulkan信息检查命令、CMake编译参数设置、运行时配置文件示例以及基准测试方法。通过调整驱动版本、启用AMD兼容性选项、优化内存管理和计算策略,可有效解决初始化失败、加载卡顿及性能异常问题,显著提升推理速度和降低延迟。

OIIOII 是一款专注于 AI 动画创作的平台,通过 AI 多智能体协作系统还原专业动画制作分工。核心特色包括一站式虚拟团队(艺术总监、编剧等)、五大创作模式(剧情短片、AMV 等)以及全局资产记忆库和结构化通信机制解决角色一致性问题。实际使用流程简单,支持从创意到成片的自动化生成。目前处于内测阶段,存在分镜衔接等优化空间,适合自媒体创作者及 AI 爱好者…

对比了 Xilinx 7 系列、AXI Memory Mapped 和 XDMA 三种 PCIe IP 核的区别与适用场景。详细解析了 Virtex-7 FPGA Gen3 Integrated Block for PCI Express v4.3 的数据信号接口(如 tdata/tuser),包括命令下发、波形传输及采集数据上传的流程。介绍了 IP 核配置…
演示如何使用 Augment Code 配合 Axure 设计稿自动生成 Vue3 前端项目。通过对比 Cursor 方案,分析 Augment Code 在还原度和自动化方面的优势。步骤包括导出 Axure HTML 至本地、整合至 Vue3 项目结构、配置依赖及路由,最后通过特定指令让 AI 生成页面代码并处理常见错误。

介绍 OpenClaw 开源自动化平台对接 QQ 机器人的方法。涵盖环境准备、Docker 部署及大模型 API 配置。提供两种接入方案:一是 QQ 开放平台官方机器人,适合正规服务;二是个人号通过 NapCat 接入,支持群聊。文中包含详细的命令行操作、配置文件示例及避坑指南,帮助用户在本地或云端快速搭建 AI 助手。
一种结合人工势场法(APF)与双向 RRT*算法的无人机路径规划方案。针对传统 RRT 在复杂环境中采样效率低、路径曲折的问题,该混合算法利用 APF 的方向引导优势与 RRT*的渐进最优特性,并通过双向搜索加速收敛。文章详细拆解了环境建模、引力斥力计算及树结构实现等关键模块,提供了改进后的 Python 代码示例,展示了如何在障碍物密集场景下提升规划速度与…
介绍 Whisper.cpp 量化模型下载指南。Whisper.cpp 是 OpenAI Whisper 的 C++ 实现,支持量化技术减小模型尺寸。常见量化级别包括 q4_0、q5_0、q8_0 等,分别对应不同压缩率与精度权衡。模型以 ggml 格式提供,可从官方 GitHub 仓库 Releases 页面下载。示例展示了命令行运行方式。建议根据设备性能…

一套无人机智能巡检系统的开发方案,涵盖实时监控、任务管理、数据媒体、AI 识别及设备等核心模块。系统采用前后端分离微服务架构,基于 Spring Boot 和 Vue.js 构建,集成大疆 SDK 实现云端控制与视频传输。通过 AI 算法进行异常检测与事件管理,支持三维建模与数据分析,旨在提升巡检效率并降低运营成本。
如何使用 GLM-4.7-Flash 模型构建本地 Copilot 编程助手。内容涵盖环境准备、一键部署、Web 界面访问、VS Code 集成以及高级应用场景如代码审查和文档生成。文章还提供了性能优化技巧,包括流式输出和显存管理,并解决了常见问题。该方案支持离线运行,保障数据隐私,适合定制化开发需求。
利用 AI 工具制作动漫短剧的核心流程,涵盖角色场景生成、剧本创作、动态合成及后期优化。分析了内容变现、IP 衍生及定制服务等盈利模式,并通过成本对比与实操案例展示了 AI 在降低制作成本与提升效能方面的优势,建议初期聚焦垂直领域验证商业模式。

飞书 OpenClaw 机器人在交互时返回 HTTP 401 Invalid Authentication 报错的问题。该错误属于未授权状态,表明身份认证无效。在飞书开放平台场景中,无论是上行事件推送还是下行 API 调用,若凭证无效或鉴权逻辑不通过,服务端将拒绝请求并返回此状态码,最终透传至客户端。目前该问题在单聊和群聊场景中均可稳定复现,导致无正常业务响…

CSS 背景样式的各项属性,涵盖背景颜色设置(支持多种格式)、背景图片的引入与平铺控制、定位方式(方位词与坐标)、图像固定效果以及属性复合简写。重点讲解了 RGBA 实现背景色半透明的方法,并提供了包含完整 HTML 结构与 CSS 样式的综合代码示例,帮助读者掌握页面背景视觉效果的构建。
如何在 Obsidian 中通过手动安装 Claudian 插件及配置 Obsidian Skills,实现本地 AI 知识库管理。支持替换为智谱 GLM 或 DeepSeek 模型,利用 Canvas 生成知识图谱,并阐述了 Obsidian 坚持 Local-first 和 Privacy-first 的哲学。
介绍如何在 Windows 或 Linux 环境下通过 Docker 安装并配置 Neo4j 图数据库。步骤包括环境准备、创建挂载目录、拉取镜像、启动容器及访问配置。重点说明了数据持久化设置、远程访问配置(修改 neo4j.conf)以及常见问题的排查方法,如端口占用和密码设置要求。
基于 ESP32 芯片的开源无人机远程识别方案 ArduRemoteID。该方案支持 ESP32-S3 和 C3 平台,兼容 MAVLink 与 DroneCAN 协议栈,提供 WiFi 及蓝牙多种通信模式。文章详细解析了其模块化架构、多层安全防护机制(包括固件签名与 eFuse 锁定)以及商业合规部署流程。相比商业方案,其具有成本低、灵活性高、可扩展性强等…
详细阐述了 GME-Qwen2-VL-2B-Instruct 多模态模型在 Kubernetes 集群中的部署流程。涵盖环境准备、持久化存储配置、服务暴露、健康检查探针及 HPA 自动扩缩容设置。通过标准化 YAML 配置实现图文匹配服务的高可用与弹性扩展,并提供了常见故障排查与性能优化建议,适用于电商商品匹配及内容审核等场景。

评测十大 AI 论文辅助工具,涵盖降重优化、AIGC 率控制、论文框架生成及开题报告润色等功能。工具通过语义重组、同义词替换等技术提升文本原创性,辅助完成文献综述与关键模块。主要工具包括 aicheck(降 AIGC 率)、aibiye(生成大纲)、askpaper(文献整合)等。AI 工具能显著提高效率,但需配合人工润色以确保学术合规。合理搭配工具可将精力…

深度解析百度文心一言 4.5 开源模型。涵盖 10 款模型版本介绍、基准测试表现及工具生态。技术分析包括多模态异构 MOE 架构、高效训练并行策略及后训练方法。提供基于 FastDeploy 的详细部署步骤与环境配置。通过基础通识、推理、视觉、代码等维度对比评测,展示其在中文理解与多模态任务上的优势。结论表明该系列模型在性能与效率上达到业界 SOTA 水平,…