跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客GitHub 精选镜像AI 生图工具UI配色美学隐私政策关于联系
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

YOLO26:Ultralytics 发布端到端视觉 AI 新突破

Ultralytics 于 YOLO Vision 2025 大会发布 YOLO26 模型。该版本主打端到端架构,移除 NMS 后处理与 DFL 模块,引入 MuSGD 优化器及 STAL 标签分配策略。支持检测、分割、分类等五大任务,兼容 TensorRT、ONNX 等多种部署格式。CPU 推理速度提升显著,适用于边缘计算与实时场景。

人间失格发布于 2025/11/10更新于 2026/7/2742 浏览
YOLO26:Ultralytics 发布端到端视觉 AI 新突破

YOLO26:Ultralytics 在 YOLO Vision 2025 发布的端到端视觉 AI 新突破

9 月 25 日,在伦敦举行的年度盛会 YOLO Vision 2025(YV25)上,Ultralytics 创始人兼 CEO Glenn Jocher 正式宣布了 Ultralytics YOLO 模型系列的最新突破——Ultralytics YOLO26!

YOLO26 是一款更快、更轻、更准且易于部署的 Vision AI 产品。它不仅延续了 YOLO 系列一贯的速度与易用性,还在端到端架构、训练优化和多任务支持上带来了革命性突破。简而言之,Ultralytics YOLO26 是一款更好、更快、更小的 Vision AI 模型。在正式发售之前,我们来全面解析 YOLO26 的功能与优势。

设计理念:让视觉 AI 更简单、更普惠

Ultralytics 从成立起就有两大使命:普及 AI 技术,让所有人都能无障碍使用;保持尖端性能,不断突破视觉模型的速度与精度极限。随着边缘计算的兴起,用户越来越希望在智能相机、无人机或移动设备上实现实时视觉推理。这对模型提出了新的要求:更轻、更快,同时保证精度。YOLO26 正是在这一背景下诞生的。

Glenn Jocher 在发布会上表示:'最大的挑战之一,就是在保持卓越性能的同时,让用户最大化利用 YOLO26 的简单性与高效性。'

YOLO26 发布会现场

YOLO26 概览:从检测到分割的全能模型

YOLO26 是 YOLO 系列实时物体检测器的最新产品,专为边缘和低功耗设备而设计。它采用精简设计,消除了不必要的复杂性,同时集成了有针对性的创新技术,以提供更快、更轻和更方便的部署。

核心原则

YOLO26 的架构遵循三个核心原则:

  • 简单:YOLO26 是一个原生的端到端模型,无需非最大抑制(NMS)即可直接生成预测结果。由于省去了这一后处理步骤,推理变得更快、更轻便,也更容易部署到现实世界的系统中。这一突破性方法由清华大学的王敖在 YOLOv10 中首创,并在 YOLO26 中得到进一步发展。
  • 部署效率:端到端设计省去了管道的整个阶段,大大简化了集成、减少了延迟,并使不同环境下的部署更加稳健。
  • 训练优化:YOLO26 引入了 MuSGD 优化器,它是 SGD 和 Muon 的混合体,灵感来自 Moonshot AI 在 LLM 训练中取得的 Kimi K2 突破。该优化器具有更高的稳定性和更快的收敛速度,将语言模型中的优化技术应用到了计算机视觉领域。

这些创新结合在一起,使模型系列在小型物体上实现了更高的精度,提供了无缝部署,在 CPU 上的运行速度提高了 43%,从而使 YOLO26 成为迄今为止在资源有限的环境中最实用、最易部署的 YOLO 模型之一。

YOLO26 架构示意图

支持的视觉任务

YOLO26 提供五种不同的型号,用户可根据任务规模自由选择。

YOLO26 支持的计算机视觉任务概览:

  • 目标检测:比检测更进一步,YOLO26 可以在识别的每个对象周围生成像素完美的边界框。
  • 实例分割:生成像素级边界,更好地理解物体形状。
  • 图像分类:该模型可分析整幅图像,并将其归入特定类别或标签。
  • 姿态估计:YOLO26 可以检测关键点,并估算人类和其他物体的姿态。
  • 定向边界框 (OBB):可以检测任何角度的物体,尤其适用于航拍、无人机和卫星图像。
  • 目标跟踪:YOLO26 可用于跟踪视频帧或实时流中的物体。

无论是轻量级边缘设备,还是企业级 AI 系统,YOLO26 都能无缝适配。

YOLO26 任务支持

支持的部署平台

无论是移动应用程序、智能相机还是企业系统,部署 YOLO26 都非常简单灵活。Ultralytics Python 软件包支持不断增加的导出格式,这使得 YOLO26 很容易集成到现有的工作流程中,并与几乎所有平台兼容。

YOLO26 的另一大亮点是部署友好性。通过 Ultralytics Python 软件包,用户可以轻松导出多种格式:

  • TensorRT(GPU 加速最大化)
  • ONNX(跨平台兼容性强)
  • CoreML(适配 iOS)
  • TFLite(适配 Android 与边缘设备)
  • OpenVINO(优化英特尔硬件性能)

部署的另一个关键是确保模型在资源有限的设备上高效运行。这就是量化的作用所在。得益于其简化的架构,YOLO26 完美支持 INT8 量化与 FP16 半精度推理,在保证精度的前提下进一步减小模型体积、提升速度。这意味着 YOLO26 不仅能在服务器集群中高速运行,也能在手持设备、智能相机等边缘环境中稳定工作。

YOLO26 部署支持

YOLO26 架构创新:端到端推理与轻量化升级
架构的创新设计

YOLO26 的架构进行了创新设计:

  • DFL 移除:通过移除分布焦点损失(DFL)模块,简化了模型的设计,该模块以前会减慢推理速度并限制边界框回归。
  • 端到端(E2E)/无 NMS:跳过了传统的非最大值抑制(NMS)步骤,直接输出最终预测结果,无需非最大抑制(NMS)后处理,使部署更轻便。
  • ProgLoss & STAL:渐进损失平衡(ProgLoss)提升训练稳定性并提高准确性,小目标感知标签分配(STAL)增强小目标检测能力。
  • MuSGD 优化器:结合 SGD 与 Muon 优势,灵感来自 Moonshot AI 在 LLM 训练中的 Kimi K2 突破,提高了训练收敛性并提升了整体性能。

这些改进让 YOLO26 的 nano 版本在标准 CPU 上的速度提升 43%,特别适合移动应用程序、智能相机和其他对速度和效率要求极高的边缘设备。

性能指标

YOLO26 性能对比

边缘性能

YOLO26 具有最先进的边缘性能:

  • CPU 推理速度最多可提高 43%
  • 缩小模型尺寸,减少内存占用
  • 简化架构以实现兼容性(无 DFL、无 NMS)
  • 灵活的导出格式,包括 TensorRT、ONNX、CoreML、TFLite 和 OpenVINO
应用场景:从机器人到制造业

YOLO26 的轻量化和高精度,使其在多个行业展现潜力:

  • 机器人:YOLO26 可以帮助机器人实时解读周围环境。这使得导航更加顺畅,物体处理更加精确。它还能使机器人与人的协作更加安全。
  • 制造业:自动化缺陷检测,与人工检测相比,它可以更快、更准确地自动识别生产线上的缺陷。
  • 智能交通:在低功耗硬件上实现实时监控与预警。
  • 无人机与遥感:通过 OBB 检测复杂角度的地面物体。

简而言之,YOLO26 的普适性让它成为边缘 AI 与企业级系统的桥梁。

YOLO26 应用场景

主要收获

YOLO26 并不是简单的'版本升级',而是一次理念革新:它通过端到端简化、架构优化和训练创新,为计算机视觉带来了全新的速度与灵活性。

在 YV25 发布会上,Ultralytics 向我们展示了一个清晰的愿景:视觉 AI 的未来属于更轻量化、更智能、更普惠的模型。YOLO26 正是这一愿景的重要里程碑。

如果您在研究中使用了 YOLO26,请引用原作:

@software{yolo26_ultralytics, author ={Glenn Jocher and Jing Qiu}, title ={Ultralytics YOLO26}, version ={26.0.0}, year ={2025}, url ={https://github.com/ultralytics/ultralytics}, orcid ={0000-0001-5950-6979, 0000-0003-3783-7069}, license ={AGPL-3.0}}

目录

  1. YOLO26:Ultralytics 在 YOLO Vision 2025 发布的端到端视觉 AI 新突破
  2. 设计理念:让视觉 AI 更简单、更普惠
  3. YOLO26 概览:从检测到分割的全能模型
  4. 核心原则
  5. 支持的视觉任务
  6. 支持的部署平台
  7. YOLO26 架构创新:端到端推理与轻量化升级
  8. 架构的创新设计
  9. 性能指标
  10. 边缘性能
  11. 应用场景:从机器人到制造业
  12. 主要收获
  • 免费图片AI生成工具免费生成了解详情
  • Magick API 一键接入全球大模型注册送1000万token查看
  • 免费图片视频在线生成30秒,将你的创意变成现实开始设计
  • X/Twitter免费视频下载器免登陆无限额度免费视频解析下载了解详情
  • 100+免费在线小游戏爽一把
极客日志微信公众号二维码

微信扫一扫,关注极客日志

微信公众号「极客日志V2」,在微信中扫描左侧二维码关注。展示文案:极客日志V2 zeeklog

更多推荐文章

查看全部
  • xiaozhi-esp32 AI 语音机器人开发指南
  • DeerFlow 2.0 开源:基于 LangGraph 的超级智能体编排框架
  • GLM-4.6V-Flash-WEB 漫画分镜理解能力深度测评
  • 金仓 KingbaseES 融合架构实践:从多库并存到一库多能
  • GitHub Copilot 配合 Figma MCP 还原设计稿生成前端代码
  • 2026主流AI大模型横评与选型指南
  • 基于 Go 语言构建命令行 AI 对话客户端:从环境部署到核心实现
  • 大疆无人机开发实战指南:MSDK/PSDK/上云 API
  • Playwright MCP:Vibe Coding 前端搭建的最佳测试伙伴
  • AI 安全研究:视觉提示词注入与模型鲁棒性分析
  • 2026 AI Agent 技术趋势与多 Agent 系统实战
  • Visual C++ 6.0 安装与汉化教程及路径注意事项
  • physipy: 使 Python 具有单位感知
  • AI 图像生成指南:从原理到实战
  • FPGA 实现 CAN 总线接口与数据帧解析实战
  • 清华团队发布 Vidu 大模型,支持 16 秒文生视频生成
  • 微调 LLM 构建任务型对话 Agent 方案与实践
  • GitHub 汉化插件安装与配置指南
  • GitHub 启用双因素身份验证(2FA)配置指南
  • 三款云电脑部署 DeepSeek 实测:ToDesk、顺网与海马云横向对比

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online