Ultralytics YOLO27:
指南

什么是实例分割?快速指南

和我们一起深入了解实例分割是什么、它如何工作、它在各种计算机视觉应用中的用途,以及它可能带来的影响。

ABAbirami Vina7 min read
图像中的目标实例分割

计算机视觉应用在我们的日常生活中越来越常见,从监控道路状况的交通摄像头到商店中的自助结账系统。通过让机器以类似人类的方式理解视觉数据,视觉 AI 正在影响众多行业。

许多此类应用依赖目标检测,这是一项计算机视觉任务,用于在图像中的关键目标周围绘制边界框。虽然这种方法通常效果良好,但有些图像分析解决方案需要更高的精度。

例如,医学成像不仅需要检测肿瘤,还必须勾勒出其准确形状。同样,在机器人领域,机器需要识别物体的精确轮廓,才能正确抓取物体。实例分割可以提供更精确的解决方案,以应对这些挑战。

实例分割是一项计算机视觉任务,旨在支持仅检测目标还不够的应用场景——它可以实现像素级精度。借助 Ultralytics YOLO11 等计算机视觉模型,你可以轻松地对图像和视频应用实例分割。

使用 Ultralytics YOLO11 进行实例分割

图 1. 使用 YOLO11 进行实例分割的示例。

在本指南中,我们将详细介绍实例分割的工作原理及其应用,以及如何针对特定分割任务对 Ultralytics YOLO11 进行自定义训练。

什么是实例分割?#

假设有一张多人合影,大家站得很近。目标检测可以帮助你在每个人周围绘制框,但无法告诉你他们的确切形状。

另一方面,实例分割类似于仔细沿着每个人的轮廓进行描绘,这样即使他们彼此重叠,你也能看到完整的轮廓。它不只是用框标记某个物体的位置,而是在像素级别识别每个目标的确切形状,从而更容易理解复杂图像。

最终得到的是一个填充物体形状的详细掩码,可以精确指出哪些像素属于该物体。在许多现实应用中,理解物体的确切形状和边界非常重要,而这种精度正适用于这些场景。

Ultralytics YOLO11 对实例分割的支持

图 2. 展示 Ultralytics YOLO11 对实例分割的支持。

实例分割与语义分割#

在了解实例分割时,你可能会遇到语义分割这一概念。

这两种技术都能帮助计算机在像素级别理解图像,但用途不同。语义分割根据类别为每个像素添加标签,并将所有同类型的物体归为一组。例如,在包含多辆汽车的图像中,语义分割会将它们全部标记为“car”,而不会区分不同的车辆。

另一方面,实例分割更进一步,会分别识别每个物体。它为每个独立实例分配唯一标签,并围绕其形状创建精确掩码。因此,在同一张图像中,实例分割不会只将所有物体标记为“car”,而是会分别识别并勾勒出每辆汽车。

两者的主要区别在于:语义分割按类别对物体进行分组,而实例分割将每个物体视为具有清晰边界的独立实体。选择使用哪项任务取决于具体应用——是只需了解图像中有什么,还是必须区分不同的物体。

实例分割与语义分割对比

图 3. 实例分割与语义分割对比(分别为右图和左图)。

热门实例分割模型#

如今,视觉 AI 社区可以使用各种实例分割模型。有些模型速度更快,有些精度更高,还有些更易于使用。

这些选项虽然很有用,但也可能引发一个问题:针对特定任务,究竟应该选择哪个模型?在众多选项中,Ultralytics YOLO 模型非常受欢迎,因为它们注重速度和精度。

此外,这些模型多年来也取得了显著发展。例如,Ultralytics YOLOv5 使用 PyTorch 等框架简化了部署,让更广泛的用户无需深厚的技术专业知识,也能使用先进的视觉 AI。

在此基础上,Ultralytics YOLOv8 增强了对实例分割、姿态估计和图像分类等计算机视觉任务的支持。

如今,Ultralytics YOLO11 将性能提升到了新的水平。它在 COCO 数据集上的平均精度均值(mAP)更高,同时参数量比 YOLOv8m 少 22%,这意味着它可以用更少的资源更精准地识别物体。

Ultralytics YOLO11 性能基准测试

图 4. YOLO11 基准测试。

简单来说,Ultralytics YOLO11 在不牺牲效率的情况下实现了业界领先的精度,成为该领域的突破性方案。

了解实例分割的工作原理#

接下来,我们来了解实例分割通常是如何工作的。较早的计算机视觉模型采用两步法。

首先,它们通过在物体周围绘制边界框来检测目标。然后,生成像素级掩码,勾勒出每个物体的确切形状。Mask R-CNN 就是一个知名示例,它在目标检测模型的基础上增加了掩码预测步骤。虽然这种方法效果良好,但由于需要分多个阶段处理图像,速度可能较慢,从而使实时应用更具挑战性。

与此同时,Ultralytics YOLO11 等模型可以一次性处理图像,同时预测目标边界框和实例分割掩码。这种简化的方法在保持高精度的同时,速度也快得多。因此,它特别适用于自动驾驶、视频分析和机器人等实时应用,因为这些场景对速度和精度都有很高要求。

针对实例分割自定义训练 Ultralytics YOLO11#

YOLO11 开箱即用时是一个预训练模型。它使用 COCO-Seg 数据集进行训练,该数据集涵盖用于实例分割的日常物体。不过,Ultralytics Python 包支持自定义训练,这对于需要分割独特物体的专业应用至关重要。

为什么自定义训练或微调模型很重要?自定义训练通过利用预训练模型中已有的知识来实现迁移学习。它不是从头开始,而是使用更小的数据集和更少的计算资源,使现有模型适应新任务,同时保持较高的精度。

如何自定义训练 Ultralytics YOLO11#

下面详细介绍针对实例分割微调 Ultralytics YOLO11 所涉及的步骤:

  • 数据准备: 根据具体应用收集并标注图像。Ultralytics 支持多个图像数据集,但你也可以准备符合要求的 YOLO 格式图像和标注,使用自己的数据集进行训练。
  • 使用预训练模型: 不要从头开始,而是使用预训练的 Ultralytics YOLO11 模型。
  • 模型训练: 调整批量大小(每次迭代处理的图像数量)、图像大小(目标输入分辨率)和训练轮数(训练周期总数)等关键训练设置,然后训练模型。
  • 性能评估: 模型训练完成后,你可以使用 mAP 等性能指标测试模型的精度。Ultralytics Python 包还提供了用于模型评估的内置函数。

Ultralytics YOLO11 支持的实例分割应用#

实例分割可以帮助机器更准确地观察和理解物体,从而解决现实世界中的挑战。从提升自动化水平到保护环境,它在许多领域都发挥着重要作用。下面我们来看看它正在产生影响的一些应用示例。

使用 Ultralytics YOLO11 实现施工现场安全与监控#

实例分割对于确保施工现场的安全和效率至关重要。例如,它可以用于监控重型机械。

你可以对 Ultralytics YOLO11 进行微调,使其准确分割和识别起重机、挖掘机、推土机等不同类型的设备,并实时跟踪它们的位置。这有助于现场管理人员确保机械严格在指定区域内运行,不会进入有工作人员或存在危险的区域。

此外,将此类解决方案与实时警报系统集成后,可以迅速采取纠正措施。不仅如此,收集到的洞察还可以帮助优化现场布局和工作流程,进一步降低风险并提高生产力。

使用 Ultralytics YOLO11 监控重型机械

图 5. 使用 Ultralytics YOLO11 监控重型机械。

使用分割和 Ultralytics YOLO11 进行动物监控#

动物行为监控可以帮助研究人员、农场主和自然资源保护工作者更好地照顾不同环境中的动物。在农场、动物园和自然栖息地中,实例分割可以识别并分割单个动物,在这些系统中发挥重要作用。与使用边界框的传统目标检测不同,实例分割可以提供每只动物的像素级轮廓,尤其适用于动物彼此距离较近的场景。

详细的分割有助于更准确地跟踪动物的运动和行为。重叠或密集聚集的动物也能被清晰识别,从而更精确地分析互动、健康状况和活动模式。总体而言,对动物行为更深入的洞察可以改善动物护理和管理实践。

使用实例分割监控牛群

图 6. 使用实例分割监控牛群。

Ultralytics YOLO11 在体育分析和运动员跟踪中的应用#

精准跟踪运动员和比赛事件是体育分析的重要组成部分。传统跟踪方法依赖人工标注,可能无法捕捉详细的互动信息。你可以使用计算机视觉在像素级别分割每名运动员、球和关键事件等细节,从而获得深入洞察。

例如,实例分割可以通过清晰区分每名运动员和物体,帮助检测犯规或无球事件等情况。Ultralytics YOLO11 等模型实现的这种细粒度监控,可以为分析人员提供更清晰的信息,以高精度研究运动模式、空间位置和互动。更重要的是,这些洞察可以帮助团队优化策略并提升整体表现。

实例分割的优缺点#

下面是实例分割可以为各个行业带来的一些主要优势:

  • 提升自动化水平: 通过自动执行质量控制和安全监控等任务,实例分割减少了人工干预需求,并最大限度地降低人为错误。
  • 更好的场景理解: 通过准确勾勒每个物体,实例分割有助于更深入地理解复杂场景,从而支持更明智的决策。
  • 高效的后处理: 像素级输出简化了背景移除、物体计数和空间分析等任务,减少了额外处理步骤的需求。

虽然这些优势突出了实例分割对不同应用场景的影响,但考虑其实施过程中涉及的挑战同样重要。

下面是实例分割的一些主要局限性:

  • 透明性方面的挑战: 玻璃和水等透明或反光物体很难进行分割,容易导致边界不准确。
  • 维护开销: 随着环境条件和数据集发生变化,需要持续更新和微调模型,才能保持其准确性和适用性。
  • 较高的标注工作量: 训练实例分割模型需要详细的像素级标注,这会显著增加数据准备所需的时间和成本。

要点总结#

实例分割可以精准地区分单个物体,即使这些物体彼此重叠。通过在像素级别捕捉物体边界,它相比目标检测等传统计算机视觉任务,能够更深入地理解视觉数据。

计算机视觉领域的最新进展让实例分割变得更快、更易于使用。尤其是 Ultralytics YOLO11 等计算机视觉模型简化了这一流程,只需极少的设置即可实现实时分割,让更多行业和应用都能使用这项技术。

对 AI 感兴趣?访问我们的 GitHub 代码仓库,并加入我们的社区继续探索。前往我们的解决方案页面,了解自动驾驶汽车中的 AI农业中的视觉 AI等创新应用。查看我们的许可选项,开始你的计算机视觉项目!

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅