Instance Segmentation
了解实例分割如何实现像素级目标检测。了解如何使用 Ultralytics YOLO26 高速实时生成掩码等。
实例分割是计算机视觉 (CV)中的一种先进技术,能够在像素级别识别并 delineate 图像中每个独立的目标对象。标准的目标检测使用矩形边界框定位对象,而实例分割则通过为每个检测到的实体生成精确掩码,深入分析图像内容。这项能力使人工智能 (AI)模型能够区分同一类别中的不同对象,例如将两个相互重叠的人分开,从而相比更简单的分类方法,对视觉场景提供更丰富、更详细的理解。
区分分割类型#
要全面理解实例分割的实用价值,有必要将其与其他相关的图像处理任务区分开来。根据应用需求的不同,每种方法都能提供不同级别的细粒度信息。
- 语义分割: 这种方法将图像中的每个像素分类到某个类别中(例如“道路”“天空”“汽车”)。但是,它无法区分同一类别中的不同对象。如果三辆汽车并排停放,语义分割会将它们视为一个“汽车”区域。
- 实例分割: 这种方法将每个对象视为一个独立实体。它会检测单个实例,并为每个实例的像素分配唯一标签。以停放的汽车为例,实例分割会创建三个不同的掩码,分别识别“汽车 A”“汽车 B”和“汽车 C”。
- 全景分割: 这是一种混合方法,将语义分割对背景的标注与实例分割对可计数对象的识别结合起来。
像素级分析的工作原理#
现代实例分割模型通常依赖先进的深度学习 (DL)架构,尤其是卷积神经网络 (CNNs)。这些网络从图像中提取特征,以预测对象的类别及其空间轮廓。从历史上看,Mask R-CNN等两阶段架构曾是标准方案:先提出感兴趣区域,再将其细化为掩码。
然而,近期的发展催生了YOLO26等单阶段检测器,能够同时执行检测和分割。这种“端到端”方法显著提升了实时推理速度,使消费级硬件能够对实时视频流应用高精度分割。
实际应用#
实例分割提供的精确边界对于那些必须准确了解对象形状和位置以进行决策的行业至关重要。
- 医疗领域中的 AI: 在医学诊断中,确定肿瘤或病变的准确大小和形状非常重要。实例分割能够以高精度勾勒MRI 扫描中的异常区域,帮助放射科医生制定治疗方案并监测疾病进展。
- 自动驾驶汽车: 自动驾驶汽车依靠分割来应对复杂环境。借助Cityscapes等数据集,车辆可以识别可行驶路面、识别车道线,并在拥挤的人行横道中区分单个行人,从而确保安全。
- 农业领域中的 AI: 精准农业使用分割来监测作物健康状况。配备视觉系统的机器人可以识别单个果实以进行自动采摘,或检测特定杂草以实施定向除草剂施用,从而减少化学品使用量并优化产量。
使用 Python 实现分割#
开发者可以使用 ultralytics 库轻松实现实例分割。以下示例演示了如何加载预训练的 YOLO26模型,并为图像生成分割掩码。
from ultralytics import YOLO
# Load a pre-trained YOLO26 instance segmentation model
# The 'n' suffix denotes the nano version, optimized for speed
model = YOLO("yolo26n-seg.pt")
# Run inference on an image
# This predicts classes, bounding boxes, and masks
results = model("https://ultralytics.com/images/bus.jpg")
# Visualize the results
# Displays the image with overlaid segmentation masks
results[0].show()挑战与模型训练#
尽管功能强大,实例分割相比简单的边界框检测需要更多计算资源。生成像素级精确的掩码需要大量的GPU 资源和精确的数据标注。为这些任务标注数据需要在每个对象周围绘制紧密的多边形,这可能非常耗时。
为了简化这一流程,团队通常会使用Ultralytics Platform等工具,该平台提供数据集管理、自动标注和云端训练等功能。这使开发者能够使用自定义数据微调模型,例如特定的工业零部件或生物样本,并通过ONNX或TensorRT等优化格式,将模型高效部署到边缘 AI设备上。









