Image Segmentation
探索计算机视觉中的图像分割。了解 Ultralytics YOLO26 如何为实例分割、语义分割和全景分割提供精准的像素级掩码。
图像分割是计算机视觉 (CV)中的一种复杂技术,涉及将数字图像划分为多个像素子组,这些子组通常称为图像片段或区域。与标准的图像分类不同,图像分类为整幅图像分配单个标签,而分割会在更加细粒度的层面分析视觉数据,为每个单独的像素分配特定的类别标签。这个过程会创建精确的像素级地图,使人工智能 (AI)模型不仅能够理解图像中存在哪些对象,还能准确了解它们的位置及具体边界。
像素级分析的工作原理#
为了实现这种高保真度的理解,分割模型通常采用深度学习 (DL)架构,尤其是卷积神经网络 (CNNs)。这些网络充当强大的特征提取器,用于识别边缘、纹理和复杂形状等模式。传统的分割架构(如经典的 U-Net)通常采用编码器-解码器结构。编码器会压缩输入图像以捕获语义上下文,而解码器则重建空间细节,输出最终的分割掩码。
现代技术进步催生了 YOLO26 等实时架构,该模型于 2026 年 1 月发布。这些模型将分割功能直接集成到端到端流水线中,从云端 GPUs 到边缘设备,均可实现高速处理。
分割的主要类型#
根据项目的具体目标,开发者通常会在三种主要的分割技术中进行选择:
- 语义分割: 这种方法根据类别对像素进行分类,但不会区分同一类别中的不同对象。例如,在卫星图像分析中,所有代表“森林”的像素都会被标为绿色,并将整片森林视为一个实体。
- 实例分割: 这种技术能够识别并分离不同的独立目标。在繁忙的街景中,实例分割会为“汽车 A”“汽车 B”和“行人 A”生成唯一的掩码,使系统能够对特定实体进行计数和跟踪。这是 Ultralytics YOLO26 模型系列的核心功能。
- 全景分割: 这是一种混合方法,将语义分割的覆盖范围与实例分割的精确性相结合。它会为每个像素分配标签,区分无定形的背景元素(如天空和道路),同时唯一识别可计数的前景对象。
与目标检测的区别#
区分分割与目标检测至关重要。检测算法使用矩形边界框定位对象,但不可避免地会将背景像素包含在框内。分割则通过描绘对象的精确轮廓或多边形,提供更紧密、更准确的表示。对于机器人抓取等应用,这一区别至关重要,因为机械臂必须了解物体的精确几何形状,才能在操作时避免碰撞。
实际应用#
图像分割提供的精确性正在推动各个行业的创新:
- 医学诊断: 在医学图像分析领域,分割对于勾勒解剖结构至关重要。算法会分析 MRI 扫描,描绘肿瘤或器官边界,使外科医生能够计算精确体积,并以挽救生命的准确度规划手术。
- 自动驾驶: 自动驾驶车辆依靠分割来实现安全导航。通过处理视频流,车辆的计算机能够区分可行驶车道、人行道和障碍物。 SAE International 等标准组织会定义自动驾驶等级,而这些等级要求具备这种高保真度的环境感知能力。
- 精准农业: 在农业中的 AI中,分割有助于机器人系统在作物中识别杂草。通过为特定植物叶片生成掩码,自动喷洒设备可以只针对入侵物种,从而显著减少除草剂的使用量。
使用 Ultralytics YOLO26 实现分割#
开发者可以使用 ultralytics Python 软件包高效实现实例分割。以下示例使用最先进的 YOLO26 模型,该模型针对速度和准确性进行了优化。
from ultralytics import YOLO
# Load a pre-trained YOLO26 segmentation model
# 'n' denotes the nano version, optimized for speed
model = YOLO("yolo26n-seg.pt")
# Run inference on an image to generate masks
# The model identifies objects and outlines their shape
results = model("https://ultralytics.com/images/bus.jpg")
# Display the image with segmentation overlays
results[0].show()为了在自定义任务上实现高性能,团队通常需要整理高质量的训练数据。Ultralytics Platform 提供了用于使用多边形掩码标注图像、管理数据集以及在云端训练模型的工具,简化了整个机器学习运维 (MLOps)生命周期。像 OpenCV 这样的库也经常与这些模型配合使用,用于图像预处理和结果掩码后处理。









