Image Segmentation
探索计算机视觉中的图像分割。了解 Ultralytics YOLO26 如何提供用于实例、语义和全景分割的精确像素级掩码。
图像分割是计算机视觉 (CV)中的一项高级技术,它涉及将数字图像划分为多个像素子群,通常被称为图像片段或区域。与为整张图像分配单个标签的标准图像分类不同,分割通过为每个单独的像素分配特定的类标签,在更细粒度的水平上分析视觉数据。此过程创建了一个精确的像素级地图,使人工智能 (AI) 模型不仅能理解存在哪些对象,还能准确理解它们的位置以及它们的具体边界是什么。
像素级分析的机制#
为了实现这种高保真理解,分割模型通常利用深度学习 (DL) 架构,特别是卷积神经网络 (CNN)。这些网络充当强大的特征提取器,识别边缘、纹理和复杂形状等模式。传统的分割架构(如经典的U-Net)通常采用编码器-解码器结构。编码器压缩输入图像以捕获语义上下文,而解码器重建空间细节以输出最终的分割掩码。
现代进展催生了像2026年1月发布的YOLO26这样的实时架构。这些模型将分割功能直接集成到端到端管道中,从而能够在从云GPU到边缘设备的各种硬件上进行高速处理。
分割的主要类型#
根据项目的具体目标,开发人员通常在三种主要的分割技术之间进行选择:
- **语义分割:**此方法根据类别对像素进行分类,但不区分同一类的不同对象。例如,在卫星图像分析中,代表“森林”的所有像素都将涂成绿色,将整片森林视为一个单一实体。
- **实例分割:**该技术可识别并分离出不同的单个目标对象。在繁忙的街道场景中,实例分割会为“汽车 A”、“汽车 B”和“行人 A”生成独特的掩码,使系统能够对特定实体进行计数和跟踪。这是Ultralytics YOLO26模型系列的核心功能。
- **全景分割:**一种将语义分割的覆盖范围与实例分割的精度相结合的混合方法。它为每个像素分配一个标签,在区分无定形背景元素(如天空和道路)的同时唯一地识别可计数的远景对象。
与目标检测的区别#
区分分割与目标检测至关重要。虽然检测算法使用矩形边界框来定位项目,但它们不可避免地会将背景像素包含在该框内。分割通过追踪对象的精确轮廓或多边形,提供了更紧凑、更准确的表示。这种差异对于机器人抓取等应用至关重要,在这些应用中,机械臂必须了解项目的精确几何形状才能进行操作而不会发生碰撞。
实际应用#
图像分割提供的精确度推动了各行业的创新:
- **医学诊断:**在医学图像分析领域,分割对于勾勒解剖结构至关重要。算法分析MRI 扫描来描绘肿瘤或器官边界,让外科医生能够计算确切的体积并以挽救生命的准确度规划手术。
- **自动驾驶:**自动驾驶汽车依靠分割来安全导航。通过处理视频源,车辆的计算机可以区分可行驶车道与人行道和障碍物。像国际自动机工程师学会 (SAE International)这样的标准组织定义了需要这种高保真环境感知的自动化级别。
- **精准农业:**在农业中的人工智能中,分割帮助机器人系统识别作物中的杂草。通过为特定的植物叶子生成掩码,自动化喷雾器可以只针对入侵物种,从而显著减少除草剂的使用。
使用 Ultralytics YOLO26 实现分割#
开发者可以使用 ultralytics Python 包高效地实现实例分割。以下示例使用了针对速度和准确性进行优化的最先进的YOLO26 模型。
from ultralytics import YOLO
# Load a pre-trained YOLO26 segmentation model
# 'n' denotes the nano version, optimized for speed
model = YOLO("yolo26n-seg.pt")
# Run inference on an image to generate masks
# The model identifies objects and outlines their shape
results = model("https://ultralytics.com/images/bus.jpg")
# Display the image with segmentation overlays
results[0].show()为了在自定义任务上实现高性能,团队通常需要策划高质量的训练数据。Ultralytics 平台通过提供使用多边形掩码标注图像、管理数据集以及在云中训练模型的工具来简化此过程,从而简化整个机器学习运维 (MLOps) 生命周期。OpenCV 等库也经常与这些模型一起使用,用于预处理图像和后处理生成的掩码。






