Ultralytics YOLO27:
指南

理解图像处理中的边缘检测

图像处理中的边缘检测。了解 Sobel、Canny 和其他边缘检测算法,准确检测边缘并实现稳健的边缘识别。

ABAbirami Vina11 min read
图像处理中的边缘检测

人类在查看图像时,会自然地识别物体的边缘、沿着它们的曲线观察,并注意其表面的纹理。然而,对计算机而言,理解始于单个像素层面。

像素是数字图像的最小单位,用于存储单个点的颜色和亮度。通过跟踪图像中这些像素值的变化,计算机可以检测出揭示关键细节的模式。

具体来说,图像处理使用像素数据来突出重要特征并去除干扰。边缘检测是一种常见的图像处理技术,它可以识别亮度或颜色急剧变化的点,从而勾勒物体轮廓、标记边界并增加结构信息。

这使计算机能够分离形状、测量尺寸,并理解场景中各部分之间的连接方式。边缘检测通常是高级图像分析的第一步。

原始图像与不同边缘检测方法的输出结果

图 1. 原始图像与不同边缘检测方法输出结果的示例。(来源

本文将介绍什么是边缘检测、它如何工作以及它在现实世界中的应用。让我们开始吧!

边缘检测概念#

边缘检测的重点是寻找图像中亮度或颜色从一个点到下一个点发生明显变化的位置。如果变化很小,该区域看起来会很平滑。如果变化剧烈,则通常表示两个不同区域之间的边界。

以下是导致这些像素变化的一些原因:

  • 表面法线不连续:当两个表面以一定角度相交时,例如墙角或盒子的边缘,方向的急剧变化会在图像中产生清晰的边界。
  • 深度不连续:当物体与相机的距离不同时,就会出现这种情况,从而产生可见的分离,帮助系统区分这些物体。
  • 表面颜色或纹理变化:当某个区域的颜色或纹理与相邻区域不同时,就会产生可见的分离。
  • 光照变化:它源于光线变化,包括表面的阴影或高光;即使表面本身平滑或连续,也会形成可见的分离。

图像中的不同类型边缘不连续

图 2. 图像中的不同类型边缘不连续。(来源

边缘检测识别如何工作#

边缘检测通常首先将彩色图像转换为灰度图像,使每个点只显示亮度。这样,算法就能更容易地关注明暗差异,而不是颜色差异。

接下来,特殊滤波器会扫描图像,寻找亮度突然变化的位置。这些滤波器会计算亮度变化的陡峭程度,即梯度。较高的梯度由相邻点之间更大的差异造成,通常表示存在边缘。

随后,算法会不断优化图像,去除细小细节,只保留最重要的线条和形状。最终得到清晰的轮廓和输出图像,可用于进一步分析。

边缘检测与图像处理的演变#

在深入了解边缘检测之前,我们先来讨论它是如何随着时间发展的。

图像处理始于简单的基于规则的方法,例如使用阈值处理和滤波来清理并改善图像。在模拟时代,这意味着使用光学滤波器、放大镜或化学处理来处理照片或胶片,以突出细节。

对比度调整、降噪、图像强度调整和基础边缘检测等技术,有助于使输入图像更加清晰,并突出形状和纹理。在 20 世纪 60 年代和 70 年代,从模拟处理转向数字处理,为天文学、医学成像和卫星监测等领域的现代分析开辟了道路。

到了 20 世纪 80 年代和 90 年代,更快的计算机使处理特征提取、形状检测和基础物体识别等复杂任务成为可能。Sobel 算子和 Canny 等算法带来了更精确的边缘检测,而模式识别也应用于从工业自动化到通过光学字符识别读取印刷文字等各种场景。

21 世纪的边缘检测与计算机视觉#

如今,技术的持续进步推动了计算机视觉的发展。视觉 AI(即计算机视觉)是 AI 的一个分支,专注于教会机器解读和理解视觉信息。

传统图像处理(例如双阈值处理,它通过保留强边缘并去除弱边缘来使图像更清晰)和边缘检测遵循固定规则,只能处理特定任务;而计算机视觉使用数据驱动模型,可以从示例中学习并适应新的情况。

如今,成像系统的能力远不止增强图像或检测边缘。它们可以识别物体、跟踪运动,并理解整个场景的上下文。

实现这一点的关键技术之一是卷积。卷积运算是一种让小型滤波器(也称为卷积核)扫描图像,以寻找边缘、角点和纹理等重要模式的过程。这些模式会成为计算机视觉模型用于识别和理解物体的基础。

例如,Ultralytics YOLO11等计算机视觉模型会利用这些基于卷积的特征来执行实例分割等高级任务。这与边缘检测密切相关,因为实例分割需要准确勾勒图像中每个物体的边界。

边缘检测专注于寻找边缘像素中的强度变化,以标记物体边缘;实例分割则在此基础上检测边缘、进行分类,并将每个物体分离到各自的区域中。

使用 Ultralytics YOLO11 进行实例分割

图 3. 使用 Ultralytics YOLO11 进行实例分割。(来源

边缘检测算法与方法#

即使计算机视觉不断发展,图像处理仍然是许多应用的重要组成部分。这是因为计算机视觉通常建立在基础图像预处理步骤之上。

在检测物体或理解场景之前,系统通常会清理图像、降低噪声并寻找边缘,使关键细节更加突出。这些步骤可以让高级模型更加准确、高效。

接下来,让我们了解一些用于检测边缘的常见图像处理算法,以及它们的工作方式。

Sobel 边缘检测#

Sobel 边缘检测是用于寻找图像中物体轮廓的一种关键方法。它不会一次分析所有细节,而是关注亮度从一个像素到下一个相邻像素发生急剧变化的区域。

这些突变通常标志着一个物体结束、另一个物体开始的位置,或物体与背景相接的位置。通过分离这些边缘,Sobel 可以将复杂图像转换为更清晰的轮廓,便于其他系统执行运动跟踪、形状检测或物体识别等任务。

你可以将 Sobel 边缘检测理解为一种梯度检测器,用于测量图像中的强度变化。其核心是卷积运算:让称为卷积核的小矩阵在图像上滑动,并计算相邻像素值的加权和。

这些卷积核经过设计,可以突出水平方向和垂直方向上的亮度变化。与从数据中学习卷积核的深度学习模型不同,Sobel 使用固定卷积核,无需训练即可高效突出边缘。

下面详细了解 Sobel 边缘检测方法的工作原理:

  • 使用两个 3×3 滤波器:该方法使用两个很小的 3×3 网格,称为滤波器。你可以把它们想象成在图像上沿水平方向(x 方向)和垂直方向(y 方向)滑动的模板。一个网格用于寻找水平边缘,另一个用于寻找垂直边缘。
  • 计算梯度:每个滤波器都会找出亮度变化的速度和梯度方向。变化越大,越可能存在边缘。
  • 合并结果:将水平和垂直方向的结果合并,以确定每个像素处总体的边缘强度和方向。
  • 检测边缘:梯度幅值较高的像素会被标记为强边缘。
  • 勾勒边界:这些边缘有助于定义物体形状,并分离图像中的不同区域。

Sobel 边缘检测突出输入图像的主要轮廓

图 4. Sobel 边缘检测可以突出输入图像的主要轮廓并生成边缘图。(来源)

Canny 边缘检测#

Canny 边缘检测是另一种常用于寻找图像中边缘的方法。它以生成清晰、精确的轮廓而闻名。与基础边缘检测技术不同,它会遵循一系列精心设计的步骤来滤除噪声、锐化边界,并聚焦于最重要的边缘。

下面快速了解 Canny 边缘检测器的工作原理:

  • 平滑图像:首先使用高斯滤波器对图像进行模糊处理。这种平滑技术可以降低噪声和可能被误认为边缘的细小细节。
  • 检测亮度变化:然后,算法会扫描亮度的急剧变化,并使用梯度计算来测量这些变化的强度和方向。
  • 细化边缘:只保留每条检测到的线上的最强点,去除较弱的点,从而得到清晰、锐利的边缘。
  • 分类边缘:根据亮度变化的阈值,将每个像素标记为强边缘、弱边缘或非边缘。
  • 最终清理:保留与强边缘相连的弱边缘,丢弃其他边缘,只留下清晰且连通的边界。

使用 Canny 边缘检测器后的原始图像及其输出结果

图 5. 使用 Canny 边缘检测器后的原始图像及其对应输出图像。(来源

Canny 边缘检测在滤除噪声的同时能够提供准确结果,因此广泛应用于重视精度的领域。例如,它被用于医学成像、卫星制图、文档扫描和机器人视觉等行业。

基于梯度与基于高斯的边缘检测#

到目前为止,我们介绍了 Sobel 和 Canny 两种边缘检测方法。虽然它们的目标都是寻找边缘,但处理问题的方式不同。

基于梯度的方法(如 Sobel、Prewitt 和 Scharr)通过寻找称为梯度的亮度急剧变化来检测边缘。它们会扫描图像,并标记变化最强的位置。这些方法简单、快速,在图像清晰时效果良好。不过,它们对噪声敏感——亮度中的微小变化可能会被误认为边缘。

基于高斯的方法(如 Canny 或高斯-拉普拉斯)会增加一个步骤来处理这一问题:先对图像进行模糊处理。这种通常使用高斯滤波器完成的平滑操作,可以减少可能产生错误边缘的微小变化。平滑后,这些方法仍然会寻找亮度的急剧变化,但对于有噪声或质量较低的图像,结果会更加清晰、准确。

基于梯度与基于高斯的边缘检测

图 6. 基于梯度与基于高斯的边缘检测。图片由作者提供。

边缘检测的现实世界应用#

在更好地理解边缘检测的工作原理后,让我们来了解它如何应用于现实场景。

使用边缘检测识别裂缝#

检查桥梁和高层建筑等大型混凝土结构,通常是一项充满挑战且危险的任务。这些结构可能延伸很长距离或达到很高的高度,使传统检查变得缓慢、昂贵且具有风险。这类检查通常还需要搭建脚手架、绳索作业、人工近距离测量或拍照。

2019 年,研究人员探索了一种有趣的方法:使用配备高分辨率相机的无人机,拍摄混凝土表面的详细输入图像,从而实现更安全、更快速的检查。随后,这些图像经过各种边缘检测技术处理,以自动识别裂缝。

研究表明,这种方法显著减少了人员直接进入危险区域的需求,并加快了检查速度。不过,其准确性仍取决于光照条件、图像清晰度和无人机运行稳定性等因素。在某些情况下,仍需要人工复核来排除误报。

在医学成像中应用边缘检测#

X 射线和 MRI 通常包含称为噪声的视觉干扰,这会使细节更难看清。当医生试图发现肿瘤边缘、勾勒器官轮廓或监测随时间发生的细微变化时,这就构成了挑战。

一项近期的医学成像研究测试了常见边缘检测方法(如 Sobel、Canny、Prewitt 和拉普拉斯算子)处理含噪图像的能力。研究人员向图像中添加了不同类型和程度的噪声,并检查每种方法勾勒重要特征的准确性。

即使噪声很重,Canny 通常也能生成最清晰的边缘,但它并非在所有情况下都表现最佳。有些方法在处理特定噪声模式时效果更好,因此不存在单一的完美解决方案。

随着噪声增加,Canny 比 Sobel 提供更清晰的边缘

图 7. 随着噪声增加,Canny(d–f)比 Sobel(g–i)提供更清晰的边缘。(来源

这说明了计算机视觉等技术为何如此重要。通过结合高级算法和视觉 AI 模型,这类解决方案可以超越基础边缘检测,即使在具有挑战性的条件下,也能提供更准确、更可靠的结果。

边缘检测的优势#

以下是使用边缘检测和图像处理的一些好处:

  • 更好的数据压缩:边缘检测允许图像仅使用关键特征来表示,在保留必要信息的同时减小文件大小,从而提高存储和传输效率。
  • 更精确的物体定位:通过准确识别物体边界,边缘检测可以提升系统定位和跟踪物体的能力,有利于视觉机器人中的 AI和自动驾驶汽车等应用。
  • 多尺度特征检测:边缘检测技术可以在不同尺度下分析图像,同时捕捉细小细节和较大形状。这种灵活性适用于从纹理分析到场景理解的各种任务。

使用图像处理进行边缘检测的局限性#

虽然图像处理中的边缘检测有许多优势,但也伴随着一些挑战。以下是需要考虑的主要局限性:

  • 复杂纹理带来的问题:在包含复杂或重复图案的图像中,边缘检测通常会产生许多错误或无关边缘,使进一步分析变得复杂,并降低可靠性。
  • 对光照敏感:亮度、阴影和反射的变化可能导致边缘检测器将光照变化误解为物体边界,从而产生不一致的结果。
  • 无法识别物体:边缘可以突出物体的起止位置,但不能说明物体是什么。还需要额外处理,才能为检测到的边缘赋予含义或标签。

何时可以使用计算机视觉进行边缘检测#

边缘检测的灵感来自我们的眼睛和大脑协同工作、理解世界的方式。在人类视觉中,视觉皮层中的特化神经元对边缘、线条和边界高度敏感。

这些视觉线索帮助我们快速判断一个物体在哪里结束、另一个物体在哪里开始。这就是为什么即使是简单的线稿也能被立即识别——我们的大脑高度依赖边缘来识别形状和物体。

计算机视觉旨在模仿这种能力,但更进一步。Ultralytics YOLO11 等模型不止于基础的边缘突出和图像增强。它们可以检测物体、精确勾勒物体轮廓,并实时跟踪运动。这种更深层次的理解使它们在仅靠边缘检测不足以应对的场景中不可或缺。

使用 Ultralytics YOLO11 更准确地检测边缘#

以下是 Ultralytics YOLO11 支持的一些关键计算机视觉任务,这些任务建立在边缘检测之上并超越了边缘检测:

  • 物体检测:通过在每个物体周围绘制边界框,识别并定位图像或视频中的多个物体,从而清晰展示场景中有哪些物体以及它们各自的位置。
  • 实例分割:将物体细化到像素级别,即使物体相互重叠或形状不规则,也能生成清晰、精确的轮廓。
  • 姿态估计:目标是确定物体或人的位置、方向或姿态,这有助于监测运动或检测随时间发生的结构变化。
  • 目标跟踪:此任务会跟踪物体在视频帧中的移动,确保持续、准确地识别目标,以便进行长期观测。
  • 图像分类:根据物体或整幅图像的视觉特征为其分配标签,从而更轻松地整理和解读大量数据。

使用计算机视觉检测基础设施中的裂缝#

计算机视觉增强传统上依赖边缘检测的应用,一个很好的例子就是检测基础设施和工业资产中的裂缝。你可以训练 Ultralytics YOLO11 等计算机视觉模型,准确识别道路、桥梁和管道上的裂缝。同样的技术还可应用于飞机维护、建筑检查和制造质量控制,从而帮助加快检查速度并提高安全性。

使用 Ultralytics YOLO11 进行裂缝分割的示例

图 8. 使用 YOLO11 进行裂缝分割的示例。(来源

要点总结#

边缘检测已经取得了长足发展,从早期的简单方法演变为能够识别复杂图像中细微边界的先进技术。它有助于突出重要细节、标记关键区域,并为进一步分析准备图像,因此是图像处理的核心组成部分。

在计算机视觉中,边缘检测在定义形状、分离物体和提取有用信息方面发挥着重要作用。它广泛应用于医学成像、工业检查、自动驾驶和安防等领域,以实现准确可靠的视觉理解。

加入我们的社区,并探索我们的 GitHub 代码库,了解更多 AI 相关内容。如果你想启动自己的视觉 AI 项目,请查看我们的许可选项。访问我们的解决方案页面,进一步了解医疗保健领域的 AI零售领域的视觉 AI等应用。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅