Ultralytics YOLO27:
视觉 AI

了解 3D 目标检测及其应用

探索 2D 和 3D 目标检测的工作原理、主要差异及其在自动驾驶汽车、机器人和增强现实等领域的应用。

ABAbirami Vina4 min read
检测车辆及周围环境中的 3D 目标

多年来,目标检测变得越来越先进。它已经从识别简单二维(2D)图像中的物体,发展到识别我们周围复杂三维(3D)世界中的物体。20 世纪 70 年代,人们开发了模板匹配等早期技术。这类技术通过将图像中的部分内容与存储的参考图像进行比较来查找物体,并为 2D 目标检测奠定了基础。20 世纪 90 年代,激光雷达(LIDAR)等技术的引入,让系统能够更轻松地捕获深度和空间信息。如今,多模态融合方法将 2D 图像与 3D 数据结合起来,为高精度 3D 目标检测系统铺平了道路。

3D 目标检测示例

图 1。3D 目标检测示例。

本文将探讨什么是 3D 目标检测、它的工作原理,以及它与 2D 目标检测有何不同。我们还将介绍 3D 目标检测的一些应用。让我们开始吧!

2D 目标检测概览#

在了解 3D 目标检测之前,我们先来看看 2D 目标检测的工作原理。2D 目标检测是一种计算机视觉技术,能够让计算机识别并定位平面二维图像中的物体。它通过分析物体在图像中的水平(X)和垂直(Y)位置来工作。例如,如果你将一张包含足球场上球员的图像输入像 Ultralytics YOLOv8 这样的 2D 目标检测模型,它就能分析图像,并在每个物体(本例中为球员)周围绘制边界框,精确确定它们的位置。

YOLOv8 对足球场上球员进行 2D 目标检测

图 2。使用 YOLOv8 2D 目标检测来检测足球场上的球员。

不过,2D 目标检测也有局限性。由于它只考虑两个维度,因此无法理解深度。这会让判断物体距离我们有多远或物体有多大变得困难。例如,远处的一个大物体可能看起来和近处的一个小物体一样大,从而造成混淆。在机器人技术增强现实等应用中,了解物体的真实大小和距离是必要的,而缺少深度信息可能导致检测不准确。这正是需要 3D 目标检测的原因。

通过 3D 目标检测获得空间感知能力#

3D 目标检测是一种先进的计算机视觉技术,能够让计算机识别三维空间中的物体,从而更深入地理解周围的世界。与 2D 目标检测不同,3D 目标检测还会考虑深度数据。深度信息可以提供更多细节,例如物体在哪里、大小如何、距离多远,以及它在真实 3D 世界中的朝向。值得注意的是,3D 检测还能更好地处理一个物体部分遮挡另一个物体的情况(遮挡),即使视角发生变化也能保持可靠。对于需要精确空间感知的应用场景来说,它是一种强大的工具。

3D 目标检测对于自动驾驶汽车机器人技术和增强现实系统等应用至关重要。它通过使用激光雷达或双目相机等传感器来工作。这些传感器会创建详细的环境 3D 地图,称为点云或深度图。随后,系统会分析这些地图,以检测 3D 环境中的物体。

对汽车进行 3D 目标检测

图 3。对汽车进行 3D 目标检测。

有许多先进的计算机视觉模型专门用于处理点云等 3D 数据。例如,VoteNet 使用一种称为霍夫投票的方法来预测点云中物体中心的位置,从而更容易准确地检测和分类物体。同样,VoxelNet 会将点云转换为由称为体素的小立方体组成的网格,以简化数据分析。

2D 与 3D 目标检测的主要区别#

现在我们已经了解了 2D 和 3D 目标检测,接下来看看它们的主要区别。3D 目标检测比 2D 目标检测更复杂,因为它需要处理点云。分析 LiDAR 生成的点云等 3D 数据,需要更多内存和计算能力。另一个区别在于所涉及算法的复杂性。3D 目标检测模型需要更加复杂,才能处理深度估计、3D 形状分析以及物体朝向分析。

2D 与 3D 目标检测对比

图 4。2D 与 3D 目标检测对比。

3D 目标检测模型涉及的数学和计算工作量比 2D 目标检测模型更大。如果没有先进硬件和优化措施,实时处理 3D 数据可能颇具挑战。不过,这些差异也使 3D 目标检测更适合需要更强空间理解能力的应用。另一方面,2D 目标检测通常用于安防系统等较简单的应用,这些系统需要图像识别视频分析

3D 目标检测的优缺点#

3D 目标检测具有多项优势,使其区别于传统的 2D 目标检测方法。通过捕获物体的全部三个维度,它可以提供物体相对于现实世界的位置、大小和朝向等精确信息。对于自动驾驶汽车等应用来说,这种精度至关重要,因为准确了解障碍物的位置对于安全驾驶非常重要。使用 3D 目标检测的另一个优势是,它可以帮助你更好地理解 3D 空间中不同物体之间的关系。

使用 3D 目标检测解决遮挡问题

图 5。使用 3D 目标检测解决遮挡问题。

尽管 3D 目标检测有许多优势,但它也存在一些局限性。以下是你需要注意的一些主要挑战:

  • 更高的计算成本:处理 3D 数据需要更强大的硬件资源,成本可能会迅速增加。
  • 更复杂的数据要求:3D 目标检测通常依赖 LiDAR 等先进传感器,而这些传感器可能价格昂贵,并不一定适用于所有环境。
  • 数据采集与处理:3D 目标检测复杂的数据要求意味着,收集、准备和处理训练模型所需的大型数据集既耗时又消耗大量资源。
  • 更高的模型复杂度:用于 3D 目标检测的模型通常更加复杂,比用于 2D 目标检测的模型包含更多层和参数。

3D 目标检测的应用#

现在我们已经讨论了 3D 目标检测的优缺点,接下来深入了解一些 3D 目标检测的应用场景。

自动驾驶车辆#

自动驾驶汽车中,3D 目标检测对于感知车辆周围环境至关重要。它可以帮助车辆检测行人、其他汽车和障碍物,还能提供它们在现实世界中的位置、大小和朝向等精确信息。通过 3D 目标检测系统获取的详细数据,有助于为车内乘客带来更加安全的自动驾驶体验。

在自动驾驶车辆中使用 3D 目标检测

图 6。在自动驾驶车辆中使用 3D 目标检测。(来源:towardsdatascience.com)

机器人技术#

机器人系统将 3D 目标检测用于多种应用。它们利用 3D 目标检测在不同类型的环境中导航、拾取和放置物体,并与周围环境互动。这类应用场景在仓库制造工厂等动态环境中尤为重要,因为机器人需要理解三维布局才能有效运行。

使用 3D 目标检测的移动机器人

图 7。使用 3D 目标检测的移动机器人。

增强现实和虚拟现实(AR/VR)#

3D 目标检测的另一个有趣应用场景是增强现实和虚拟现实应用。3D 目标检测可用于将虚拟物体准确放置在逼真的 VR 或 AR 环境中。这样可以提升这类技术的整体用户体验。它还能够让 VR/AR 系统识别和跟踪实体物体,创造出数字元素与实体元素无缝交互的沉浸式环境。例如,使用 AR/VR 头显的游戏玩家可以借助 3D 目标检测获得更加沉浸式的体验。它能让用户与 3D 空间中的虚拟物体进行更具吸引力的互动。

用于 AR 应用的 3D 物体识别

图 8。3D 物体识别用于 AR 应用的示例。

关于 3D 目标检测的总结#

与 2D 目标检测方法相比,3D 目标检测让系统能够更有效地理解深度和空间。在自动驾驶汽车、机器人和 AR/VR 等应用中,了解物体的大小、距离和位置非常重要,因此 3D 目标检测发挥着关键作用。尽管 3D 目标检测需要更强的处理能力和更复杂的数据,但它能够提供准确、详细的信息,因此在许多领域都是非常有价值的工具。随着技术不断进步,3D 目标检测的效率和可及性可能会进一步提升,从而推动其在各个行业中得到更广泛的应用和创新。

加入我们的社区,及时了解 AI 领域的最新动态!访问我们的 GitHub 仓库,了解我们如何利用 AI 为制造业医疗保健等行业打造尖端解决方案。🚀

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅