Ultralytics YOLO27:
视觉 AI

主动学习加快计算机视觉开发

了解主动学习如何应用于计算机视觉,以减少标注工作量,并探索其在各行业中的实际应用。

ABAbirami Vina7 min read
主动学习加速计算机视觉开发

训练计算机视觉模型很像教孩子识别颜色。首先,你需要收集一组彩色物体。然后,你要引导孩子正确识别每种颜色,而这项任务通常既耗时又重复。

就像孩子需要大量示例才能学习一样,视觉模型也需要大量带标注的数据,才能识别图像中的模式和物体。然而,标注海量数据需要投入大量时间和精力,更不用说资源了。主动学习等技术可以帮助简化这一过程。

主动学习是一个循序渐进的过程,从大型数据集中选择最重要的数据并进行标注。模型从这些带标注的数据中学习,从而变得更加准确和高效。只关注最有价值的数据可以减少所需的标注量,并加快模型开发速度。

本文将介绍主动学习如何帮助模型训练、降低标注成本并提高模型的整体准确率。

图像数据集并不容易构建#

数据集是计算机视觉和深度学习模型的基础。像 ImageNet 这样的热门数据集提供了数百万张涵盖多种物体类别的图像。然而,创建和维护如此庞大的高质量数据集会带来各种挑战。

例如,收集和标注数据需要时间、资源和熟练的标注人员,因此具体应用不同,流程的难度也不同。为了满足对图像数据集日益增长的需求,需要创新且更高效的解决方案,而这正是主动学习旨在解决的问题。

主动学习通过优化数据标注流程提供了理想的解决方案。通过策略性地选择信息量最大的样本进行标注,主动学习可以在减少标注工作量的同时最大化模型性能。

什么是主动学习?#

主动学习是一种迭代式机器学习技术,模型会从大量未标注数据中挑选最重要的数据点进行标注。这些选中的数据点经过人工标注后,会被加入训练数据集。

随后,模型使用更新后的数据集重新训练,并选择下一批需要标注的数据点。这个过程不断重复,模型持续关注信息量最大的样本,从而不断提升性能。该循环会持续进行,直到模型达到目标准确率或满足预先设定的标注标准。

主动学习概览

图 1. 主动学习概览。

了解主动学习的工作原理#

你可能想知道,主动学习技术如何决定哪些数据点需要人工标注,以及下一步应标注哪些数据点。我们可以把主动学习的工作方式类比为备考:你会重点复习自己不确定的主题,同时确保涵盖各种科目,以做好充分准备。

在最初的数据选择过程中,主动学习会采用不确定性采样和基于多样性的采样等策略。不确定性采样优先选择模型对预测最没有把握的数据点,旨在提高模型在困难案例中的准确率。基于多样性的采样则选择覆盖广泛特征的数据点,通过让模型接触多样化示例,确保其能够很好地泛化到未见过的数据。

左侧为不确定性采样,右侧为基于多样性的采样

图 2. 不确定性采样(左侧)和基于多样性的采样(右侧)。

完成初始数据选择后,主动学习主要采用两种标注方法:基于池的采样和基于流的采样。它们类似于老师帮助学生专注于最重要内容的方式。

在基于池的采样中,模型会扫描一个大型未标注数据池,并选择最具挑战性或信息量最大的一些示例进行标注,这就像学生优先复习自己觉得最难的闪卡一样。在基于流的采样中,模型会处理不断到达的数据,并决定是对其进行标注还是跳过,这类似于学生只在遇到困难时才寻求帮助。在这两种情况下,带标注的数据都会被加入训练集,模型也会重新训练,并在每次迭代中持续改进。

探索主动学习的应用#

主动学习在计算机视觉应用中发挥着重要作用,例如医学影像和自动驾驶领域,可以提高模型准确率并简化数据标注流程。一个有趣的例子是,自动驾驶汽车使用计算机视觉模型在低光照或雾天条件下检测行人或物体。主动学习可以通过关注多样化且具有挑战性的驾驶场景来提升准确率。

具体而言,主动学习可以识别此类场景中的不确定数据或视频帧,并对其进行选择性标注。将这些带标注的示例加入训练集后,模型便能更好地识别恶劣天气或夜间驾驶等困难环境中的行人和物体。

例如,NVIDIA 使用主动学习来改进其自动驾驶模型在夜间检测行人的能力。通过策略性地选择信息量最大的训练数据,尤其是在具有挑战性的场景中,模型性能得到了显著提升。

使用主动学习检测雨伞下的行人

图 3. 使用主动学习检测雨伞下的行人。

主动学习可以降低标注成本#

主动学习的另一个重要方面是它有潜力降低标注成本。它只关注最重要的数据点,而不要求对整个数据集进行标注。这种有针对性的方法可以节省时间、精力和资金。通过聚焦于不确定或多样化的样本,主动学习减少了所需的标注数量,同时仍能保持较高的模型准确率。

事实上,研究表明,主动学习可以在不牺牲性能的情况下将标注成本降低40%–60%。这对医疗和制造业等数据标注成本高昂的行业尤其有帮助。通过简化标注流程,主动学习可以帮助企业更快地开发模型,并更高效地部署模型,同时保持准确率。

主动学习的优势#

以下是主动学习能够带来的其他一些主要优势:

  • 解决类别不平衡:主动学习可以通过标注少数类别中的样本来帮助解决类别不平衡问题。即使数据有限,模型也能更好地处理罕见场景。
  • 缩短开发周期:减少数据标注量可以间接加快机器学习和计算机视觉模型的开发流程,从而为更多迭代和实验留出时间与资源。
  • 适应性:主动学习可以通过对不确定样本或边缘案例进行迭代,持续改进训练数据,因此非常适合动态变化或不断演进的数据集。

主动学习可以与 AutoML 协同工作#

自动化机器学习 (AutoML)专注于自动化构建和部署机器学习模型过程中耗时且需要反复迭代的任务。它可以自动执行模型选择和性能评估等任务,减少对人工操作的需求,从而简化机器学习工作流。

与主动学习集成后,AutoML 可以加快并优化模型开发生命周期。主动学习组件会策略性地选择信息量最大的样本进行标注,而 AutoML 则通过自动化架构、参数和调优方式的选择来优化模型。

AutoML 工作流

图 4. AutoML 工作流。

让我们通过一个示例来了解这项技术组合。

假设你正在尝试检测医学影像中的罕见病症(这是一个带标注数据集有限且获取成本高昂的用例)。主动学习可以识别并选择不确定的数据,例如模型无法分类的 X 射线图像中的细微变化。然后,可以优先对这些不确定数据进行人工标注,以提升模型的理解能力。

借助带标注的数据,AutoML 可以通过探索各种架构、超参数和其他数据增强技术来优化模型。这一迭代过程能够加快可靠视觉模型(如 Ultralytics YOLO11)的开发,帮助医疗专业人员做出准确诊断。

主动学习面临的挑战#

主动学习及其相关技术具有诸多优势,但在实施这些策略时,还需要注意以下几点:

  • 查询策略选择:主动学习包含许多技术,选择最佳方法会显著影响模型的有效性。不恰当的策略可能会降低模型在特定应用中的性能。
  • 重新训练成本:主动学习的迭代特性需要耗费大量计算资源,尤其是在处理大型数据集时。模型会在每轮标注后重新训练,从而增加复杂度。
  • 初始模型质量:主动学习的有效性取决于初始模型的质量。性能不佳的初始模型可能无法准确识别信息量最大的样本,导致标注请求质量不高,并降低整体性能。

主动学习和 AutoML 的未来发展#

随着 AI 和计算机视觉领域不断取得进展,主动学习将应对更加复杂的挑战,并简化机器学习工作流。将主动学习与联邦学习、自监督学习等技术结合,可以进一步提升视觉模型的效率和可扩展性。

联邦学习通过分布式框架使模型能够在多个设备或服务器上进行训练,而无需数据离开其原始位置。以重视数据隐私的医疗行业为例,联邦学习可以直接使用敏感的本地数据进行训练,同时确保数据安全。它无需共享原始数据,只需共享模型更新或洞见,便能在保护私人信息的同时继续为训练过程做出贡献。

与此同时,自监督学习通过使用未标注数据对模型进行预训练,帮助减少对带标注数据的需求。这一过程可以为模型建立坚实基础。随后,主动学习可以通过识别和选择最重要的数据点供人工标注,在此基础上进一步优化模型。

从主动学习到主动创造影响#

主动学习为解决计算机视觉中的重大挑战提供了实用方法,例如数据标注成本高昂以及对更准确模型的需求。通过只关注最有价值的数据点进行标注,它减少了人工所需投入,同时提升了模型性能。

与 AutoML 等技术结合后,主动学习可以通过自动化耗时任务来简化模型开发。随着技术不断进步,主动学习将成为构建更智能、更高效计算机视觉系统的重要工具。

探索我们的 GitHub 代码仓库,加入我们的社区,详细了解 AI 和计算机视觉模型。在我们的解决方案页面上,进一步了解制造业中的计算机视觉医疗保健领域中的计算机视觉应用。你还可以查看我们的许可选项,立即开始你的视觉 AI 之旅。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅