主动学习加速计算机视觉开发
学习主动学习在计算机视觉中如何用于最小化标注工作量,并探索其在各行业的实际应用。

训练计算机视觉模型就像教孩子识别颜色一样。首先,你需要收集一些彩色物体。然后,你要引导孩子正确辨认每种颜色,这通常是一项既耗时又重复的任务。
就像孩子需要大量示例才能学会一样,视觉模型也需要大量的标注数据来识别图像中的模式和物体。然而,标注海量数据不仅耗时耗力,还需要大量资源。主动学习等技术可以帮助简化这一过程。
Active learning 是一个逐步的过程,从中挑选并标注来自大型数据集最重要的的数据。模型从这些已标注的数据中学习,从而变得更加准确和高效。仅关注最有价值的数据可以减少所需的标注量,并加速模型的开发。
在本文中,我们将探讨主动学习如何辅助模型训练、降低标注成本并提高模型的整体准确性。
构建图像数据集并非易事#
数据集是计算机视觉和深度学习模型的基础。像 ImageNet 这样受欢迎的数据集提供了数百万张包含各种对象类别的图像。然而,创建和维护如此海量的高质量数据集面临着各种挑战。
例如,收集和标注数据需要时间、资源和熟练的标注人员,这使得该过程根据具体应用而充满挑战。我们需要创新且更高效的解决方案来跟上对图像数据集不断增长的需求,而这正是主动学习旨在解决的问题。
主动学习通过优化数据标注过程提供了一个完美的解决方案。通过策略性地选择最具信息量的数据点进行标注,主动学习能够在最大化模型性能的同时,将标注工作量降至最低。
什么是主动学习?#
主动学习是一种迭代式的机器学习技术,模型从大型未标注数据池中筛选出最重要的待标注数据点。这些被选中的数据点经人工标注后,会被加入到训练集中。
随后,模型会在更新后的数据集上进行重新训练,并选出下一批待标注的数据点。这一过程不断重复,模型通过专注于最具信息量的数据点持续改进。该循环会一直持续,直到模型达到预期的准确性或满足预设的标注标准。

Fig 1. 主动学习概览。
理解主动学习的工作原理#
你可能想知道主动学习技术是如何决定哪些数据点需要人工标注以及下一步该标注哪些内容的。让我们将主动学习类比为备考来理解其原理——你需要专注于不确定的主题,同时确保涵盖各类学科,从而做好充分准备。
对于初始的数据选择过程,主动学习会采用不确定性采样和基于多样性的采样等策略。不确定性采样优先考虑模型预测置信度最低的数据点,旨在提高在困难情况下的准确性。基于多样性的采样则选择涵盖广泛特征的数据点,通过让模型接触多样的示例,确保其对未知数据的泛化能力。

Fig 2. 不确定性采样(左)和基于多样性的采样(右)。
在初始数据选择后,主动学习使用两种主要标注方法:基于池的采样和基于流的采样。它们类似于老师帮助学生专注于最重要知识点的过程。
在基于池的采样中,模型扫描大型未标注数据池并选出最具挑战性或信息量最大的示例进行标注,这就像学生优先复习他们觉得最难的抽认卡。而在基于流的采样中,模型处理随之而来的数据,决定是标注还是跳过,类似于学生只在遇到困难时寻求帮助。在这两种情况下,标注后的数据都会被加入训练集,模型进行自我重训,并在每次迭代中稳步提升。
探索主动学习的应用#
主动学习在计算机视觉应用(如医学影像和自动驾驶)中起着关键作用,它能提高模型准确率并简化数据标注流程。一个有趣的例子是用于自动驾驶汽车中的计算机视觉模型,用于在低光或有雾的条件下检测行人和物体。主动学习可以通过专注于多样化且具有挑战性的驾驶场景来提高准确性。
具体来说,主动学习可以用于识别此类场景中的不确定数据或帧,进行选择性标注。将这些已标注的示例添加到训练集中,能使模型在恶劣天气或夜间驾驶等困难环境下更好地识别行人和物体。
例如,NVIDIA 曾利用主动学习来提升其自动驾驶模型在夜间检测行人的能力。通过策略性地选择训练中最具信息量的数据,特别是在极具挑战性的场景中,模型性能得到了显著提高。

Fig 3. 使用主动学习检测带有雨伞的行人。
主动学习能够降低标注成本#
主动学习的另一个关键点在于其降低标注成本的潜力。它通过仅关注最重要的数据点来实现这一目标,而不是要求对整个数据集进行标注。这种有针对性的方法节省了时间、精力和金钱。通过聚焦于不确定的或多样的样本,主动学习在减少所需标注数量的同时,依然保持了高模型准确性。
事实上,研究表明主动学习可以在不牺牲性能的前提下将标注成本降低 40-60%。这在医疗保健和制造业等数据标注成本高昂的行业中尤其有用。通过简化标注流程,主动学习帮助企业更快地开发模型并更高效地部署,同时保持准确性。
主动学习的益处#
以下是主动学习可以提供的其他一些关键优势:
- 解决类别不平衡:主动学习可以通过标注少数类的数据实例来帮助解决类别不平衡问题。模型可以在数据有限的稀有场景下表现得更好。
- 更快的开发周期:标注更少的数据间接意味着加速机器学习和计算机视觉模型的开发过程,从而腾出更多时间和资源用于额外的迭代和实验。
- 适应性:它可以通过对不确定的或边缘情况样本进行迭代,持续改进训练数据,使其非常适合动态或不断演变的数据集。
主动学习与 AutoML 可以协同工作#
Automated Machine Learning (AutoML) 专注于自动化构建和部署机器学习模型中耗时且重复的任务。它通过自动化模型选择和性能评估等任务来简化机器学习工作流,从而减少对手动工作的需求。
当与主动学习集成时,AutoML 可以加速并优化模型开发生命周期。主动学习组件策略性地选择最具信息量的数据点进行标注,而 AutoML 则通过自动化架构选择、参数设置和调优来完善模型。

Fig 4. AutoML 工作流。
让我们通过一个示例来理解这种技术组合。
假设你正试图在医学影像中检测罕见病症(这是一个已标注数据集有限且获取成本高昂的应用场景)。主动学习可以识别并选择模型无法分类的不确定数据,例如 X 光图像中的细微变化。然后,可以优先对这些不确定数据进行手动标注,以提高模型理解能力。
借助已标注的数据,AutoML 可以通过探索各种架构、超参数和其他数据增强技术来优化模型。这个迭代过程加速了诸如 Ultralytics YOLO11 等可靠视觉模型的开发,这些模型有助于医疗专业人员做出准确的诊断。
主动学习的挑战#
主动学习及其技术提供了诸多优势,但在实施这些策略时仍需考虑以下几点:
- 查询策略选择:主动学习涉及许多技术,选择最佳方法对模型的有效性有重大影响。选择不恰当的策略可能会降低模型在特定应用中的性能。
- 重训成本:主动学习的迭代特性需要昂贵的计算资源,特别是对于大型数据集而言。模型在每一轮标注后都需要重训,这增加了其复杂性。
- 初始模型质量:主动学习的有效性取决于初始模型的质量。表现较差的初始模型可能无法准确识别有价值的信息点,从而导致标注请求质量低下,进而降低整体性能。
主动学习与 AutoML 的未来之路#
随着 AI 和计算机视觉的最新进展,主动学习将有望解决更复杂的挑战并简化机器学习工作流程。将主动学习与联邦学习和自监督学习等技术相结合,可以进一步增强视觉模型的效率和可扩展性。
Federated learning 允许模型通过分布式框架在多个设备或服务器上进行训练,而无需数据离开其原始位置。以重视数据隐私的医疗行业为例,联邦学习使得直接在敏感的本地数据上进行训练成为可能,同时确保其安全性。系统不共享原始数据,而是只共享模型更新或见解,从而确保在为训练过程做出贡献的同时,保护私密信息不受泄露。
同时,self-supervised learning 通过在未标注数据上对模型进行预训练,有助于减少对标注数据的需求。此过程为模型奠定了坚实的基础。然后,主动学习可以通过识别和选择用于人工标注的最重要数据点在此基础上进行构建,从而进一步完善模型。
从主动学习到主动影响#
主动学习为解决计算机视觉中的重大挑战提供了一种切实可行的方法,例如高昂的数据标注成本和对更高精度模型的需求。通过仅专注于标注最有价值的数据点,它减少了人类所需的工作量,同时提升了模型的性能。
当与 AutoML 等技术结合时,主动学习通过自动化耗时任务来简化模型开发。随着进步的持续,主动学习注定会成为构建更智能、更高效计算机视觉系统的核心工具。
探索我们的 GitHub 仓库并加入我们的社区,以了解有关 AI 和计算机视觉模型的更多信息。在我们的解决方案页面上发现计算机视觉在制造业和医疗保健中的更多应用。你还可以查看我们的授权选项,立即开启你的视觉 AI 之旅。






