Continual Learning
了解持续学习如何使 AI 在不遗忘的情况下习得新技能。探索关键策略并更新你的 Ultralytics YOLO26 模型以应用于边缘 AI。
持续学习 (CL),通常被称为终身学习,描述了人工智能模型随着时间的推移按顺序学习新任务或获取新知识,且不忘记之前所学信息的能力。与传统的机器学习流水线不同(模型在静态数据集上训练一次后即部署),持续学习模拟了人类适应新环境并不断从新经验中学习的能力。该领域的主要挑战是克服灾难性遗忘,这是一种当神经网络在新数据上训练时,由于用于旧任务的权重被覆盖,导致其在旧任务上的表现急剧下降的现象。
为什么持续学习很重要#
在动态的现实世界环境中,数据分布很少保持静态。例如,自动驾驶汽车上的视觉感知系统必须适应不断变化的天气、新的交通法规或不同的城市布局,同时不能失去识别初始训练期间学到的基础道路标志的能力。传统的基于累积数据集从头重新训练通常计算成本高昂,且由于存储限制或隐私问题而难以实现。持续学习通过允许模型进行增量更新来解决这些问题,使其对于资源有限的边缘 AI 应用更加高效和可扩展。
实际应用#
- 机器人与自主系统: 部署在非结构化环境中的机器人需要操作新颖的物体或在新的地形中导航。通过持续学习,机器人可以掌握特定的制造任务,随后学会处理不同的产品线,而无需进行完整的系统重置,从而有效地支持灵活的工业 4.0 创新管线。
- 医学影像诊断: 随着新疾病的出现或成像协议的变化,医疗保健数据也在不断演变。协助放射科医生的 AI 系统可以利用持续学习来纳入新的病理,例如 X 光片中发现的某种病毒的新变种,同时在检测肺炎或骨折等常见病症时保持高准确率。此功能对于在不损害既定协议下的患者安全的前提下维护最新的医疗诊断至关重要。
持续学习的关键策略#
为了减轻灾难性遗忘,研究人员采用了几种策略。正则化方法向损失函数添加约束,以防止对先前任务中识别出的重要权重产生重大更改。重放方法存储先前数据的一分子子集(或使用生成式 AI 生成合成样本),并在训练期间将它们与新数据混合。最后,参数隔离将模型的特定参数子集分配给不同的任务,从而确保对新任务的更新不会干扰为先前任务优化好的参数。2024 年和 2025 年的最新进展集中于使用视觉语言模型来更好地识别哪些特征是通用的,哪些是任务专用的。
持续学习与迁移学习#
区分持续学习与迁移学习非常重要。在迁移学习中,预训练模型作为解决新特定任务的起点,对原始任务的性能通常无关紧要。其目标是最大化目标域上的性能。相比之下,持续学习的目标是在新任务和所有先验任务上都表现良好。同样,虽然主动学习侧重于选择用于训练的最具信息量的数据点进行标注,但持续学习侧重于随时间推移更新模型本身的过程。
更新 YOLO 模型#
虽然真正的持续学习需要专门的架构调整,但用户可以通过在混合了旧数据缓冲区的新数据上微调模型来模拟此工作流。Ultralytics Platform 简化了这些数据集的管理和模型版本控制。以下是如何使用 Python API 接近更新模型的一个示例:
from ultralytics import YOLO
# Load a model previously trained on 'dataset_v1.yaml'
model = YOLO("yolo26n-v1.pt")
# Train the model on a new dataset containing new and old samples
# This helps mitigate catastrophic forgetting by "replaying" old data
results = model.train(
data="dataset_v2_combined.yaml",
epochs=50,
imgsz=640,
lr0=0.001, # Lower learning rate for fine-tuning
)挑战与未来方向#
尽管取得了进展,持续学习仍然是一个活跃的研究领域。确定最佳的可塑性-稳定性困境(平衡学习新事物的能力(可塑性)与保留旧事物的能力(稳定性))是困难的。此外,评估这些系统需要考虑到前向迁移(新任务上的学习速度)和后向迁移(对旧任务的影响)的强大性能指标。随着基础模型变得越来越大,诸如低秩适应 (LoRA) 等高效的持续自适应方法对于在不进行完整重新训练的情况下定制大规模系统正变得至关重要。






