Online Learning
了解在线学习如何实现增量模型更新、适应概念漂移,并通过 Ultralytics YOLO26 支持更安全的计算机视觉工作流程。
在线学习是一种机器学习方法,模型会随着新样本的到来而逐步更新,而不是在固定数据集上进行一次性训练。该术语指的是流式或顺序模型更新,而非基于互联网的教育。正如scikit-learn在线学习定义所描述的那样,在线学习者可以在每个样本或小批量数据之后进行预测、接收反馈并进行更新。这使得它在数据是连续的、超出了内存容量或随时间变化时非常有用。(scikit-learn.org)
Link to this section在线学习的工作原理#
一个典型的循环是:
- 模型接收新输入并进行预测。
- 标签或反馈信号变得可用。
- 计算损失并更新模型参数。
- 在处理下一个样本之前测量性能。
诸如River流式机器学习库之类的库通过predict_one()和learn_one()等方法实现了这种先预测后学习的工作流。神经网络可以通过重复的PyTorch优化器步骤使用相同的原则,尽管深度模型通常为了计算效率而在小批量数据上进行更新。(docs.pytorch.org)
在线学习在概念漂移情况下特别有价值,即输入与输出之间的关系发生变化时。例如季节性交通模式、变化的客户行为、新的制造缺陷或安装在不同光照条件下的摄像头。一份2024年的循环概念漂移调查强调,循环条件(如天气和一天中的时间)要求系统识别并适应之前遇到过的分布。(ijcai.org)
Link to this section计算机视觉中的在线学习#
Ultralytics YOLO不会在推理过程中执行不受控制的逐帧权重更新。相反,团队可以通过在近期标记数据与旧样本混合的基础上,进行周期性的微批量微调来近似实现安全的在线学习:
from ultralytics import YOLO
model = YOLO("yolo26n.pt")
model.train(data="coco8.yaml", epochs=3, imgsz=640, lr0=0.001)此可运行示例使用Ultralytics YOLO26和文档化的YOLO训练模式来进行小幅度的低学习率更新。在生产中,coco8.yaml将被替换为包含近期样本和回放样本的带版本控制的数据集。
具体应用包括:
- 制造业视觉检测: 当出现新产品、新材料或新缺陷类型时,模型会进行更新。
- 自动驾驶感知: 检测系统能够适应不断变化的道路、天气、摄像头状况和物体分布。
- 零售库存管理: 模型学习新的包装和季节性产品,而无需进行完整的重新训练。
Link to this section相关概念与关键差异#
持续学习范围更广:它的目标是在保留早期知识的同时跨任务或领域进行学习。在线学习描述的是更新发生的时间和频率。主动学习则选择信息量最大的样本进行人工标注,而迁移学习则将预训练知识应用于目标任务。
一个主要的共同挑战是灾难性遗忘。最近的研究包括2024年的BECoTTA持续测试时自适应、2025年的排名熵最小化以及2026年的PLASTIC稳定性-可塑性方法,这些研究探索了在不导致模型崩溃或丢失早期能力的情况下进行高效自适应的方法。(proceedings.mlr.press)






