Regularization
探索正则化如何防止机器学习中的过拟合。了解如何使用 Ultralytics YOLO26 实现 dropout 和权重衰减,以提高模型泛化能力。
正则化是一组用于机器学习的技术,旨在防止模型变得过于复杂,并提升其对全新、未见数据的泛化能力。在训练过程中,模型会努力降低误差,通常通过学习训练数据中的复杂模式来实现。然而,如果没有约束,模型可能会开始记忆噪声和异常值,这一问题称为过拟合。正则化通过向模型的损失函数添加惩罚项来解决这一问题,从而有效抑制极端参数值,并迫使算法学习更平滑、更稳健的模式。
核心概念与技术#
正则化的原理通常会与奥卡姆剃刀相比较,即最简单的解决方案通常是正确的。通过约束模型,开发者可以确保模型关注数据中最重要的特征,而不是偶然的相关性。
在现代深度学习框架中,通常会使用以下几种方法来实现正则化:
- L1 和 L2 正则化: 这些技术会根据模型权重的大小添加惩罚项。L2 正则化也称为岭回归或权重衰减,会对较大的权重施加强烈惩罚,促使权重变小并更加分散。L1 正则化,也称为套索回归,可以将部分权重压缩为零,从而有效执行特征选择。
- Dropout: 该方法专门用于神经网络,其中的Dropout 层会在训练期间随机停用一定比例的神经元。这会迫使网络为特征识别开发冗余路径,确保不会有单个神经元成为特定预测的瓶颈。
- 数据增强: 虽然数据增强主要是预处理步骤,但它也可以发挥强大的正则化作用。通过使用修改后的图像版本(旋转、翻转、颜色偏移)人为扩充数据集,模型能够接触到更多变化,从而避免记忆原始的静态样本。
- 提前停止: 该方法会在训练期间监控模型在验证数据上的表现。如果验证误差开始上升,而训练误差持续下降,就会停止训练过程,以防止模型学习噪声。
实际应用#
在数据变化性较高的各个行业中部署可靠的 AI 系统时,正则化不可或缺。
-
自动驾驶:在汽车解决方案中的 AI应用中,计算机视觉模型必须在各种天气条件下检测行人和交通标志。如果没有正则化,模型可能会记住训练集中的特定光照条件,并在现实环境中失效。权重衰减等技术可以确保检测系统很好地泛化到雨、雾或眩光环境,这对于自动驾驶汽车的安全至关重要。
-
医学影像:在执行医学图像分析时,由于隐私问题或疾病的罕见性,数据集的规模通常受到限制。过拟合在此类场景中是一个重大风险。正则化方法可以帮助用于检测 X 射线或 MRI 异常的模型在新的患者数据上保持准确,从而支持医疗 AI取得更好的诊断结果。
在 Python 中实现#
现代库通过超参数让正则化的应用变得十分简单。以下示例演示了在训练 YOLO26 模型时如何应用 dropout 和 weight_decay。
from ultralytics import YOLO
# Load the latest YOLO26 model
model = YOLO("yolo26n.pt")
# Train with regularization hyperparameters
# 'dropout' adds randomness, 'weight_decay' penalizes large weights to prevent overfitting
model.train(data="coco8.yaml", epochs=100, dropout=0.5, weight_decay=0.0005)你可以通过 Ultralytics Platform 无缝管理这些实验并跟踪不同正则化值对性能的影响,该平台提供了记录和比较训练运行的工具。
正则化与相关概念的对比#
区分正则化与其他优化和预处理术语很有帮助:









