Fine-tuning
探索微调如何使 Ultralytics YOLO26 等预训练模型适应专门任务。学习如何利用迁移学习,打造更快速、更准确的 AI。
微调是机器学习(ML)中的一项基础流程,涉及将预训练模型适配到特定任务或数据集。与需要大量数据、时间和计算能力的从头开始训练不同,开发者会从一个“基础模型”开始,该模型已经从类似ImageNet这样的海量数据集中学习了通用特征。这种方法是迁移学习的实际应用,使 AI 系统能够以显著更少的资源在细分问题上实现高性能。
适应机制#
微调背后的核心理念是利用模型已经获得的“知识”。基础模型通常已经具备对边缘、纹理和形状等基本视觉元素的深入理解。在微调过程中,模型的参数(权重)会进行小幅调整,以适应新的专业数据中的细微差异。
这种调整通常通过梯度下降并使用较低的学习率来实现。保守的学习率可以确保初始预训练过程中学到的有价值特征得到优化,而不是被破坏。在许多计算机视觉(CV)工作流中,工程师可能会冻结骨干网络的初始层——这些层负责检测通用特征——只更新更深层以及负责做出最终类别预测的检测头。
实际应用#
微调弥合了通用 AI 能力与特定行业需求之间的差距,使通用模型成为专业领域的专家。
- 医疗领域的 AI: 标准视觉模型可以区分猫和狗,但缺乏医学背景。通过在包含经过标注的 X 射线图像的医学影像分析数据集上对该模型进行微调,研究人员可以创建以高准确率检测肺炎或骨折的诊断工具。这些工具可以在快节奏的工作环境中帮助放射科医生,优先处理危重病例。
- 制造业中的 AI: 在工业环境中,现成模型可能无法识别专有组件。制造商通过微调将 YOLO26 等先进架构适配到特定装配线。这使自动化质量控制系统能够发现微小缺陷,例如微裂纹或漆面瑕疵,从而提高产品可靠性并减少浪费。
微调与从头开始训练#
区分微调与完整训练,有助于了解何时应采用每种方法。
- 从头开始训练: 该方法使用随机权重初始化模型,并在数据集上训练模型,直到其收敛。它需要非常大的带标注数据集和大量 GPU 资源。通常只有在创建新架构,或领域完全独特时才会采用这种方法(例如分析深空中的星云,而不是日常物体)。
- 微调: 该方法从经过优化的权重开始。它所需的数据少得多(通常只需几千张图像),训练速度也快得多。对于大多数商业应用,例如零售库存管理或安全监控,微调是最高效的部署路径。
使用 Ultralytics 实现微调#
现代框架让这一过程变得更加易用。例如,Ultralytics Platform可以自动处理数据集管理和云端训练,从而简化工作流。不过,开发者也可以使用 Python 在本地对模型进行微调。
以下示例演示了如何在自定义数据集上对预训练的 YOLO26 模型进行微调。请注意,我们加载的是 yolo26n.pt(预训练权重),而不是简化的配置文件,这会提示库启动迁移学习。
from ultralytics import YOLO
# Load a pre-trained YOLO26 model (n=nano size)
# This automatically loads weights trained on COCO
model = YOLO("yolo26n.pt")
# Fine-tune the model on a custom dataset (e.g., 'coco8.yaml')
# The 'epochs' argument determines how many passes over the data occur
results = model.train(data="coco8.yaml", epochs=100, imgsz=640)
# The model is now fine-tuned and ready for specific inference tasks成功的关键注意事项#
要获得最佳结果,新数据集的质量至关重要。使用数据增强工具可以通过旋转、翻转或调整图像亮度来扩充小型数据集,防止过拟合。此外,监控验证损失和平均精度(mAP)等指标,可以确保模型能够很好地泛化到未见过的数据。
对于管理复杂工作流的人员,采用 MLOps 策略和实验跟踪等工具,有助于维护不同微调迭代版本的版本控制。无论用于目标检测还是实例分割,微调仍然是部署有效 AI 解决方案的行业标准。









