Accuracy
探索 AI 中准确率的基础知识。了解如何评估性能、避免准确率悖论,并使用 Ultralytics YOLO26 衡量结果。
准确率是评估人工智能系统的基础性指标,用于量化模型相对于预测总数所做出的正确预测的百分比。在机器学习,尤其是监督学习中,该指标提供了模型与训练过程中提供的真实值的匹配程度的宏观概览。准确率是最直观的性能衡量指标,回答了“模型有多大比例的预测是正确的?”这一简单问题,也是开发者深入研究更细粒度的指标之前判断系统可靠性的主要依据。
评估性能的细微之处#
准确率是一个很好的起点,但最适合应用于类别均衡的训练数据,即所有类别都得到同等表示。例如,在区分猫和狗的标准图像分类任务中,如果数据集包含各500张猫和狗的图像,那么准确率就是一个可信的指标。然而,面对类别不平衡的数据集时,问题就会出现,从而导致“准确率悖论”。
如果模型用于欺诈检测,而只有1%的交易属于欺诈交易,那么一个将所有交易都简单预测为“合法”的模型可以达到99%的准确率,却完全无法完成其预期任务。为缓解这一问题,工程师通常会使用Ultralytics Platform可视化数据集分布,确保模型没有只记住占多数的类别。
准确率与相关术语的区别#
要全面理解模型性能,必须将准确率与相似指标区分开来:
- **精确率:**用于衡量正类预测的质量。它关注的是:“所有被预测为正类的实例中,有多少实际上是正类?”
- **召回率:**也称为敏感度,用于衡量模型找出所有相关案例的能力。它关注的是:“所有实际为正类的实例中,模型正确识别出了多少?”
- **F1 分数:**是精确率和召回率的调和平均值,通过一个兼顾二者的单一分数进行衡量,对于类别分布不均衡的情况尤其有用。
准确率提供了整体正确性的视角,而精确率和召回率则能揭示特定类型的错误,例如假阳性或假阴性。
实际应用#
准确率的实用价值延伸至众多行业,可用于验证关键环境中计算机视觉和预测模型的可靠性。
- **医疗诊断:**在医学图像分析领域,模型用于对 X 射线或 MRI 扫描进行分类。将扫描结果分类为“健康”或“病理”的模型依赖较高的准确率,以确保患者获得正确的诊断。医疗领域的 AI创新在很大程度上依赖严格的验证,以最大限度地减少自动化错误。
- 制造业质量控制:智能制造中的自动化系统通过视觉检测识别装配线上的缺陷。较高的准确率可确保只有无缺陷的产品发货,从而减少浪费和保修成本。工厂通过采用目标检测来发现缺陷,自动维持生产标准。
在代码中测量准确率#
在使用Python的实际场景中,开发者可以使用成熟的库轻松测量模型的准确率。以下示例演示了如何验证一个YOLO26分类模型,以获取其 top-1 准确率。Top-1 准确率是指模型概率最高的预测与正确标签相匹配的频率。
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Validate the model on a standard dataset (e.g., MNIST)
metrics = model.val(data="mnist")
# Print the Top-1 Accuracy
print(f"Top-1 Accuracy: {metrics.top1:.4f}")改进策略#
当模型的准确率较低时,可以采用多种技术来提升性能。工程师通常会使用数据增强人为增加训练集的多样性,防止模型过拟合。此外,超参数调优——例如调整学习率等设置——会显著影响收敛。对于复杂任务,迁移学习可以让模型利用大型预训练数据集(例如ImageNet)中的知识,从而在规模更小且特定的数据集上获得更高的准确率。









