Image Classification
探索图像分类基础知识,从 CNNs 到实际 AI 用途。了解如何使用 Ultralytics YOLO26 训练和部署先进的分类器。
图像分类是计算机视觉 (CV)中的一项基础任务,机器学习模型会分析整张图像,并从预定义的类别集合中为其分配一个标签。简单来说,它回答了这样一个问题:“这张图片的主要对象是什么?”作为人工智能 (AI)的核心组成部分,这一过程使自动化系统能够大规模地组织、分类和解读视觉数据。虽然在人眼看来这似乎很简单,但要让计算机识别模式,需要借助复杂的机器学习 (ML)算法,在原始像素与有意义的概念之间建立联系。
分类背后的机制#
现代图像分类在很大程度上依赖于称为卷积神经网络 (CNNs)的深度学习 (DL)架构。这些网络旨在模拟生物视觉皮层处理信息的方式。通过称为特征提取的过程,模型会在早期层中学习识别边缘和纹理等低级属性,最终在更深层中将这些属性组合起来,以识别复杂的形状和对象。
为了构建分类器,开发者会使用监督学习,向模型输入包含带标签示例的大量训练数据。ImageNet等大型公开数据集在提升此类系统的准确性方面发挥了重要作用。在推理阶段,模型会为每个类别输出一个概率分数,通常利用softmax 函数来确定最有可能的类别。
分类与其他视觉任务的比较#
区分图像分类与相关的计算机视觉能力非常重要,因为技术的选择取决于具体问题:
- **分类与目标检测的比较:**分类为整张图像分配一个标签。相比之下,目标检测会通过在每个对象周围绘制边界框,识别场景中多个对象的位置。
- **分类与图像分割的比较:**分类关注全局上下文,而分割则提供像素级精度。语义分割会对每个像素进行分类,从而精确 delineate 对象与背景之间的边界。
实际应用#
图像分类为各行各业的大量现实世界 AI 应用提供支持:
医疗诊断#
在医疗领域,分类模型通过分析诊断扫描结果来辅助放射科医生。医学图像分析工具可以快速将 X 射线或 MRI 归类为“正常”或“异常”,或者识别肿瘤检测等具体情况,从而加快患者分诊和诊断。
制造业质量控制#
工厂利用自动化视觉检测来维持产品标准。装配线上的摄像头会采集组件图像,分类模型根据可见缺陷即时将其标记为“合格”或“不合格”。这种自动化质量控制可确保只有无缺陷的产品进入包装阶段。
智慧农业#
农户利用农业中的 AI来监测作物健康状况。通过对无人机或智能手机拍摄的图像进行分类,系统可以识别疾病、营养缺乏或虫害迹象,从而实施有针对性的精准农业干预。
使用 Ultralytics YOLO26 实现分类#
Ultralytics YOLO26框架虽然以检测而闻名,但在图像分类任务方面也提供了先进的性能。其架构针对速度和准确性进行了优化,适用于实时应用。
下面是一个简洁示例,展示如何加载预训练模型,并使用 ultralytics Python 包对图像进行分类:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")对于希望简化工作流程的团队而言,Ultralytics Platform可以简化整个流程。它允许用户管理分类数据集、执行基于云的训练,并将模型部署为ONNX或TensorRT等多种格式,而无需构建大量编码基础设施。









