Image Classification
探索图像分类的基础知识,从 CNN 到现实世界的 AI 用例。学习使用 Ultralytics YOLO26 训练和部署最先进的分类器。
图像分类是计算机视觉 (CV)中的一项基础任务,机器学习模型会分析整张图像,并为其分配预定义类别集中的单个标签。本质上,它回答了这样一个问题:“这张照片的主要主体是什么?”作为人工智能 (AI)的核心组成部分,这一过程使自动化系统能够大规模地组织、分类和解释视觉数据。虽然在人眼看来可能很简单,但要让计算机识别模式,需要复杂的机器学习 (ML)算法来弥补原始像素与有意义的概念之间的鸿沟。
分类背后的机制#
现代图像分类严重依赖被称为卷积神经网络 (CNN)的深度学习 (DL)架构。这些网络旨在模仿生物视觉皮层处理信息的方式。通过称为特征提取的过程,模型学会识别早期图层中的边缘和纹理等低级属性,最终将它们组合起来,以识别较深图层中的复杂形状和对象。
为了构建分类器,开发者会使用监督学习,向模型输入包含带标签示例的大量训练数据。像ImageNet这样的大型公共数据集在提升这些系统的准确性方面发挥了重要作用。在推理阶段,模型会为每个类别输出一个概率分数,通常会利用softmax函数来确定最有可能的类别。
分类与其他视觉任务的区别#
将图像分类与相关的计算机视觉功能区分开来非常重要,因为技术的选择取决于具体问题:
- **分类与目标检测:**分类为整张图像分配一个标签。相比之下,目标检测通过在每个目标周围绘制一个边界框来识别场景中多个目标的位置。
- **分类与图像分割:**分类关注的是全局上下文,而分割则提供像素级别的精度。语义分割对每个单独的像素进行分类,从而能够精确划定目标与背景之间的边界。
实际应用#
图像分类为各个行业的广泛现实世界 AI 应用提供支持:
医疗诊断#
在医疗领域,分类模型通过分析诊断扫描来协助放射科医生。医学图像分析工具可以快速将 X 光片或 MRI 归类为“正常”或“异常”,或者识别诸如肿瘤检测等特定状况,从而加快患者的分诊和诊断速度。
制造业中的质量控制#
工厂利用自动视觉检测来维持产品标准。装配线上的摄像头捕获组件图像,分类模型根据可见缺陷即时将其标记为“通过”或“失败”。这种自动化的质量控制可确保只有无缺陷的物品才能进入包装阶段。
智慧农业#
农户利用农业 AI来监测作物健康状况。通过对无人机或智能手机拍摄的图像进行分类,系统可以识别出疾病、营养缺乏或害虫侵扰的迹象,从而能够进行有针对性的精准农业干预。
使用 Ultralytics YOLO26 实现分类#
Ultralytics YOLO26框架虽然以检测闻名,但它也为图像分类任务提供了最先进的性能。其架构针对速度和准确性进行了优化,非常适合实时应用。
以下是一个简明的示例,展示了如何使用 ultralytics Python 软件包加载预训练模型并对图像进行分类:
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Run inference on an image source
results = model("https://ultralytics.com/images/bus.jpg")
# Print the top predicted class name
print(f"Prediction: {results[0].names[results[0].probs.top1]}")对于希望简化工作流程的团队来说,Ultralytics Platform简化了整个管道。它允许用户管理分类数据集、执行基于云的训练,并将模型部署到诸如ONNX或TensorRT等各种格式,而无需庞大的编码基础设施。






