Ultralytics YOLO27:
返回 Ultralytics 术语表

Feature Maps

探索特征图如何充当 CNN 的眼睛。了解 Ultralytics YOLO26 如何使用这些内部表示来检测模式并赋能计算机视觉。

特征图是神经网络中的卷积滤波器处理输入图像或前置层时产生的基本输出。在计算机视觉(CV)领域,这些特征图作为数据的内部表示,突出显示模型学会识别的特定模式,例如边缘、纹理或复杂的几何形状。从本质上说,特征图就像卷积神经网络(CNN)的“眼睛”,将原始像素值转换为有意义的抽象表示,从而支持目标检测和分类等任务。

特征图背后的机制#

特征图的生成由称为卷积的数学运算驱动。在此过程中,由可学习参数组成的小型矩阵(称为内核或滤波器)会在输入数据上滑动。在每个位置,内核执行逐元素乘法并求和,最终在输出网格中得到一个值。

  • 模式激活:每个滤波器都经过训练,用于寻找特定特征。当滤波器在输入中检测到该特征时,特征图中的结果值会较高,表示强激活。
  • 空间层次结构:在深度学习(DL)架构中,特征图按层次组织。早期层生成的特征图用于检测低级细节,例如边缘检测中的线条和曲线。更深层会组合这些简单特征图,形成复杂对象的高级表示,例如人脸或车辆。
  • 维度变化:随着数据在网络中传递,池化层等操作通常会减小特征图的空间维度(高度和宽度),同时增加深度(通道数)。这一过程通常称为降维,有助于模型关注特征是否存在,而不是它们的确切像素位置。

实际应用#

特征图是现代 AI 应用的核心基础,使系统能够以类似人类的理解方式解读视觉数据。

  • 医疗诊断:在医学图像分析中,模型使用特征图处理 X 射线或 MRI 扫描。早期特征图可能突出显示骨骼轮廓,而更深层的特征图则会识别肿瘤或骨折等异常,从而协助医生处理医疗领域中的 AI场景。
  • 自主导航:自动驾驶汽车高度依赖视觉传感器生成的特征图。这些特征图使车辆的车载计算机能够实时区分车道、行人和交通标志,这对于自动驾驶车辆安全运行至关重要。

在 Python 中处理特征图#

虽然特征图属于内部结构,但在设计架构时,理解其维度至关重要。下面的 PyTorch 示例演示了单个卷积层如何将输入图像转换为特征图。

import torch
import torch.nn as nn

# Define a convolution layer: 1 input channel, 1 output filter, 3x3 kernel
conv_layer = nn.Conv2d(in_channels=1, out_channels=1, kernel_size=3, bias=False)

# Create a random dummy image (Batch Size=1, Channels=1, Height=5, Width=5)
input_image = torch.randn(1, 1, 5, 5)

# Pass the image through the layer to generate the feature map
feature_map = conv_layer(input_image)

print(f"Input shape: {input_image.shape}")
# The output shape will be smaller (3x3) due to the kernel size and no padding
print(f"Feature Map shape: {feature_map.shape}")

区分相关概念#

为了避免在模型训练期间产生混淆,区分特征图与相似术语很有帮助:

  • 特征图与滤波器:滤波器(或内核)是用于扫描图像的工具,其中包含模型权重。特征图则是该扫描的结果。你可以将滤波器看作“镜头”,将特征图看作通过该镜头捕获的“图像”。
  • 特征图与嵌入:虽然二者都用于表示数据,但特征图通常会保留适用于语义分割的空间结构(高度和宽度)。相比之下,嵌入通常是扁平化的一维向量,能够捕获语义含义,但会丢失空间布局,常用于相似性搜索任务。
  • 特征图与激活激活函数(例如 ReLU)会应用于特征图中的值,以引入非线性。特征图在执行这一数学运算之前和之后都存在。

与 Ultralytics 模型的相关性#

YOLO26 等高级架构中,特征图在模型的“骨干网络”和“检测头”中发挥着关键作用。骨干网络会提取不同尺度的特征(特征金字塔),确保模型能够有效检测大小不同的目标。使用 Ultralytics Platform 进行训练的用户可以通过 准确率 和召回率等指标,直观了解这些模型的表现,并间接观察底层特征图的效果。优化这些特征图需要在经过标注的数据集上进行大量训练,通常还会利用特征提取等技术,将预训练模型中的知识迁移到新任务中。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅