Backbone
探索主干网络在深度学习中的作用。了解 Ultralytics YOLO26 如何使用经过优化的主干网络,实现快速、准确的特征提取和目标检测。
主干网络是深度学习架构中负责基础特征提取的组件,充当将原始数据转换为有意义表示的主要引擎。在计算机视觉领域,主干网络通常由神经网络中的一系列层组成,用于处理输入图像并识别层次化模式。这些模式涵盖从边缘和纹理等简单的低级特征,到形状和物体等复杂的高级概念。主干网络的输出通常称为特征图,可作为下游组件的输入,用于执行分类或检测等特定任务。
主干网络的作用#
主干网络的主要功能是在做出任何具体决策之前“看见”并理解图像中的视觉内容。它充当通用翻译器,将像素值转换为精简且信息丰富的格式。如今大多数主干网络依赖卷积神经网络 (CNN)或视觉 Transformer (ViT),并且通常在ImageNet等大型数据集上进行预训练。这一预训练过程是迁移学习的核心环节,使模型能够利用此前学到的视觉特征,从而显著减少针对特定应用训练新模型所需的数据和时间。
例如,在使用Ultralytics YOLO26时,其架构包含一个经过高度优化的主干网络,能够高效提取多尺度特征。这样一来,网络的后续部分就可以专注于定位物体和分配类别概率,而无需从头重新学习如何识别基本视觉结构。
主干网络 vs. 颈部网络 vs. 检测头#
要全面理解目标检测模型的架构,必须将主干网络与另外两个主要组件区分开来:颈部网络和检测头。
- 主干网络:“特征提取器”。它从输入图像中提取关键视觉信息。常见示例包括残差网络 (ResNet)(最初由微软研究院开发)和 CSPNet,后者针对计算效率进行了优化。
- 颈部网络:“特征聚合器”。颈部网络位于主干网络和检测头之间,用于优化并融合不同尺度的特征。这里常用的结构是特征金字塔网络 (FPN),它增强了模型检测不同尺寸物体的能力。
- 检测头:“预测器”。检测头处理来自颈部网络的聚合特征,生成最终输出,例如边界框和类别标签。
实际应用#
主干网络是许多工业和科研 AI 应用背后的无名功臣。它们对视觉数据的泛化能力使其能够适应各种不同领域。
-
**医疗诊断:**在医疗保健领域,主干网络会分析 X 射线、CT 扫描和 MRI 等复杂医学图像。通过执行医学图像分析,这些网络可以提取表明疾病的细微异常。例如,专用模型利用强大的主干网络进行肿瘤检测,识别人眼可能忽略的癌症早期迹象。北美放射学会 (RSNA)等组织倡导使用这些深度学习工具来革新患者护理。
-
**自主系统:**在汽车和机器人行业,主干网络会处理车载摄像头传来的视频流,以解读周围环境。汽车领域的 AI依赖这些稳健的特征提取器来检测车道、读取交通标志,并实时识别行人。可靠的主干网络可确保系统区分静态障碍物和行驶中的车辆,这是 Waymo 等公司开发的自动驾驶技术必须满足的关键安全要求。Waymo等公司正在开发这类技术。
使用 Ultralytics 实现#
YOLO11等先进架构以及前沿的 YOLO26 默认集成了功能强大的主干网络。这些组件经过专门设计,可在各种硬件平台上实现最佳推理延迟,覆盖从边缘设备到高性能GPUs的平台。
下面的 Python 代码片段演示了如何使用 ultralytics 软件包加载带有预训练主干网络的模型。该设置会在推理期间自动利用主干网络进行特征提取。
from ultralytics import YOLO
# Load a YOLO26 model, which includes a pre-trained CSP backbone
model = YOLO("yolo26n.pt")
# Perform inference on an image
# The backbone extracts features, which are then used for detection
results = model("https://ultralytics.com/images/bus.jpg")
# Display the resulting detection
results[0].show()借助预训练主干网络,开发者可以使用Ultralytics Platform在自己的自定义数据集上进行微调。这种方法有助于快速开发专用模型,例如用于检测物流包裹的模型,而无需投入通常从头训练深度神经网络所需的巨大计算资源。









