Ultralytics YOLO27:
返回 Ultralytics 术语表

Mixture of Experts (MoE)

探索专家混合(MoE)架构。了解门控网络和稀疏层如何扩展神经网络,以实现高性能 AI 和计算机视觉。

专家混合模型 (MoE) 是深度学习中的一种专用架构设计,可以让模型扩展到超大规模,而不会导致计算成本按比例增加。不同于标准的稠密神经网络 (NN),在这种网络中每个参数都会针对每个输入处于激活状态,MoE 模型采用了一种称为条件计算的技术。该方法会根据输入数据的具体特征,动态激活网络组件中的一个小子集,这些组件被称为“专家”。通过这种方式,MoE 架构能够构建强大的基础模型,使其拥有数万亿个参数,同时保持与小得多的系统相当的推理延迟和运行速度。

MoE 的核心机制#

专家混合模型的高效性源于用稀疏 MoE 层替代标准稠密层。该层通常由两个协同工作的主要元素组成,以高效处理信息:

  • 专家: 这些是彼此独立的子网络,通常是简单的前馈神经网络 (FFNs)。每个专家专门处理数据的不同方面。在自然语言处理 (NLP)中,一个专家可能擅长处理语法,而另一个则专注于事实检索或代码语法。
  • 门控网络(路由器): 路由器充当数据的交通控制器。当输入(例如图像块或文本标记)进入该层时,路由器会使用softmax 函数计算概率分数。随后,它只会将该输入发送给分数最高的“Top-K”个专家(通常为一个或两个)。这样可以确保模型只在最相关的参数上消耗计算资源。

与模型集成的区别#

虽然这两个概念都涉及使用多个子模型,但必须明确区分专家混合模型与模型集成。在传统集成中,组内的每个模型都会处理相同的输入,然后对结果进行平均或投票,以最大化准确率。这种方法会使计算成本随模型数量线性增加。

相反,MoE 是一个统一的单一模型,不同输入会沿不同路径传播。稀疏 MoE 通过在每个推理步骤中仅运行全部参数的一小部分,来实现可扩展性和效率。这样,无需承担稠密集成所带来的高昂成本,就能使用海量训练数据进行训练。

实际应用#

MoE 架构已成为现代高性能 AI 的基石,尤其适用于需要多任务能力和广泛知识保留的场景。

  1. 多语言模型: Mistral AI 的 Mixtral 8x7B 等知名模型利用 MoE 在多样化语言任务中取得出色表现。通过将标记路由到专门的专家,这些系统可以在单一模型结构中处理翻译、摘要和编程任务,其性能优于活动参数数量相近的稠密模型。

  2. 可扩展计算机视觉:计算机视觉 (CV)领域,研究人员应用 MoE 构建超大规模视觉骨干网络。Vision MoE (V-MoE)架构展示了专家如何专门识别不同的视觉特征,从而有效提升在 ImageNet 等基准上的性能。虽然 YOLO26 等高度优化的稠密模型凭借可预测的内存占用,仍然是实时边缘检测的标准,但 MoE 研究仍在不断拓展服务器端视觉理解的边界。

路由逻辑示例#

要了解门控网络如何选择专家,可以参考这个简化的 PyTorch 示例。该示例演示了如何通过路由机制为给定输入选择最相关的专家。

import torch
import torch.nn as nn

# A simple router deciding between 4 experts for input dimension of 10
num_experts = 4
input_dim = 10
router = nn.Linear(input_dim, num_experts)

# Batch of 2 inputs
input_data = torch.randn(2, input_dim)

# Calculate scores and select the top-1 expert for each input
logits = router(input_data)
probs = torch.softmax(logits, dim=-1)
weights, indices = torch.topk(probs, k=1, dim=-1)

print(f"Selected Expert Indices: {indices.flatten().tolist()}")

训练和部署中的挑战#

尽管 MoE 模型具有诸多优势,但也给训练过程带来了独特挑战。一个主要问题是负载均衡;路由器可能偏向少数几个“热门”专家,同时忽略其他专家,导致容量浪费。为缓解这一问题,研究人员会使用辅助损失函数来促进所有专家的均衡使用。

此外,部署这些超大规模模型需要复杂的硬件配置。由于模型的参数总量很高(即使活动参数数量较少),通常仍需要大量显存,因此必须通过多个 GPU进行分布式训练Microsoft DeepSpeed 等框架有助于管理高效训练这些系统所需的并行化。对于管理这类复杂架构的数据集和训练工作流,Ultralytics Platform 等工具可提供日志记录、可视化和部署所需的基础设施。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅