Ultralytics YOLO27:
返回 Ultralytics 术语表

Concept Bottleneck Models

了解概念瓶颈模型如何通过人类可理解的概念、专家干预和实用的 Ultralytics YOLO26 视觉工作流,改进可解释 AI。

概念瓶颈模型(CBM)是一种通过人类可理解概念的中间层进行预测的神经网络。CBM 不会将输入直接映射到最终标签,而是先预测有意义的属性,例如“红色翅膀”“表面裂纹”或“关节间隙变窄”,然后仅使用这些属性生成决策。与传统黑盒模型相比,这种结构更易于检查、调试和纠正。

概念瓶颈模型的工作原理#

标准的神经网络通常会在不透明的潜在空间中表示信息。CBM 会将隐藏表示的一部分替换为概念向量,其中每个维度都有明确的含义。

其预测流程包含两个主要阶段:

  1. 概念预测器将原始输入(例如图像)映射为概念值。
  2. 目标预测器将这些概念值映射为最终类别或分数。

例如,鸟类分类器可能会先预测“黑色喙”“白色胸部”和“长尾”,然后再识别鸟的物种。概念可以是二值、类别型或连续型的。它们通常通过监督学习进行学习,因此每个训练样本都必须同时包含目标标签和概念标注。

这两个阶段可以独立训练、按顺序训练或联合训练。独立训练能明确体现二者的分离,而联合训练可以在概念质量与最终任务性能之间取得平衡。在所有情况下,瓶颈都应将目标预测器限制在所声明的概念范围内;否则,隐藏信息可能绕过预期的解释路径。

为什么可解释性和干预很重要#

CBM 是一种内生式可解释人工智能:其可解释结构被构建在预测过程中,而不是事后添加。这不同于显著性图等事后分析工具,后者用于估计哪些因素影响了一个已经训练好的黑盒模型。

概念层支持多种有用的交互方式:

  • 用户可以检查哪些概念导致了某项决策。
  • 领域专家可以纠正不准确的概念并重新计算输出。
  • 开发者可以测试目标预测器是否遵循有效的领域逻辑。
  • 团队可以将概念准确率与最终任务准确率分开进行衡量。

这些能力与NIST 关于可解释人工智能的指导以及People + AI Guidebook中讨论的以人为本的控制措施相一致。然而,易于理解的解释并不一定是正确的解释。必须评估概念保真度,而不能想当然地认为它是可靠的。

实际应用#

  • 医学图像分析 检查 X 光片的模型可能会先估计骨刺、关节间隙变窄和硬化等概念,然后对疾病严重程度进行分级。临床医生可以审查或纠正这些中间结果,而不是只能获得一个严重程度分数。这种人机交互与FDA 关于机器学习医疗器械的透明度原则尤其相关。

  • 制造业视觉检测 视觉系统可以识别缺失组件、裂纹、变色或对齐错误等概念,然后利用这些概念决定产品是否通过检测,或是否需要特定维修。目标检测可以定位组件和缺陷,而下游的基于概念的分类器则能提供可审计的质量决策。

局限性和相关概念#

概念标签会增加数据标注成本,并且可能需要专业知识。定义不佳的概念可能具有主观性、相关性或不完整性,也可能难以从输入中识别。团队应制定精确的标注规则,并审核标注者之间的分歧。

其他重要风险包括概念预测错误、未校准的分数,以及概念泄漏,即连续概念值编码了超出其声明含义的非预期信息。概率校准方面的指导可以帮助判断概念置信度值是否可信。

CBM 也不同于特征工程:工程化特征是手动计算的输入,而概念通常是从原始数据中预测出来并经过明确监督的。它也不同于信息瓶颈原理,后者会压缩表示,但不要求每个维度都能被人类理解。

应在相关数据切片上检查概念性能,因为有偏差的标注或缺失的概念可能导致不均等的错误。Google 关于识别机器学习偏差的指导NIST AI RMF Core提供了有用的评估与治理实践。

构建实用的视觉流程#

Ultralytics YOLO26模型可以充当上游视觉概念提取器。以下预测模式工作流会收集检测到的目标类别,作为候选概念信号:

from ultralytics import YOLO

# Load a pretrained visual concept extractor
model = YOLO("yolo26n.pt")

# Run inference and select the first result
results = model("https://ultralytics.com/images/bus.jpg")
result = results[0]

# Convert detected classes into human-readable concept candidates
concepts = {result.names[int(class_id)] for class_id in result.boxes.cls}
print(sorted(concepts))

result.save(filename="concept_candidates.jpg")

这并不是一个完整的 CBM:下游模型仍必须经过训练,才能仅根据所选概念预测最终目标。团队可以使用Ultralytics 平台来标注视觉数据、训练概念提取器、比较实验并监控已部署的组件。应使用结构化的模型评估工作流,分别评估概念准确率、目标准确率、校准、干预行为和重要子群体。

Explore solutions

用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多
用于航拍影像的计算机视觉

用于航拍影像的计算机视觉

使用 Ultralytics YOLO 将无人机和航拍影像转化为针对农业、水产养殖、环境监测、自然保护及地理空间分析的实时洞察。
了解更多
航空航天中的计算机视觉

航空航天中的计算机视觉

借助 Ultralytics YOLO 模型将视觉 AI 引入空中监测。使用计算机视觉解决方案赋能无人机、航空航天工作流、环境保护与地理空间行业。
了解更多

使用 Ultralytics YOLO 模型保护每个站点。视觉 AI 赋能周界监控、威胁检测、车牌识别和工作场所安全。
了解更多
机器人计算机视觉

机器人计算机视觉

借助 Ultralytics YOLO 模型打造更智能的机器。机器人技术中的视觉 AI 可实现自主导航、感知、目标跟踪和实时控制。
了解更多
物流计算机视觉

物流计算机视觉

使用 Ultralytics YOLO 模型提升物流效率。视觉 AI 可实现包裹检测、分拣、车辆跟踪和仓库安全实时监控。
了解更多
零售计算机视觉

零售计算机视觉

使用 Ultralytics YOLO 模型重新构想零售。视觉 AI 为库存跟踪、货架监控、队列管理和更智能的客户洞察提供支持。
了解更多
医疗领域的计算机视觉

医疗领域的计算机视觉

使用 Ultralytics YOLO 模型构建医疗解决方案。医疗领域的视觉 AI 可实现更快的医学影像处理、更智能的诊断和患者监护。
了解更多
制造业中的计算机视觉

制造业中的计算机视觉

使用 Ultralytics YOLO 模型优化制造业。视觉 AI 可推动质量控制、缺陷检测、PPE 合规和装配线自动化。
了解更多
汽车行业中的计算机视觉

汽车行业中的计算机视觉

使用 Ultralytics YOLO 模型在汽车行业应用计算机视觉。视觉 AI 提升道路安全、驾驶辅助和车辆自动化水平,让道路更加智能。
了解更多
农业中的计算机视觉

农业中的计算机视觉

使用 Ultralytics YOLO 模型将视觉 AI 带入智能农业。为作物监测、牲畜追踪和精准农业提供支持,提升产量与智能化水平。
了解更多

让我们共同构建 AI 的未来!

开启你的机器学习未来之旅