Data Security
探索 AI 必需的数据安全策略。了解如何保护 Ultralytics YOLO26 模型、防御对抗性攻击,并实施自动化脱敏。
数据安全涵盖在整个生命周期内用于保护数字信息免受未经授权的访问、损坏、盗窃或中断的防护措施、策略和技术。在机器学习 (ML)和人工智能 (AI)领域,这一学科对于确保预测系统的可靠性和维护用户信任至关重要。它包括保护训练所需的海量数据集、保护决定模型行为的专有算法,以及强化这些模型运行所依赖的基础设施。全面的安全策略会应对“CIA 三元组”,确保数据资产的机密性、完整性和可用性。
安全在 AI 流水线中的作用#
随着组织越来越多地将计算机视觉 (CV)和其他 AI 技术集成到关键工作流中,潜在安全漏洞的攻击面也在扩大。保护 AI 流水线不同于传统 IT 安全,因为模型本身可能成为攻击或操纵的目标。
- **知识产权保护:**最先进的架构(例如 YOLO26)代表了在研究和计算资源方面的重大投入。包括模型加密标准在内的强大安全协议,对于防止竞争对手提取或窃取模型至关重要。
- **防御对抗性攻击:**如果没有充分的防御措施,神经网络就容易受到对抗性攻击。在这类场景中,恶意行为者会向输入数据中加入细微且通常难以察觉的噪声,诱使模型做出错误分类,这会给自动驾驶等安全关键型系统带来严重风险。
- **防止数据投毒:**安全措施必须防止“数据投毒”,即攻击者将恶意样本注入训练数据,以破坏模型未来的行为。这对于采用主动学习循环、根据新输入持续更新的系统尤其关键。如需深入了解这些威胁,OWASP 机器学习安全十大风险提供了行业标准框架。
实际应用#
数据安全是跨敏感行业部署可信赖的 AI 系统的基础要求。
医疗保健合规与匿名化#
在医疗保健领域的 AI中,处理患者数据需要严格遵守 HIPAA 等法规。当医院使用医学图像分析来检测肿瘤或骨折时,数据流水线必须在静态和传输过程中均进行加密。此外,系统通常会移除 DICOM 元数据,或利用边缘 AI在设备本地处理图像,确保敏感的个人身份信息 (PII) 永远不会离开安全的医疗机构网络。
智慧城市监控#
现代智慧城市依靠目标检测来管理交通流量并提升公共安全。为符合 GDPR 等隐私标准,监控摄像头通常会实施实时隐私遮挡。这样一来,系统既能统计车辆或检测事故,又能自动遮挡车牌和人脸,从而保护市民身份。
技术实现:自动隐私遮挡#
计算机视觉中一种常见的数据安全技术是在推理期间自动模糊敏感对象。以下 Python 代码演示了如何使用 ultralytics 和 YOLO26 模型检测图像中的人员,并对其边界框应用高斯模糊,从而在数据存储或传输前有效地将个人匿名化。
import cv2
from ultralytics import YOLO
# Load the YOLO26 model (optimized for real-time inference)
model = YOLO("yolo26n.pt")
image = cv2.imread("street_scene.jpg")
# Perform object detection to find persons (class index 0)
results = model(image, classes=[0])
# Blur the detected regions to protect identity
for result in results:
for box in result.boxes.xyxy:
x1, y1, x2, y2 = map(int, box)
# Apply Gaussian blur to the Region of Interest (ROI)
image[y1:y2, x1:x2] = cv2.GaussianBlur(image[y1:y2, x1:x2], (51, 51), 0)数据安全与数据隐私的区别#
尽管两者经常被交替使用,但区分数据安全和数据隐私至关重要。
- 数据安全指用于保护数据免受未经授权的访问或恶意攻击的机制和工具。这包括加密、防火墙和访问控制列表 (ACLs)。
- 数据隐私指规范数据收集、共享和使用方式的政策和法律权利。它侧重于用户同意,并确保数据仅用于预期目的。
安全是实现隐私的技术基础;如果没有强大的安全措施,隐私政策就无法得到有效执行。对于负责管理完整 ML 生命周期的团队,Ultralytics Platform提供了一个集中式环境,用于标注、训练和部署模型,同时在数据集管理过程中维持严格的安全标准。









