Vector Database
了解向量数据库如何管理高维嵌入以进行语义检索。学习如何结合 Ultralytics YOLO26 和相似性搜索,为 AI 应用提供支持。
向量数据库是一种专用存储系统,旨在管理、索引和查询高维向量数据,这些数据通常也称为嵌入。不同于传统的关系型数据库,后者将结构化数据组织成行和列,以进行精确的关键词匹配,向量数据库针对语义检索进行了优化。它可以让智能系统找到概念上相似而非完全相同的数据点。这一能力是现代人工智能 (AI)基础设施的核心,使应用能够通过分析图像、音频、视频和文本等非结构化数据之间的数学关系来处理和理解这些数据。这些数据库充当智能代理的长期记忆,支持视觉搜索和个性化推荐等任务。
向量数据库的工作原理#
向量数据库的功能围绕向量空间这一概念展开:数据项会被映射为多维坐标系中的点。整个过程从特征提取开始,此时深度学习 (DL)模型会将原始输入转换为数值向量。
-
数据摄取: 数据由神经网络(例如最先进的 YOLO26)处理,以生成嵌入。这些向量将输入的语义信息压缩为由浮点数组成的密集列表。
-
索引: 为确保检索期间的推理延迟较低,数据库会使用专用算法组织这些向量。分层可导航小世界 (HNSW)或倒排文件索引 (IVF)等技术,可以让系统高效地导航数十亿个向量,而无需扫描每一条记录。
-
查询: 当用户提交搜索查询(例如一张特定鞋款的图片)时,系统会将查询转换为向量,并使用余弦相似度或欧氏距离等距离度量,计算其与存储向量之间的接近程度。
-
检索: 数据库会返回“最近邻”,它们代表与上下文最相关的结果。
以下 Python 代码片段演示了如何使用标准的 ultralytics 模型生成嵌入,这是填充向量数据库之前的必要步骤。
from ultralytics import YOLO
# Load a pre-trained YOLO26 classification model
model = YOLO("yolo26n-cls.pt")
# Generate feature embeddings for an image file
# The 'embed' method creates the vector representation needed for the database
results = model.embed("https://ultralytics.com/images/bus.jpg")
# Output the shape of the resulting embedding vector
print(f"Embedding vector shape: {results[0].shape}")实际应用#
如今,向量数据库是企业环境中许多高级计算机视觉 (CV)和自然语言处理 (NLP)应用背后的引擎。
- 检索增强生成 (RAG): 在生成式 AI时代,向量数据库可以让大型语言模型 (LLMs)访问海量的私有且最新的数据。系统根据用户提示的语义含义检索相关文档,从而减少LLMs 中的幻觉,并提供符合事实且理解上下文的响应。
- 视觉推荐引擎: 在零售业中的 AI领域,平台使用向量数据库来支持“购买相似款式”等功能。如果用户查看一条特定的夏季连衣裙,系统会查询数据库,寻找具有相似视觉嵌入的其他产品图片——匹配图案、剪裁和颜色——比简单的基于标签的筛选提供更佳的用户体验。
- 异常与威胁检测: 安全系统利用向量数据库进行异常检测。通过存储“正常”行为或授权人员的嵌入,系统可以立即标记向量空间中偏离预期集群的异常点,从而增强数据安全和设施监控能力。
区分相关概念#
要有效实施这些系统,了解向量数据库与机器学习运维 (MLOps)领域中相关技术的区别会很有帮助。
- 向量数据库与向量搜索的比较: 向量搜索是寻找相似向量的动作或算法过程(“如何实现”)。向量数据库则是用于存储数据、管理索引并大规模执行这些搜索的稳健基础设施(“在哪里实现”)。
- 向量数据库与特征存储的比较: 特征存储是用于管理模型训练和推理所用特征的集中式存储库,可确保一致性。虽然它处理特征数据,但其主要目标并不是优化向量数据库所定义的基于相似度的检索查询。
- 向量数据库与数据湖的比较: 数据湖以原生格式存储海量原始数据。向量数据库存储这些数据经过处理后的数学表示(嵌入),专门针对相似性搜索进行了优化。
与现代 AI 工作流的集成#
实施向量数据库通常需要构建一条数据管道,在其中,高效的 YOLO26等模型充当嵌入引擎。这些模型在边缘端或云端处理视觉数据,随后将生成的向量推送到 Pinecone、Milvus或 Qdrant等解决方案中。
对于希望简化整个生命周期(从数据整理和自动标注到模型训练与部署)的团队,Ultralytics Platform提供了全面的环境。通过将模型训练与高效的部署策略相结合,开发者可以确保输入向量数据库的嵌入准确无误,从而获得更高质量的搜索结果和更智能的 AI 代理。









