返回 Ultralytics 术语表
Small Language Models (SLMs)
了解小型语言模型(SLM)如何在边缘设备上实现高效、私密且低成本的 AI。学习如何将 SLM 与 Ultralytics YOLO26 搭配,用于边缘 AI。
小型语言模型(SLMs)是经过精简的人工智能模型,旨在高效理解和生成自然语言。与大型模型相比,SLMs 通常包含数百万到约 150 亿个参数,因此可以在边缘设备上本地运行,而不必依赖庞大的云计算基础设施。通过本地运行,这些模型能够加快处理速度、增强用户隐私,并显著降低部署成本。
区分关键术语#
为了更好地了解 AI 领域,有必要将 SLMs 与相关技术区分开来:
- **SLMs 与 大型语言模型 (LLMs)的对比:**LLMs 包含数千亿个参数,需要大量服务器资源,而 SLMs 则经过高度优化。这使 SLMs 能够以极低的推理延迟运行,非常适合不需要大规模算力的专业化、特定领域应用。
- **SLMs 与 视觉语言模型 (VLMs)的对比:**SLMs 主要专注于自然语言处理任务。相比之下,VLMs 能够原生理解文本和图像。不过,许多开发者现在会将 SLMs 与快速视觉模型搭配使用,构建轻量级多模态系统。
实际应用#
小型语言模型正迅速改变各行各业,将先进智能直接带入消费电子设备和企业网络。
- **设备端虚拟助手:**现代智能手机和物联网设备利用 SLMs 在本地处理语音指令。这不仅能确保实时响应,还能让敏感数据留在硬件设备上。Microsoft 的 Phi-3和Apple 的 OpenELM等先进模型正在引领这场设备端变革。
- **特定领域的聊天机器人:**企业会部署经过高度微调的 SLMs 来自动处理客户支持。将这些紧凑型模型与检索增强生成 (RAG)结合后,企业可以安全地查询内部数据库并解决问题,而无需依赖昂贵的第三方 API。
- **制造业中的边缘计算:**在智能制造工厂中,SLMs 可以帮助技术人员快速概述复杂的设备手册。将这些系统与实时目标检测模型搭配使用时,它们可以分析外观缺陷,并直接在工厂车间即时生成纯文本诊断报告。
在现代工作流程中实施 SLMs#
2024 年和 2025 年的最新突破证明,高质量训练数据能够让模型达到可与前些年庞大模型媲美的性能。Google 的 Gemma和Meta 的 Llama 3 8B等创新成果,展现了小型架构如今已具备多强的能力。
构建全面的 AI 解决方案时,开发者通常会使用 Python,将 SLM 的语言推理能力与 Ultralytics Platform中工具的视觉精度结合起来。例如,设备端 SLM 可以处理语音指令,启动计算机视觉任务。下面这段简洁代码展示了如何加载轻量级模型,例如 Ultralytics YOLO26,来执行目标跟踪;这项操作非常适合在运行 SLM 的同一台边缘硬件上进行:
from ultralytics import YOLO
# 加载高效的 YOLO26 nano 模型,适用于边缘设备
model = YOLO("yolo26n.pt")
# 在本地视频流上运行实时目标跟踪
results = model.track(source="video.mp4", show=True, tracker="botsort.yaml")优先在本地执行可显著降低带宽需求和运营成本。随着行业不断推进 Edge AI技术的发展,精简的计算机视觉与高效小型语言模型的强强组合,将推动新一代智能自主系统的发展。









